Класс Character
- Все реализуемые интерфейсы:
-
Serializable,Comparable<Character>,Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Character — это оберточная оболочка для значений примитивного типа char. Объект типа Character содержит единственное поле типа char. Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.) и для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие стандарту Unicode
Поля и методы класса Character определяются в соответствии с информацией о символах из стандарта Unicode, в частности, с файлом UnicodeData, который является частью базы данных символов Unicode. Этот файл определяет свойства, включая имя и категорию, для каждого назначенного кодового значения или диапазона символов Unicode. Файл доступен от Консорциума Unicode по адресу http://www.unicode.org.
Информация о символах основана на стандарте Unicode, версия 16.0.
Платформа Java поддерживала различные версии стандарта Unicode на протяжении времени. Обновления до более новых версий стандарта Unicode происходили в следующих выпусках Java, каждый из которых указывает новую версию:
| Выпуск Java | Версия Unicode |
|---|---|
| Java SE 24 | Unicode 16.0 |
| Java SE 22 | Unicode 15.1 |
| Java SE 20 | Unicode 15.0 |
| Java SE 19 | Unicode 14.0 |
| Java SE 15 | Unicode 13.0 |
| Java SE 13 | Unicode 12.1 |
| Java SE 12 | Unicode 11.0 |
| Java SE 11 | Unicode 10.0 |
| Java SE 9 | Unicode 8.0 |
| Java SE 8 | Unicode 6.2 |
| Java SE 7 | Unicode 6.0 |
| Java SE 5.0 | Unicode 4.0 |
| Java SE 1.4 | Unicode 3.0 |
| JDK 1.1 | Unicode 2.0 |
| JDK 1.0.2 | Unicode 1.1.5 |
Представления символов Unicode
Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основаны на исходном спецификации Unicode, которая определяла символы как сущности фиксированной длины 16 бит. Стандарт Unicode с тех пор был изменён, чтобы позволить символы, чьё представление требует более 16 бит. Диапазон допустимых кодовых точек теперь от U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда называется Базовой многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первое из диапазона высоких суррогатов (\uD800-\uDBFF), второе из диапазона низких суррогатов (\uDC00-\uDFFF).
Значение char, следовательно, представляет кодовые точки Базовой многоязычной плоскости (BMP), включая суррогатные кодовые точки или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Нижние (самые младшие) 21 бит значения int используются для представления кодовых точек Unicode, а верхние (самые старшие) 11 бит должны быть нулями. Если не указано иное, поведение относительно дополнительных символов и суррогатных char значений следующее:
- Методы, принимающие только значение
char, не могут поддерживать дополнительные символы. Они рассматриваютcharзначения из суррогатных диапазонов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, даже если это конкретное значение, если за ним следует любое низкое суррогатное значение в строке, представляло бы букву. - Методы, принимающие значение
int, поддерживают все символы Unicode, включая дополнительные символы. Например,Character.isLetter(0x2F81A)возвращаетtrue, потому что кодовое значение точки представляет букву (китайский иероглиф).
В документации API Java SE используется термин кодовая точка Unicode для значений символов в диапазоне от U+0000 до U+10FFFF, а единица кода Unicode используется для 16-битных char значений, которые являются единицами кода кодировки UTF-16. Для получения дополнительной информации о терминологии Unicode обратитесь к Словарю Unicode.
Это безусловный класс; программисты должны рассматривать экземпляры, которые равны, как взаимозаменяемые и не должны использовать их для синхронизации, иначе может произойти непредсказуемое поведение. Например, в будущей версии синхронизация может потерпеть неудачу.
- С:
- 1.0
- Внешние спецификации
- См. также:
Краткое описание вложенных классов
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class |
Character.Subset |
Экземпляры этого класса представляют собой определённые подмножества набора символов Unicode. |
static final class |
Character.UnicodeBlock |
Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode. |
static enum |
Character.UnicodeScript |
Семейство подмножеств символов, представляющих наборы символов, определённые в Приложении стандарта Unicode #24: Имена наборов символов. |
Краткое описание полей
| Модификатор и тип | Поле | Описание |
|---|---|---|
static final int |
BYTES |
Количество байтов, используемых для представления значения char в форме беззнакового двоичного кода. |
static final byte |
COMBINING_SPACING_MARK |
Общая категория "Mc" в спецификации Unicode. |
static final byte |
CONNECTOR_PUNCTUATION |
Общая категория "Pc" в спецификации Unicode. |
static final byte |
CONTROL |
Общая категория "Cc" в спецификации Unicode. |
static final byte |
CURRENCY_SYMBOL |
Общая категория "Sc" в спецификации Unicode. |
static final byte |
DASH_PUNCTUATION |
Общая категория "Pd" в спецификации Unicode. |
static final byte |
DECIMAL_DIGIT_NUMBER |
Общая категория "Nd" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_ARABIC_NUMBER |
Слабый тип бинационального символа "AN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL |
Слабый тип бинационального символа "BN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR |
Слабый тип бинационального символа "CS" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER |
Слабый тип бинационального символа "EN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR |
Слабый тип бинационального символа "ES" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR |
Слабый тип бинационального символа "ET" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_FIRST_STRONG_ISOLATE |
Слабый тип бинационального символа "FSI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT |
Сильный тип бинационального символа "L" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING |
Сильный тип бинационального символа "LRE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE |
Слабый тип бинационального символа "LRI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE |
Сильный тип бинационального символа "LRO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_NONSPACING_MARK |
Слабый тип бинационального символа "NSM" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_OTHER_NEUTRALS |
Нейтральный тип бинационального символа "ON" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR |
Нейтральный тип бинационального символа "B" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT |
Слабый тип бинационального символа "PDF" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE |
Слабый тип бинационального символа "PDI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT |
Сильный тип бинационального символа "R" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC |
Сильный тип бинационального символа "AL" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING |
Сильный тип бинационального символа "RLE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE |
Слабый тип бинационального символа "RLI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE |
Сильный тип бинационального символа "RLO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_SEGMENT_SEPARATOR |
Нейтральный тип бинационального символа "S" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_UNDEFINED |
Неопределенный тип бинационального символа. |
static final byte |
DIRECTIONALITY_WHITESPACE |
Нейтральный тип бинационального символа "WS" в спецификации Unicode. |
static final byte |
ENCLOSING_MARK |
Общая категория "Me" в спецификации Unicode. |
static final byte |
END_PUNCTUATION |
Общая категория "Pe" в спецификации Unicode. |
static final byte |
FINAL_QUOTE_PUNCTUATION |
Общая категория "Pf" в спецификации Unicode. |
static final byte |
FORMAT |
Общая категория "Cf" в спецификации Unicode. |
static final byte |
INITIAL_QUOTE_PUNCTUATION |
Общая категория "Pi" в спецификации Unicode. |
static final byte |
LETTER_NUMBER |
Общая категория "Nl" в спецификации Unicode. |
static final byte |
LINE_SEPARATOR |
Общая категория "Zl" в спецификации Unicode. |
static final byte |
LOWERCASE_LETTER |
Общая категория "Ll" в спецификации Unicode. |
static final byte |
MATH_SYMBOL |
Общая категория "Sm" в спецификации Unicode. |
static final int |
MAX_CODE_POINT |
Максимальное значение кодовой точки Unicode, константа U+10FFFF. |
static final char |
MAX_HIGH_SURROGATE |
Максимальное значение кодового блока Unicode высокого замещения в кодировке UTF-16, константа '\uDBFF'. |
static final char |
MAX_LOW_SURROGATE |
Максимальное значение кодового блока Unicode низкого замещения в кодировке UTF-16, константа '\uDFFF'. |
static final int |
MAX_RADIX |
Максимальное основание, доступное для преобразования в и из строк. |
static final char |
MAX_SURROGATE |
Максимальное значение кодового блока замещения Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final char |
MAX_VALUE |
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'. |
static final int |
MIN_CODE_POINT |
Минимальное значение кодовой точки Unicode, константа U+0000. |
static final char |
MIN_HIGH_SURROGATE |
Минимальное значение кодового блока Unicode высокого замещения в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_LOW_SURROGATE |
Минимальное значение кодового блока Unicode низкого замещения в кодировке UTF-16, константа '\uDC00'. |
static final int |
MIN_RADIX |
Минимальное основание, доступное для преобразования в и из строк. |
static final int |
MIN_SUPPLEMENTARY_CODE_POINT |
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000. |
static final char |
MIN_SURROGATE |
Минимальное значение кодового блока замещения Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_VALUE |
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'. |
static final byte |
MODIFIER_LETTER |
Общая категория "Lm" в спецификации Unicode. |
static final byte |
MODIFIER_SYMBOL |
Общая категория "Sk" в спецификации Unicode. |
static final byte |
NON_SPACING_MARK |
Общая категория "Mn" в спецификации Unicode. |
static final byte |
OTHER_LETTER |
Общая категория "Lo" в спецификации Unicode. |
static final byte |
OTHER_NUMBER |
Общая категория "No" в спецификации Unicode. |
static final byte |
OTHER_PUNCTUATION |
Общая категория "Po" в спецификации Unicode. |
static final byte |
OTHER_SYMBOL |
Общая категория "So" в спецификации Unicode. |
static final byte |
PARAGRAPH_SEPARATOR |
Общая категория "Zp" в спецификации Unicode. |
static final byte |
PRIVATE_USE |
Общая категория "Co" в спецификации Unicode. |
static final int |
SIZE |
Количество бит, используемых для представления значения char в беззнаковом двоичном формате, константа 16. |
static final byte |
SPACE_SEPARATOR |
Общая категория "Zs" в спецификации Unicode. |
static final byte |
START_PUNCTUATION |
Общая категория "Ps" в спецификации Unicode. |
static final byte |
SURROGATE |
Общая категория "Cs" в спецификации Unicode. |
static final byte |
TITLECASE_LETTER |
Общая категория "Lt" в спецификации Unicode. |
static final Class |
TYPE |
Экземпляр Class, представляющий примитивный тип char. |
static final byte |
UNASSIGNED |
Общая категория "Cn" в спецификации Unicode. |
static final byte |
UPPERCASE_LETTER |
Общая категория "Lu" в спецификации Unicode. |
Краткое описание конструкторов
| Конструктор | Описание |
|---|---|
Character |
Устаревший, подлежит удалению: Этот элемент API может быть удален в будущей версии. Использование этого конструктора редко уместно. |
Краткое описание методов
| Modifier and Type | Method | Description |
|---|---|---|
static int |
charCount |
Определяет количество char значений, необходимых для представления указанного символа (Unicode code point). |
char |
charValue() |
Возвращает значение этого объекта Character. |
static int |
codePointAt |
Возвращает код символа по заданному индексу массива char. |
static int |
codePointAt |
Возвращает код символа по заданному индексу массива char, где используются только элементы массива с index меньше, чем limit. |
static int |
codePointAt |
Возвращает код символа по заданному индексу CharSequence. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу массива char. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу массива char, где используются только элементы массива с index больше или равно start. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу CharSequence. |
static int |
codePointCount |
Возвращает количество Unicode code points в подмассиве массива char. |
static int |
codePointCount |
Возвращает количество Unicode code points в заданном диапазоне символов последовательности. |
static int |
codePointOf |
Возвращает значение code point Unicode символа, заданного его именем. |
static int |
compare |
Сравнивает два значения char по числовому значению. |
int |
compareTo |
Сравнивает два объекта Character по числовому значению. |
Optional |
describeConstable() |
Возвращает Optional объект, содержащий номинальный дескриптор для этого экземпляра. |
static int |
digit |
Возвращает числовое значение символа ch в заданном формате. |
static int |
digit |
Возвращает числовое значение указанного символа (Unicode code point) в заданной системе счисления. |
boolean |
equals |
Сравнивает этот объект с указанным объектом. |
static char |
forDigit |
Определяет текстовое представление цифры в заданной системе счисления. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для данного символа. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для данного символа (Unicode code point). |
static String |
getName |
Возвращает имя указанного символа codePoint или null, если code point - unassigned. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный Unicode символ. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ (Unicode code point). |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
int |
hashCode() |
Возвращает хэш-код для этого объекта Character, равный результату вызова charValue(). |
static int |
hashCode |
Возвращает хэш-код для значения char, совместимого с Character.hashCode(). |
static char |
highSurrogate |
Возвращает ведущий суррогат (высокий суррогатный код) пары суррогатов, представляющей указанный дополнительный символ (Unicode code point) в кодировке UTF-16. |
static boolean |
isAlphabetic |
Определяет, является ли указанный символ (Unicode code point) буквенным. |
static boolean |
isBmpCodePoint |
Определяет, находится ли указанный символ (Unicode code point) в основной многоязычной плоскости (BMP). |
static boolean |
isDefined |
Определяет, определён ли символ в Unicode. |
static boolean |
isDefined |
Определяет, определён ли символ (Unicode code point) в Unicode. |
static boolean |
isDigit |
Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit |
Определяет, является ли указанный символ (Unicode code point) цифрой. |
static boolean |
isEmoji |
Определяет, является ли указанный символ (Unicode code point) эмодзи. |
static boolean |
isEmojiComponent |
Определяет, является ли указанный символ (Unicode code point) компонентом эмодзи. |
static boolean |
isEmojiModifier |
Определяет, является ли указанный символ (Unicode code point) модификатором эмодзи. |
static boolean |
isEmojiModifierBase |
Определяет, является ли указанный символ (Unicode code point) базовым модификатором эмодзи. |
static boolean |
isEmojiPresentation |
Определяет, имеет ли указанный символ (Unicode code point) свойство отображения эмодзи по умолчанию. |
static boolean |
isExtendedPictographic |
Определяет, является ли указанный символ (Unicode code point) расширенным пиктографическим символом. |
static boolean |
isHighSurrogate |
Определяет, является ли данное значение char высоким суррогатным кодом Unicode. |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или Unicode. |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли рассматривать указанный символ (Unicode code point) как игнорируемый символ в идентификаторе Java или Unicode. |
static boolean |
isIdeographic |
Определяет, является ли указанный символ CJKV (китайский, японский, корейский и вьетнамский) идеограммой, как определено в стандарте Unicode. |
static boolean |
isISOControl |
Определяет, является ли указанный символ управляющим символом ISO. |
static boolean |
isISOControl |
Определяет, является ли символ (Unicode code point) управляющим символом ISO. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Java, отличного от первого символа. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли символ (Unicode code point) быть частью идентификатора Java, отличного от первого символа. |
static boolean |
isJavaIdentifierStart |
Определяет, может ли указанный символ быть первым символом в идентификаторе Java. |
static boolean |
isJavaIdentifierStart |
Определяет, может ли символ (Unicode code point) быть первым символом в идентификаторе Java. |
static boolean |
isJavaLetter |
Устарело. Заменено на isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit |
Устаревшее. Заменено на isJavaIdentifierPart(char). |
static boolean |
isLetter |
Определяет, является ли указанный символ буквой. |
static boolean |
isLetter |
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой или цифрой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ строчной буквой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ (кодовый пункт Юникода) строчной буквой. |
static boolean |
isLowSurrogate |
Определяет, является ли заданное значение char нижним суррогатным кодовым блоком Юникода (также известным как кодовый блок суррогата-приставки). |
static boolean |
isMirrored |
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isMirrored |
Определяет, является ли указанный символ (кодовый пункт Юникода) зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isSpace |
Устаревшее. Заменено на isWhitespace(char). |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ символом пробела Юникода. |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ (кодовый пункт Юникода) символом пробела Юникода. |
static boolean |
isSupplementaryCodePoint |
Определяет, находится ли указанный символ (кодовый пункт Юникода) в диапазоне дополнительных символов. |
static boolean |
isSurrogate |
Определяет, является ли заданное значение char кодовым блоком суррогата Юникода. |
static boolean |
isSurrogatePair |
Определяет, является ли указанная пара значений char корректной парой суррогатных кодовых блоков Юникода. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ символом заглавной буквы. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ (кодовый пункт Юникода) символом заглавной буквы. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Юникода, не являясь первым символом. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ (кодовый пункт Юникода) быть частью идентификатора Юникода, не являясь первым символом. |
static boolean |
isUnicodeIdentifierStart |
Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUnicodeIdentifierStart |
Определяет, разрешен ли указанный символ (кодовый пункт Юникода) в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ заглавной буквой. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ (кодовый пункт Юникода) заглавной буквой. |
static boolean |
isValidCodePoint |
Определяет, является ли указанный кодовый пункт допустимым кодовым пунктом Юникода. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ символом пробела согласно Java. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ (кодовый пункт Юникода) символом пробела согласно Java. |
static char |
lowSurrogate |
Возвращает суррогат-приставку (нижний суррогат кодовый блок суррогата) пары суррогатов, представляющей указанный дополнительный символ (кодовый пункт Юникода) в кодировке UTF-16. |
static int |
offsetByCodePoints |
Возвращает индекс в заданном подмассиве char, который смещен от заданного index на codePointOffset кодовых пункта. |
static int |
offsetByCodePoints |
Возвращает индекс в заданной последовательности символов, который смещен от заданного index на codePointOffset кодовых пункта. |
static char |
reverseBytes |
Возвращает значение, полученное путем изменения порядка байтов в указанном значении char. |
static char[] |
toChars |
Преобразует указанный символ (кодовый пункт Юникода) в его UTF-16 представление, хранящееся в массиве char. |
static int |
toChars |
Преобразует указанный символ (кодовый пункт Юникода) в его UTF-16 представление. |
static int |
toCodePoint |
Преобразует указанную пару суррогатов в значение дополнительного кодового пункта. |
static char |
toLowerCase |
Преобразует аргумент символа в строчные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toLowerCase |
Преобразует аргумент символа (кодовый пункт Юникода) в строчные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
String |
toString() |
Возвращает объект String, представляющий значение этого Character. |
static String |
toString |
Возвращает объект String, представляющий указанный char. |
static String |
toString |
Возвращает объект String, представляющий указанный символ (кодовый пункт Юникода). |
static char |
toTitleCase |
Преобразует аргумент символа в заглавные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toTitleCase |
Преобразует аргумент символа (кодовый пункт Юникода) в заглавные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
static char |
toUpperCase |
Преобразует аргумент символа в прописные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toUpperCase |
Преобразует аргумент символа (кодовый пункт Юникода) в прописные буквы, используя информацию о преобразовании регистра из файла UnicodeData. |
static Character |
valueOf |
Возвращает экземпляр Character, представляющий заданное значение char. |
Подробное описание полей
MIN_RADIX
public static final int MIN_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MAX_RADIX
public static final int MAX_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MIN_VALUE
public static final char MIN_VALUE
char, '\u0000'.- С:
- 1.0.2
- См. также:
MAX_VALUE
public static final char MAX_VALUE
char, '\uFFFF'.- С:
- 1.0.2
- См. также:
TYPE
public static final Class<Character> TYPE
Class, представляющий примитивный тип char.- С:
- 1.1
НЕНАЗНАЧЕННЫЙ
public static final byte UNASSIGNED
- С:
- 1.1
- См. также:
БУКВА_ВЕРХНЕГО_РЕГИСТРА
public static final byte UPPERCASE_LETTER
- С:
- 1.1
- См. также:
БУКВА_НИЖНЕГО_РЕГИСТРА
public static final byte LOWERCASE_LETTER
- С:
- 1.1
- См. также:
БУКВА_ЗАГОЛОВКА
public static final byte TITLECASE_LETTER
- С:
- 1.1
- См. также:
БУКВА_МОДИФИКАТОРА
public static final byte MODIFIER_LETTER
- С:
- 1.1
- См. также:
ДРУГАЯ_БУКВА
public static final byte OTHER_LETTER
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_БЕЗ_ПРОБЕЛА
public static final byte NON_SPACING_MARK
- С:
- 1.1
- См. также:
ВКЛЮЧАЮЩИЙ_РАЗДЕЛИТЕЛЬ
public static final byte ENCLOSING_MARK
- С:
- 1.1
- См. также:
СОЧЕТАНИЕ_РАЗДЕЛИТЕЛЬ_С_ПРОБЕЛОМ
public static final byte COMBINING_SPACING_MARK
- С:
- 1.1
- См. также:
ДЕСЯТИЧНАЯ_ЦИФРА
public static final byte DECIMAL_DIGIT_NUMBER
- С:
- 1.1
- См. также:
БУКВА_ЦИФРА
public static final byte LETTER_NUMBER
- С:
- 1.1
- См. также:
ДРУГАЯ_ЦИФРА
public static final byte OTHER_NUMBER
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_ПРОБЕЛА
public static final byte SPACE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_СТРОК
public static final byte LINE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_АБЗАЦОВ
public static final byte PARAGRAPH_SEPARATOR
- С:
- 1.1
- См. также:
УПРАВЛЯЮЩИЙ
public static final byte CONTROL
- С:
- 1.1
- См. также:
ФОРМАТ
public static final byte FORMAT
- С момента:
- 1.1
- См. также:
ИСПОЛЬЗОВАНИЕ_В_ЧАСТНЫХ_ЦЕЛЯХ
public static final byte PRIVATE_USE
- С момента:
- 1.1
- См. также:
СУРРОГАТ
public static final byte SURROGATE
- С момента:
- 1.1
- См. также:
ПОДЧЁРТНИК_ПУНКТУАЦИЯ
public static final byte DASH_PUNCTUATION
- С момента:
- 1.1
- См. также:
НАЧАЛЬНАЯ_ПУНКТУАЦИЯ
public static final byte START_PUNCTUATION
- С момента:
- 1.1
- См. также:
КОНЕЧНАЯ_ПУНКТУАЦИЯ
public static final byte END_PUNCTUATION
- С момента:
- 1.1
- См. также:
ПОДКЛЮЧАЮЩАЯ_ПУНКТУАЦИЯ
public static final byte CONNECTOR_PUNCTUATION
- С момента:
- 1.1
- См. также:
ПРОЧАЯ_ПУНКТУАЦИЯ
public static final byte OTHER_PUNCTUATION
- С момента:
- 1.1
- См. также:
МАТЕМАТИЧЕСКИЙ_СИМВОЛ
public static final byte MATH_SYMBOL
- С момента:
- 1.1
- См. также:
СИМВОЛ_ВАЛЮТЫ
public static final byte CURRENCY_SYMBOL
- С момента:
- 1.1
- См. также:
СИМВОЛ_МОДИФИКАТОРА
public static final byte MODIFIER_SYMBOL
- С момента:
- 1.1
- См. также:
ПРОЧИЙ_СИМВОЛ
public static final byte OTHER_SYMBOL
- С момента:
- 1.1
- См. также:
НАЧАЛЬНАЯ_КАВЫЧКА_ПУНКТУАЦИЯ
public static final byte INITIAL_QUOTE_PUNCTUATION
- С момента:
- 1.4
- См. также:
КОНЕЧНАЯ_КАВЫЧКА_ПУНКТУАЦИЯ
public static final byte FINAL_QUOTE_PUNCTUATION
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_НЕОПРЕДЕЛЁННО
public static final byte DIRECTIONALITY_UNDEFINED
char значения имеют неопределённое направление в спецификации Unicode.- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_СЛЕВА_НА_ПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_СПРАВА_НАЛЕВО_АРАБСКОЕ
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_ЕВРОПЕЙСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_РАЗДЕЛИТЕЛЬ_ЕВРОПЕЙСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_ЗАВЕРШИТЕЛЬ_ЕВРОПЕЙСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
- С момента:
- 1.4
- См. также:
НАПРАВЛЕНИЕ_АРАБСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_ARABIC_NUMBER
- С момента:
- 1.4
- См. также:
РАЗДЕЛИТЕЛЬ_ОБЩИХ_ЧИСЕЛ
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
- С момента:
- 1.4
- См. также:
РАЗДЕЛИТЕЛЬ_НЕПОДЧИНЯЮЩИХСЯ_ЗАМЕТОК
public static final byte DIRECTIONALITY_NONSPACING_MARK
- С момента:
- 1.4
- См. также:
НЕЙТРАЛЬНЫЙ_РАЗДЕЛИТЕЛЬ_ГРАНИЦ
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
- С момента:
- 1.4
- См. также:
РАЗДЕЛИТЕЛЬ_АБЗАЦОВ
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
- С момента:
- 1.4
- См. также:
РАЗДЕЛИТЕЛЬ_СЕГМЕНТОВ
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
- С момента:
- 1.4
- См. также:
ПРОБЕЛ
public static final byte DIRECTIONALITY_WHITESPACE
- С момента:
- 1.4
- См. также:
ПРОЧИЕ_НЕЙТРАЛЬНЫЕ
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
- С момента:
- 1.4
- См. также:
ВКЛЮЧЕНИЕ_СЛЕВА_НАПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
- С момента:
- 1.4
- См. также:
ПЕРЕОПРЕДЕЛЕНИЕ_СЛЕВА_НАПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
- С момента:
- 1.4
- См. также:
ВКЛЮЧЕНИЕ_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
- С момента:
- 1.4
- См. также:
ПЕРЕОПРЕДЕЛЕНИЕ_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
- С момента:
- 1.4
- См. также:
ВЫВОД_ФОРМАТА_НАПРАВЛЕНИЯ
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
- С момента:
- 1.4
- См. также:
ИЗОЛИРОВАНИЕ_СЛЕВА_НАПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
- С момента:
- 9
- См. также:
ИЗОЛИРОВАНИЕ_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
- С момента:
- 9
- См. также:
ПЕРВЫЙ_СИЛЬНЫЙ_ИЗОЛИРОВАННЫЙ
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
- С момента:
- 9
- См. также:
ВЫВОД_ИЗОЛИРОВАННОГО_НАПРАВЛЕНИЯ
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
- С момента:
- 9
- См. также:
МИН_ВЫСОКИЙ_СУРРОГАТ
public static final char MIN_HIGH_SURROGATE
'\uD800'. Высокий суррогат также известен как ведущий суррогат.- С момента:
- 1.5
- См. также:
МАКС_ВЫСОКИЙ_СУРРОГАТ
public static final char MAX_HIGH_SURROGATE
'\uDBFF'. Высокий суррогат также известен как ведущий суррогат.- С момента:
- 1.5
- См. также:
МИН_НИЗКИЙ_СУРРОГАТ
public static final char MIN_LOW_SURROGATE
'\uDC00'. Низкий суррогат также известен как завершающий суррогат.- С момента:
- 1.5
- См. также:
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
'\uDFFF'. Низкий суррогат также известен как завершающий суррогат.- Since:
- 1.5
- See Also:
MIN_SURROGATE
public static final char MIN_SURROGATE
'\uD800'.- Since:
- 1.5
- See Also:
MAX_SURROGATE
public static final char MAX_SURROGATE
'\uDFFF'.- Since:
- 1.5
- See Also:
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
U+10000.- Since:
- 1.5
- See Also:
MIN_CODE_POINT
public static final int MIN_CODE_POINT
U+0000.- Since:
- 1.5
- See Also:
MAX_CODE_POINT
public static final int MAX_CODE_POINT
U+10FFFF.- Since:
- 1.5
- See Also:
SIZE
public static final int SIZE
char в беззнаковой двоичной форме, константа 16.- Since:
- 1.5
- See Also:
BYTES
public static final int BYTES
char в беззнаковой двоичной форме.- Since:
- 1.8
- See Also:
Constructor Details
Character
@Deprecated(since="9", forRemoval=true) public Character(char value)
valueOf(char) обычно предпочтительнее, так как он, вероятно, обеспечит значительно лучшую производительность по памяти и времени.Character, который представляет заданное значение char.- Parameters:
-
value- значение, которое будет представлено объектомCharacter.
Method Details
describeConstable
public Optional<DynamicConstantDesc<Character>> describeConstable()
Optional, содержащий номинальный дескриптор для этого экземпляра.- Specified by:
-
describeConstableв интерфейсеConstable - Returns:
- an
Optional, описывающий экземпляр Character - Since:
- 15
valueOf
public static Character valueOf(char c)
Character, представляющий заданное значение char. Если новый экземпляр Character не требуется, этот метод обычно предпочтительнее конструктора Character(char), так как этот метод, вероятно, обеспечит значительно лучшую производительность по памяти и времени, кэшируя часто запрашиваемые значения. Этот метод всегда будет кэшировать значения в диапазоне
'\u0000' до '\u007F' включительно, и может кэшировать другие значения за пределами этого диапазона.- Parameters:
-
c- значение char. - Returns:
- экземпляр
Character, представляющийc. - Since:
- 1.5
charValue
public char charValue()
Character.- Returns:
- примитивное значение
char, представленное этим объектом.
hashCode
hashCode
public static int hashCode(char value)
char; совместимый с Character.hashCode().- Parameters:
-
value- Значениеchar, для которого требуется хэш-код. - Returns:
- значение хэш-кода для значения
char. - Since:
- 1.8
equals
public boolean equals(Object obj)
true тогда и только тогда, когда аргумент не null и представляет собой объект Character, который представляет то же значение char, что и этот объект.toString
public String toString()
String, представляющий значение этого объекта Character. Результатом является строка длиной 1, единственным компонентом которой является примитивное значение char, представленное этим объектом Character.toString
public static String toString(char c)
String, представляющий указанное значение char. Результат — строка длиной 1, состоящая только из указанного значения char.- API Note:
- Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод
toString(int). - Parameters:
-
c- значениеcharдля преобразования - Returns:
- строковое представление указанного значения
char - Since:
- 1.4
toString
public static String toString(int codePoint)
String, представляющий указанный символ (код Юникода). Результат — строка длиной 1 или 2, состоящая только из указанного codePoint.- Параметры:
-
codePoint- преобразуемыйcodePoint - Возвращает:
- строковое представление указанного
codePoint - Исключение:
-
IllegalArgumentException- если указанныйcodePointне является валидным кодом Юникода. - С:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
- Параметры:
-
codePoint- проверяемый код Юникода - Возвращает:
-
true, если значение указанного кода находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - С:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
char.isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
- Параметры:
-
codePoint- тестируемый символ (код Юникода) - Возвращает:
-
true, если указанный код находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - С:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
char старшим замещающим кодом (также известным как старший код замещения). Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно;falseв противном случае. - С:
- 1.5
- См. также:
isLowSurrogate
public static boolean isLowSurrogate(char ch)
char младшим замещающим кодом (также известным как следующий код замещения). Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно;falseв противном случае. - С:
- 1.5
- См. также:
isSurrogate
public static boolean isSurrogate(char ch)
char кодом Юникода замещающим кодом. Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
Значение char является замещающим кодом тогда и только тогда, когда оно является либо младшим замещающим кодом, либо старшим замещающим кодом.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно;falseв противном случае. - С:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high, char low)
char валидной парой замещения Юникода. Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Параметры:
-
high- старшее замещающее значение кода, которое будет проверено -
low- младшее замещающее значение кода, которое будет проверено - Возвращает:
-
true, если указанные старшее и младшее замещающие значения кода представляют валидную пару замещения;falseв противном случае. - С:
- 1.5
charCount
public static int charCount(int codePoint)
char, необходимых для представления указанного символа (кода Юникода). Если указанный символ равен или больше 0x10000, метод возвращает 2. В противном случае метод возвращает 1. Этот метод не проверяет, является ли указанный символ допустимым кодом Юникода. Вызывающий метод должен проверить значение символа с помощью isValidCodePoint, если необходимо.
- Параметры:
-
codePoint- тестируемый символ (код Юникода). - Возвращает:
- 2, если символ является допустимым дополнительным символом; 1 в противном случае.
- С:
- 1.5
- См. также:
toCodePoint
public static int toCodePoint(char high, char low)
isSurrogatePair, если необходимо.- Параметры:
-
high- старший замещающий код -
low- младший замещающий код - Возвращает:
- дополнительный код Юникода, составленный из указанной пары замещения.
- С:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq, int index)
CharSequence. Если значение char в заданном индексе CharSequence находится в диапазоне старших замещающих кодов, следующий индекс меньше длины CharSequence, и значение char в следующем индексе находится в диапазоне младших замещающих кодов, то возвращается дополнительный код Юникода, соответствующий этой паре замещения. В противном случае возвращается значение char в заданном индексе.- Параметры:
-
seq- последовательность значенийchar(единиц кодирования Юникода) -
index- индекс значенийchar(единиц кодирования Юникода) вseqдля преобразования - Возвращает:
- код Юникода в заданном индексе
- Исключение:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если значениеindexотрицательное или не меньшеseq.length(). - С:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index)
char. Если значение char по заданному индексу в массиве char находится в диапазоне высоких суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу находится в диапазоне низких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по заданному индексу.- Параметры:
-
a- массивchar -
index- индекс к значениямchar(единицы кода Юникода) в массивеcharдля преобразования - Возвращаемое значение:
- код символа Юникода по заданному индексу
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньше длины массиваchar. - С:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index, int limit)
char, где используются только элементы массива с индексом, меньшим чем limit. Если значение char по заданному индексу в массиве char находится в диапазоне высоких суррогатов, следующий индекс меньше limit, а значение char по следующему индексу находится в диапазоне низких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по заданному индексу.- Параметры:
-
a- массивchar -
index- индекс к значениямchar(единицы кода Юникода) в массивеcharдля преобразования -
limit- индекс после последнего элемента массива, который можно использовать в массивеchar - Возвращаемое значение:
- код символа Юникода по заданному индексу
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexотрицателен или не меньше аргументаlimit, или если аргументlimitотрицателен или больше длины массиваchar. - С:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq, int index)
CharSequence. Если значение char по индексу (index - 1) в CharSequence находится в диапазоне низких суррогатов, (index - 2) не отрицательно, и значение char по индексу (index - 2) в CharSequence находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
seq- экземплярCharSequence -
index- индекс, следующий за кодом символа, который должен быть возвращен - Возвращаемое значение:
- значение кода символа Юникода перед заданным индексом.
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или большеseq.length(). - С:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index)
char. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатов, (index - 2) не отрицательно, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
a- массивchar -
index- индекс, следующий за кодом символа, который должен быть возвращен - Возвращаемое значение:
- значение кода символа Юникода перед заданным индексом.
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или больше длины массиваchar - С:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index, int start)
char, где используются только элементы массива с индексом, большим или равным start. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатов, (index - 2) не меньше start, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
a- массивchar -
index- индекс, следующий за кодом символа, который должен быть возвращен -
start- индекс первого элемента массива в массивеchar - Возвращаемое значение:
- значение кода символа Юникода перед заданным индексом.
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexне больше аргументаstartили больше длины массиваchar, или если аргументstartотрицателен или не меньше длины массиваchar. - С:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint- дополнительный символ (код символа Юникода) - Возвращаемое значение:
- ведущая суррогат код-единица, используемая для представления символа в кодировке UTF-16
- С:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint- дополнительный символ (код символа Юникода) - Возвращаемое значение:
- заключительная суррогат код-единица, используемая для представления символа в кодировке UTF-16
- С:
- 1.7
toChars
public static int toChars(int codePoint, char[] dst, int dstIndex)
dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогатов сохраняются в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.- Параметры:
-
codePoint- символ (код Юникода), который необходимо преобразовать. -
dst- массивchar, в котором хранится значение UTF-16 символа. -
dstIndex- начальный индекс в массивеdst, где хранится преобразованное значение. - Возвращает:
- 1, если код символа — код BMP, 2, если код символа — дополнительный код.
- Исключение:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Юникода. -
NullPointerException- если указанныйdstравен null. -
IndexOutOfBoundsException- еслиdstIndexотрицательно или не меньшеdst.length, или если вdstпо индексуdstIndexнедостаточно элементов массива для хранения результатаchar(еслиdstIndexравноdst.length-1, и указанныйcodePoint— дополнительный символ, значение высокого суррогата не сохраняется вdst[dstIndex]). - С:
- 1.5
toChars
public static char[] toChars(int codePoint)
char. Если указанный код символа является значением BMP (Базовый многоязычный план или план 0), то результирующий массив char имеет то же значение, что и codePoint. Если указанный код символа является дополнительным кодом, результирующий массив char имеет соответствующую пару суррогатов.- Параметры:
-
codePoint- код Юникода. - Возвращает:
- массив
char, содержащий UTF-16 представлениеcodePoint. - Исключение:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Юникода. - С:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
beginIndex и простирается до char с индексом endIndex - 1. Таким образом, длина (в char) текстового диапазона равна endIndex-beginIndex. Непарные суррогаты в текстовом диапазоне считаются по одному символу Юникода.- Параметры:
-
seq- последовательность символов -
beginIndex- индекс первогоcharтекстового диапазона. -
endIndex- индекс после последнегоcharтекстового диапазона. - Возвращает:
- количество символов Юникода в указанном текстовом диапазоне
- Исключение:
-
NullPointerException- еслиseqравен null. -
IndexOutOfBoundsException- еслиbeginIndexотрицательный, илиendIndexбольше длины заданной последовательности, илиbeginIndexбольше чемendIndex. - С:
- 1.5
codePointCount
public static int codePointCount(char[] a, int offset, int count)
char. Аргумент offset — индекс первого char подмассива, а аргумент count задаёт длину подмассива в char. Непарные суррогаты в подмассиве считаются по одному символу Юникода.- Параметры:
-
a- массивchar -
offset- индекс первогоcharв заданном массивеchar -
count- длина подмассива вchar - Возвращает:
- количество символов Юникода в указанном подмассиве
- Исключение:
-
NullPointerException- еслиaравен null. -
IndexOutOfBoundsException- еслиoffsetилиcountотрицательные, или еслиoffset + countбольше длины данного массива. - С:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
index на codePointOffset символов Юникода. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу Юникода.- Параметры:
-
seq- последовательность символов -
index- индекс, который необходимо сместить -
codePointOffset- смещение в символах Юникода - Возвращает:
- индекс в последовательности символов
- Исключение:
-
NullPointerException- еслиseqравен null. -
IndexOutOfBoundsException- еслиindexотрицательный или больше длины последовательности символов, или еслиcodePointOffsetположительный, и подпоследовательность, начинающаяся сindex, содержит меньше, чемcodePointOffsetсимволов Юникода, или еслиcodePointOffsetотрицательный, и подпоследовательность передindexсодержит меньше, чем абсолютное значениеcodePointOffsetсимволов Юникода. - С:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
char, который смещён относительно данного index на codePointOffset символов Юникода. Аргументы start и count задают подмассив массива char. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу Юникода.- Параметры:
-
a- массивchar -
start- индекс первогоcharподмассива -
count- длина подмассива вchar -
index- индекс, который необходимо сместить -
codePointOffset- смещение в символах Юникода - Возвращает:
- индекс в подмассиве
- Исключение:
-
NullPointerException- еслиaравен null. -
IndexOutOfBoundsException- еслиstartилиcountотрицательные, или еслиstart + countбольше длины данного массива, или еслиindexменьшеstartили большеstart + count, или еслиcodePointOffsetположительный, и текстовый диапазон, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньше, чемcodePointOffsetсимволов Юникода, или еслиcodePointOffsetотрицательный, и текстовый диапазон, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше, чем абсолютное значениеcodePointOffsetсимволов Юникода. - С:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Символ является строчной буквой, если его тип общей категории, предоставленный методом Character.getType(ch), равен LOWERCASE_LETTER, или если он обладает дополнительным свойством Other_Lowercase, как определено в стандарте Юникод.
Вот примеры символов строчных букв:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Юникода также являются символами строчных букв.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isLowerCase(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является строчной буквой;falseв противном случае. - См. также:
isLowerCase
public static boolean isLowerCase(int codePoint)
Символ является строчной буквой, если его тип общей категории, предоставленный методом getType(codePoint), равен LOWERCASE_LETTER, или если он обладает дополнительным свойством Other_Lowercase, как определено в стандарте Юникод.
Вот примеры символов строчных букв:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Юникода также являются символами строчных букв.
- Параметры:
-
codePoint- проверяемый символ (код Юникода). - Возвращает:
-
true, если символ является строчной буквой;falseв противном случае. - С:
- 1.5
- См. также:
isUpperCase
public static boolean isUpperCase(char ch)
Символ является заглавной буквой, если его тип общей категории, предоставленной Character.getType(ch), является UPPERCASE_LETTER или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Ниже приведены примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isUpperCase(int).
- Параметры:
-
ch— тестируемый символ. - Возвращает:
-
true, если символ является заглавной буквой;falseв противном случае. - С:
- 1.0
- См. также:
isUpperCase
public static boolean isUpperCase(int codePoint)
Символ является заглавной буквой, если его тип общей категории, предоставленной getType(codePoint), является UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Ниже приведены примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
- Параметры:
-
codePoint— тестируемый символ (код точки Unicode). - Возвращает:
-
true, если символ является заглавной буквой;falseв противном случае. - С:
- 1.5
- См. также:
isTitleCase
public static boolean isTitleCase(char ch)
Символ является заглавной буквой в стиле заголовка, если его тип общей категории, предоставленной Character.getType(ch), является TITLECASE_LETTER.
Некоторые символы похожи на пары латинских букв. Например, существует заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей для рендеринга слова строчными буквами с заглавными начальными буквами, как в заголовках книг.
Вот некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются заглавными буквами в стиле заголовка.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isTitleCase(int).
- Параметры:
-
ch— тестируемый символ. - Возвращает:
-
true, если символ является заглавной буквой в стиле заголовка;falseв противном случае. - С:
- 1.0.2
- См. также:
isTitleCase
public static boolean isTitleCase(int codePoint)
Символ является заглавной буквой в стиле заголовка, если его тип общей категории, предоставленной getType(codePoint), является TITLECASE_LETTER.
Некоторые символы похожи на пары латинских букв. Например, существует заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей для рендеринга слова строчными буквами с заглавными начальными буквами, как в заголовках книг.
Вот некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются заглавными буквами в стиле заголовка.
- Параметры:
-
codePoint— тестируемый символ (код точки Unicode). - Возвращает:
-
true, если символ является заглавной буквой в стиле заголовка;falseв противном случае. - С:
- 1.5
- См. также:
isDigit
public static boolean isDigit(char ch)
Символ является цифрой, если его тип общей категории, предоставленной Character.getType(ch), является DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', деванагари цифры -
'\uFF10'по'\uFF19', полноширинные цифры
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDigit(int).
- Параметры:
-
ch— тестируемый символ. - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - См. также:
isDigit
public static boolean isDigit(int codePoint)
Символ является цифрой, если его тип общей категории, предоставленной getType(codePoint), является DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', деванагари цифры -
'\uFF10'по'\uFF19', полноширинные цифры
- Параметры:
-
codePoint— тестируемый символ (код точки Unicode). - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isDefined
public static boolean isDefined(char ch)
Символ определен, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Он имеет значение в диапазоне, определенном файлом UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDefined(int).
- Параметры:
-
ch— тестируемый символ - Возвращает:
-
true, если символ имеет определенное значение в Unicode;falseв противном случае. - С:
- 1.0.2
- См. также:
isDefined
public static boolean isDefined(int codePoint)
Символ считается определённым, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Он имеет значение в диапазоне, определённом файлом UnicodeData.
- Параметры:
-
codePoint- проверяемый символ (код точки Unicode). - Возвращает:
-
true, если символ имеет определённое значение в Unicode;falseв противном случае. - С:
- 1.5
- См. также:
isLetter
public static boolean isLetter(char ch)
Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), является любым из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isLetter(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является буквой;falseв противном случае. - См. также:
isLetter
public static boolean isLetter(int codePoint)
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), является одним из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint- проверяемый символ (код точки Unicode). - Возвращает:
-
true, если символ является буквой;falseв противном случае. - С:
- 1.5
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Символ считается буквой или цифрой, если либо Character.isLetter(char ch), либо Character.isDigit(char ch) возвращает true для символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - С:
- 1.0.2
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Символ считается буквой или цифрой, если либо isLetter(codePoint), либо isDigit(codePoint) возвращает true для символа.
- Параметры:
-
codePoint- проверяемый символ (код точки Unicode). - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом пунктуации соединения (например,'_').
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - С:
- 1.0.2
- См. также:
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Символ может быть частью идентификатора Java, если и только если выполняется одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ пунктуации соединения (например,
'_') - это цифра
- это буквенная цифра (например, символ римской цифры)
- это знак сочетания
- это знак без пробела
-
isIdentifierIgnorableвозвращаетtrueдля символа.
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - С:
- 1.0.2
- См. также:
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Символ считается буквенным, если его тип общей категории, предоставленной getType(codePoint), является одним из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Parameters:
-
codePoint- тестируемый символ (кодовая точка Юникода). - Returns:
-
true, если символ является буквенным символом Юникода,falseв противном случае. - Since:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
- Parameters:
-
codePoint- тестируемый символ (кодовая точка Юникода). - Returns:
-
true, если символ является идеограммой Юникода,falseв противном случае. - Since:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительной пунктуации (например,'_').
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).
- Parameters:
-
ch- тестируемый символ. - Returns:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - указанный символ является символом валюты (например,
'$') - указанный символ является символом соединительной пунктуации (например,
'_').
- Parameters:
-
codePoint- тестируемый символ (кодовая точка Юникода). - Returns:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.5
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительной пунктуации (например,
'_') - это цифра
- это буквенно-цифровой символ (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).
- Parameters:
-
ch- тестируемый символ. - Returns:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительной пунктуации (например,
'_') - это цифра
- это буквенно-цифровой символ (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля кодовой точки
- Parameters:
-
codePoint- тестируемый символ (кодовая точка Юникода). - Returns:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.5
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: По умолчанию идентификаторы стандарта Юникод, со следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Parameters:
-
ch- тестируемый символ. - Returns:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - Since:
- 1.1
- External Specifications
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавлено в Start для обратной совместимости.- Параметры:
-
codePoint- символ (кодовый пункт Юникода), который нужно проверить. - Возвращает:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - С:
- 1.5
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:
- это буква
- это символ соединительной пунктуации (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный диакритический знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавлено в Continue для обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - С:
- 1.1
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:
- это буква
- это символ соединительной пунктуации (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный диакритический знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавлено в Continue для обратной совместимости.- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для проверки. - Возвращает:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - С:
- 1.5
- Внешние спецификации
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Юникода, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является управляющим символом, который можно игнорировать и который может быть частью идентификатора Java или Юникода;falseв противном случае. - С:
- 1.1
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для проверки. - Возвращает:
-
true, если символ является управляющим символом, который можно игнорировать и который может быть частью идентификатора Java или Юникода;falseв противном случае. - С:
- 1.5
- См. также:
isEmoji
public static boolean isEmoji(int codePoint)
Символ считается смайликом, только если он имеет свойство Emoji, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для проверки. - Возвращает:
-
true, если символ является смайликом;falseв противном случае. - С:
- 21
isEmojiPresentation
public static boolean isEmojiPresentation(int codePoint)
Символ считается имеющим свойство Emoji Presentation только в том случае, если он имеет свойство Emoji_Presentation, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно проверить. - Возвращает:
-
true, если символ имеет свойство Emoji Presentation;falseв противном случае. - С:
- 21
isEmojiModifier
public static boolean isEmojiModifier(int codePoint)
Символ считается модификатором Emoji только в том случае, если он имеет свойство Emoji_Modifier, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно проверить. - Возвращает:
-
true, если символ является модификатором Emoji;falseв противном случае. - С:
- 21
isEmojiModifierBase
public static boolean isEmojiModifierBase(int codePoint)
Символ считается базовым модификатором Emoji только в том случае, если он имеет свойство Emoji_Modifier_Base, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно проверить. - Возвращает:
-
true, если символ является базовым модификатором Emoji;falseв противном случае. - С:
- 21
isEmojiComponent
public static boolean isEmojiComponent(int codePoint)
Символ считается компонентом Emoji только в том случае, если он имеет свойство Emoji_Component, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно проверить. - Возвращает:
-
true, если символ является компонентом Emoji;falseв противном случае. - С:
- 21
isExtendedPictographic
public static boolean isExtendedPictographic(int codePoint)
Символ считается расширенным пиктографическим символом только в том случае, если он имеет свойство Extended_Pictographic, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно проверить. - Возвращает:
-
true, если символ является расширенным пиктографическим символом;falseв противном случае. - С:
- 21
toLowerCase
public static char toLowerCase(char ch)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, следует использовать String.toLowerCase() для преобразования символов в нижний регистр. Методы преобразования в нижний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.
Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в нижнем регистре, если он существует; в противном случае, сам символ.
- См. также:
toLowerCase
public static int toLowerCase(int codePoint)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, следует использовать String.toLowerCase() для преобразования символов в нижний регистр. Методы преобразования в нижний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно преобразовать. - Возвращает:
- эквивалент символа в нижнем регистре (кодовое значение Юникода), если он существует; в противном случае, сам символ.
- С:
- 1.5
- См. также:
toUpperCase
public static char toUpperCase(char ch)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, следует использовать String.toUpperCase() для преобразования символов в верхний регистр. Методы преобразования в верхний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.
Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае, сам символ.
- См. также:
toUpperCase
public static int toUpperCase(int codePoint)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, следует использовать String.toUpperCase() для преобразования символов в верхний регистр. Методы преобразования в верхний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.
- Параметры:
-
codePoint- символ (кодовое значение Юникода), который нужно преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае, сам символ.
- С:
- 1.5
- См. также:
toTitleCase
public static char toTitleCase(char ch)
char уже является символом заглавного регистра char, то будет возвращено то же самое значение char. Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в заглавном регистре, если он существует; в противном случае, сам символ.
- С:
- 1.0.2
- См. также:
toTitleCase
public static int toTitleCase(int codePoint)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Параметры:
-
codePoint- символ (код Юникода), который нужно преобразовать. - Возвращает:
- эквивалент символа в заглавной букве, если есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
digit
public static int digit(char ch, int radix)
ch в указанном радиксе. Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:
- Метод
isDigitвозвращаетtrueдля символа, и десятичное значение цифры Юникода символа (или его разложения на один символ) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', и его код меньшеradix + 'A' - 10. В этом случае, возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', и его код меньшеradix + 'a' - 10. В этом случае, возвращаетсяch - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате от A (
'\uFF21') до Z ('\uFF3A'), и его код меньшеradix + '\uFF21' - 10. В этом случае, возвращаетсяch - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате от a (
'\uFF41') до z ('\uFF5A'), и его код меньшеradix + '\uFF41' - 10. В этом случае, возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch- символ для преобразования. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- См. также:
digit
public static int digit(int codePoint, int radix)
Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:
- Метод
isDigit(codePoint)возвращаетtrueдля символа, и десятичное значение цифры Юникода символа (или его разложения на один символ) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', и его код меньшеradix + 'A' - 10. В этом случае, возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', и его код меньшеradix + 'a' - 10. В этом случае, возвращаетсяcodePoint - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате от A (
'\uFF21') до Z ('\uFF3A'), и его код меньшеradix + '\uFF21' - 10. В этом случае, возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате от a (
'\uFF41') до z ('\uFF5A'), и его код меньшеradix + '\uFF41'- 10. В этом случае, возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- С:
- 1.5
- См. также:
getNumericValue
public static int getNumericValue(char ch)
'\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50. Буквы A-Z в их заглавных ('\u0041' через '\u005A'), строчных ('\u0061' через '\u007A') и полных вариантах ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное целое значение; -2, если у символа есть числовое значение, но значение нельзя представить как неотрицательное целое значение; -1, если у символа нет числового значения.
- С:
- 1.1
- См. также:
getNumericValue
public static int getNumericValue(int codePoint)
'\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50. Буквы A-Z в их заглавных ('\u0041' через '\u005A'), строчных ('\u0061' через '\u007A') и полных вариантах ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное целое значение; -2, если у символа есть числовое значение, но значение нельзя представить как неотрицательное целое значение; -1, если у символа нет числового значения.
- С:
- 1.5
- См. также:
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
true только для следующих пяти символов: | Символ | Код | Имя |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является пробелом ISO-LATIN-1;falseв противном случае. - См. также:
isSpaceChar
public static boolean isSpaceChar(char ch)
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isSpaceChar(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является пробелом;falseв противном случае. - С:
- 1.1
- См. также:
isSpaceChar
public static boolean isSpaceChar(int codePoint)
- Параметры:
-
codePoint- проверяемый символ (кодовый пункт Unicode). - Возвращает:
-
true, если символ является пробелом;falseв противном случае. - С:
- 1.5
- См. также:
isWhitespace
public static boolean isWhitespace(char ch)
- Он является символом Unicode-пробела (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isWhitespace(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является пробелом Java;falseв противном случае. - С:
- 1.1
- См. также:
isWhitespace
public static boolean isWhitespace(int codePoint)
- Он является символом Unicode-пробела (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
- Параметры:
-
codePoint- проверяемый символ (кодовый пункт Unicode). - Возвращает:
-
true, если символ является пробелом Java;falseв противном случае. - С:
- 1.5
- См. также:
isISOControl
public static boolean isISOControl(char ch)
'\u0000' — '\u001F' или в диапазоне '\u007F' — '\u009F'. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isISOControl(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - С:
- 1.1
- См. также:
isISOControl
public static boolean isISOControl(int codePoint)
'\u0000' — '\u001F' или в диапазоне '\u007F' — '\u009F'.- Параметры:
-
codePoint- проверяемый символ (кодовый пункт Unicode). - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - С:
- 1.5
- См. также:
getType
public static int getType(char ch)
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод getType(int).
- Параметры:
-
ch- проверяемый символ. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.1
- См. также:
getType
public static int getType(int codePoint)
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С тех пор:
- 1.5
- См. также:
forDigit
public static char forDigit(int digit, int radix)
radix не является допустимым радиксом, или значение digit не является допустимой цифрой в заданном радиксе, возвращается нулевой символ ('\u0000'). Аргумент radix допустим, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.
Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit- число, которое нужно преобразовать в символ. -
radix- радикс. - Возвращает:
- символьное представление указанной цифры в указанном радиксе.
- См. также:
getDirectionality
public static byte getDirectionality(char ch)
char значений равно DIRECTIONALITY_UNDEFINED. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch-char, для которого требуется свойство направленности. - Возвращает:
- свойство направленности значения
char. - С тех пор:
- 1.4
- См. также:
getDirectionality
public static byte getDirectionality(int codePoint)
DIRECTIONALITY_UNDEFINED.- Параметры:
-
codePoint- символ (код Юникода), для которого требуется свойство направленности. - Возвращает:
- свойство направленности символа.
- С тех пор:
- 1.5
- См. также:
isMirrored
public static boolean isMirrored(char ch)
'\u0028' левая скобка по смыслу определена как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch-char, для которого требуется свойство зеркальности. - Возвращает:
-
true, если символ зеркальный,false, если символ не зеркальный или не определен. - С тех пор:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
'\u0028' ЛЕВАЯ СКОБКА семантически определена как открывающая скобка. Она будет отображаться как «(» в тексте слева направо, но как «)» в тексте справа налево.- Параметры:
-
codePoint- символ (кодовое значение Unicode) для проверки. - Возвращает:
-
true, если символ зеркальный;false, если символ не зеркальный или не определён. - С версии:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
Character численно.- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter- объектCharacterдля сравнения. - Возвращает:
- значение
0, если переданный аргументCharacterравен этому объектуCharacter; значение меньше0, если этот объектCharacterчисленно меньше аргументаCharacter; и значение больше0, если этот объектCharacterчисленно больше аргументаCharacter(сравнение без учёта знака). Обратите внимание, что это строго численное сравнение; оно не зависит от локали. - С версии:
- 1.2
compare
public static int compare(char x, char y)
char численно. Возвращаемое значение идентично тому, что было бы возвращено:
Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x- первое значение типаcharдля сравнения -
y- второе значение типаcharдля сравнения - Возвращает:
- значение
0, еслиx == y; значение меньше0, еслиx < y; и значение больше0, еслиx > y - С версии:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
char.- Параметры:
-
ch- Значение типаchar, для которого требуется перестановка байтов. - Возвращает:
- значение, полученное путём перестановки (или, эквивалентно, обмена) байтов в указанном значении типа
char. - С версии:
- 1.5
getName
public static String getName(int codePoint)
codePoint или null, если кодовое значение не присвоено unassigned. Если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), возвращаемое имя совпадает с результатом выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для символов в файле UnicodeData имя, возвращаемое этим методом, соответствует схеме именования в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, таких как хангыль/идеограммы, правило генерации имени отличается от правила, определенного в стандарте Unicode.- Параметры:
-
codePoint- символ (кодовое значение Unicode) - Возвращает:
- имя указанного символа или null, если кодовое значение не присвоено.
- Исключения:
-
IllegalArgumentException- если указанноеcodePointне является допустимым кодовым значением Unicode. - С версии:
- 1.7
codePointOf
public static int codePointOf(String name)
Если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), его имя определяется как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Совпадение по имени name не учитывает регистр и удаляет все ведущие и хвостовые пробельные символы. Для кодовых точек в файле UnicodeData этот метод распознаёт имя, соответствующее имени, определённому в разделе «Свойство имени Unicode» в стандарте Unicode. Для других кодовых точек этот метод распознаёт имя, сгенерированное методом getName(int).
- Параметры:
-
name- имя символа - Возвращает:
- числовое кодовое значение Unicode символа, указанного его именем.
- Исключения:
-
IllegalArgumentException- если указанноеnameне является допустимым именем символа. -
NullPointerException- еслиnameявляетсяnull - С версии:
- 9
© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://download.java.net/java/early_access/jdk24/docs/api/java.base/java/lang/Character.html