Spec-Zone.ru › OpenJDK 24

Класс Character

java.lang.Object
java.lang.Character
Все реализуемые интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Класс Character — это оберточная оболочка для значений примитивного типа char. Объект типа Character содержит единственное поле типа char.

Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.) и для преобразования символов из верхнего регистра в нижний и наоборот.

Соответствие стандарту Unicode

Поля и методы класса Character определяются в соответствии с информацией о символах из стандарта Unicode, в частности, с файлом UnicodeData, который является частью базы данных символов Unicode. Этот файл определяет свойства, включая имя и категорию, для каждого назначенного кодового значения или диапазона символов Unicode. Файл доступен от Консорциума Unicode по адресу http://www.unicode.org.

Информация о символах основана на стандарте Unicode, версия 16.0.

Платформа Java поддерживала различные версии стандарта Unicode на протяжении времени. Обновления до более новых версий стандарта Unicode происходили в следующих выпусках Java, каждый из которых указывает новую версию:

Показывает выпуски Java и поддерживаемые версии Unicode
Выпуск Java Версия Unicode
Java SE 24 Unicode 16.0
Java SE 22 Unicode 15.1
Java SE 20 Unicode 15.0
Java SE 19 Unicode 14.0
Java SE 15 Unicode 13.0
Java SE 13 Unicode 12.1
Java SE 12 Unicode 11.0
Java SE 11 Unicode 10.0
Java SE 9 Unicode 8.0
Java SE 8 Unicode 6.2
Java SE 7 Unicode 6.0
Java SE 5.0 Unicode 4.0
Java SE 1.4 Unicode 3.0
JDK 1.1 Unicode 2.0
JDK 1.0.2 Unicode 1.1.5
Отклонения от этих базовых версий Unicode, такие как распознанные приложения, документированы в другом месте.

Представления символов Unicode

Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основаны на исходном спецификации Unicode, которая определяла символы как сущности фиксированной длины 16 бит. Стандарт Unicode с тех пор был изменён, чтобы позволить символы, чьё представление требует более 16 бит. Диапазон допустимых кодовых точек теперь от U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)

Набор символов от U+0000 до U+FFFF иногда называется Базовой многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первое из диапазона высоких суррогатов (\uD800-\uDBFF), второе из диапазона низких суррогатов (\uDC00-\uDFFF).

Значение char, следовательно, представляет кодовые точки Базовой многоязычной плоскости (BMP), включая суррогатные кодовые точки или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Нижние (самые младшие) 21 бит значения int используются для представления кодовых точек Unicode, а верхние (самые старшие) 11 бит должны быть нулями. Если не указано иное, поведение относительно дополнительных символов и суррогатных char значений следующее:

  • Методы, принимающие только значение char, не могут поддерживать дополнительные символы. Они рассматривают char значения из суррогатных диапазонов как неопределённые символы. Например, Character.isLetter('\uD840') возвращает false, даже если это конкретное значение, если за ним следует любое низкое суррогатное значение в строке, представляло бы букву.
  • Методы, принимающие значение int, поддерживают все символы Unicode, включая дополнительные символы. Например, Character.isLetter(0x2F81A) возвращает true, потому что кодовое значение точки представляет букву (китайский иероглиф).

В документации API Java SE используется термин кодовая точка Unicode для значений символов в диапазоне от U+0000 до U+10FFFF, а единица кода Unicode используется для 16-битных char значений, которые являются единицами кода кодировки UTF-16. Для получения дополнительной информации о терминологии Unicode обратитесь к Словарю Unicode.

Это безусловный класс; программисты должны рассматривать экземпляры, которые равны, как взаимозаменяемые и не должны использовать их для синхронизации, иначе может произойти непредсказуемое поведение. Например, в будущей версии синхронизация может потерпеть неудачу.

С:
1.0
Внешние спецификации
  • Unicode 3.1.0
См. также:
  • Сериализованная форма

Краткое описание вложенных классов

Модификатор и тип Класс Описание
static class  Character.Subset
Экземпляры этого класса представляют собой определённые подмножества набора символов Unicode.
static final class  Character.UnicodeBlock
Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode.
static enum  Character.UnicodeScript
Семейство подмножеств символов, представляющих наборы символов, определённые в Приложении стандарта Unicode #24: Имена наборов символов.
END_OF_DOCUMENT_MARKER

Краткое описание полей

Модификатор и тип Поле Описание
static final int BYTES
Количество байтов, используемых для представления значения char в форме беззнакового двоичного кода.
static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип бинационального символа "AN" в спецификации Unicode.
static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип бинационального символа "BN" в спецификации Unicode.
static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип бинационального символа "CS" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип бинационального символа "EN" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип бинационального символа "ES" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип бинационального символа "ET" в спецификации Unicode.
static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый тип бинационального символа "FSI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип бинационального символа "L" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип бинационального символа "LRE" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый тип бинационального символа "LRI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип бинационального символа "LRO" в спецификации Unicode.
static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип бинационального символа "NSM" в спецификации Unicode.
static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип бинационального символа "ON" в спецификации Unicode.
static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип бинационального символа "B" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип бинационального символа "PDF" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый тип бинационального символа "PDI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип бинационального символа "R" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип бинационального символа "AL" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип бинационального символа "RLE" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый тип бинационального символа "RLI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип бинационального символа "RLO" в спецификации Unicode.
static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип бинационального символа "S" в спецификации Unicode.
static final byte DIRECTIONALITY_UNDEFINED
Неопределенный тип бинационального символа.
static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип бинационального символа "WS" в спецификации Unicode.
static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
static final int MAX_CODE_POINT
Максимальное значение кодовой точки Unicode, константа U+10FFFF.
static final char MAX_HIGH_SURROGATE
Максимальное значение кодового блока Unicode высокого замещения в кодировке UTF-16, константа '\uDBFF'.
static final char MAX_LOW_SURROGATE
Максимальное значение кодового блока Unicode низкого замещения в кодировке UTF-16, константа '\uDFFF'.
static final int MAX_RADIX
Максимальное основание, доступное для преобразования в и из строк.
static final char MAX_SURROGATE
Максимальное значение кодового блока замещения Unicode в кодировке UTF-16, константа '\uDFFF'.
static final char MAX_VALUE
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'.
static final int MIN_CODE_POINT
Минимальное значение кодовой точки Unicode, константа U+0000.
static final char MIN_HIGH_SURROGATE
Минимальное значение кодового блока Unicode высокого замещения в кодировке UTF-16, константа '\uD800'.
static final char MIN_LOW_SURROGATE
Минимальное значение кодового блока Unicode низкого замещения в кодировке UTF-16, константа '\uDC00'.
static final int MIN_RADIX
Минимальное основание, доступное для преобразования в и из строк.
static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000.
static final char MIN_SURROGATE
Минимальное значение кодового блока замещения Unicode в кодировке UTF-16, константа '\uD800'.
static final char MIN_VALUE
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'.
static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
END_OF_DOCUMENT_MARKER
static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
static final int SIZE
Количество бит, используемых для представления значения char в беззнаковом двоичном формате, константа 16.
static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.

Краткое описание конструкторов

Конструктор Описание
Character(char value)
Устаревший, подлежит удалению: Этот элемент API может быть удален в будущей версии.
Использование этого конструктора редко уместно.

Краткое описание методов

Modifier and Type Method Description
static int charCount(int codePoint)
Определяет количество char значений, необходимых для представления указанного символа (Unicode code point).
char charValue()
Возвращает значение этого объекта Character.
static int codePointAt(char[] a, int index)
Возвращает код символа по заданному индексу массива char.
static int codePointAt(char[] a, int index, int limit)
Возвращает код символа по заданному индексу массива char, где используются только элементы массива с index меньше, чем limit.
static int codePointAt(CharSequence seq, int index)
Возвращает код символа по заданному индексу CharSequence.
static int codePointBefore(char[] a, int index)
Возвращает код символа, предшествующий заданному индексу массива char.
static int codePointBefore(char[] a, int index, int start)
Возвращает код символа, предшествующий заданному индексу массива char, где используются только элементы массива с index больше или равно start.
static int codePointBefore(CharSequence seq, int index)
Возвращает код символа, предшествующий заданному индексу CharSequence.
static int codePointCount(char[] a, int offset, int count)
Возвращает количество Unicode code points в подмассиве массива char.
static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество Unicode code points в заданном диапазоне символов последовательности.
static int codePointOf(String name)
Возвращает значение code point Unicode символа, заданного его именем.
static int compare(char x, char y)
Сравнивает два значения char по числовому значению.
int compareTo(Character anotherCharacter)
Сравнивает два объекта Character по числовому значению.
Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional объект, содержащий номинальный дескриптор для этого экземпляра.
static int digit(char ch, int radix)
Возвращает числовое значение символа ch в заданном формате.
static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (Unicode code point) в заданной системе счисления.
boolean equals(Object obj)
Сравнивает этот объект с указанным объектом.
static char forDigit(int digit, int radix)
Определяет текстовое представление цифры в заданной системе счисления.
static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для данного символа.
static byte getDirectionality(int codePoint)
Возвращает свойство направленности Unicode для данного символа (Unicode code point).
static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если code point - unassigned.
static int getNumericValue(char ch)
Возвращает значение int, которое представляет указанный Unicode символ.
static int getNumericValue(int codePoint)
Возвращает значение int, которое представляет указанный символ (Unicode code point).
static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
int hashCode()
Возвращает хэш-код для этого объекта Character, равный результату вызова charValue().
static int hashCode(char value)
Возвращает хэш-код для значения char, совместимого с Character.hashCode().
static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (высокий суррогатный код) пары суррогатов, представляющей указанный дополнительный символ (Unicode code point) в кодировке UTF-16.
static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (Unicode code point) буквенным.
static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (Unicode code point) в основной многоязычной плоскости (BMP).
static boolean isDefined(char ch)
Определяет, определён ли символ в Unicode.
static boolean isDefined(int codePoint)
Определяет, определён ли символ (Unicode code point) в Unicode.
static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (Unicode code point) цифрой.
static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (Unicode code point) эмодзи.
static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (Unicode code point) компонентом эмодзи.
static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (Unicode code point) модификатором эмодзи.
static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (Unicode code point) базовым модификатором эмодзи.
static boolean isEmojiPresentation(int codePoint)
Определяет, имеет ли указанный символ (Unicode code point) свойство отображения эмодзи по умолчанию.
static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (Unicode code point) расширенным пиктографическим символом.
static boolean isHighSurrogate(char ch)
Определяет, является ли данное значение char высоким суррогатным кодом Unicode.
static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или Unicode.
static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли рассматривать указанный символ (Unicode code point) как игнорируемый символ в идентификаторе Java или Unicode.
static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ CJKV (китайский, японский, корейский и вьетнамский) идеограммой, как определено в стандарте Unicode.
static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO.
static boolean isISOControl(int codePoint)
Определяет, является ли символ (Unicode code point) управляющим символом ISO.
static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, отличного от первого символа.
static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (Unicode code point) быть частью идентификатора Java, отличного от первого символа.
static boolean isJavaIdentifierStart(char ch)
Определяет, может ли указанный символ быть первым символом в идентификаторе Java.
static boolean isJavaIdentifierStart(int codePoint)
Определяет, может ли символ (Unicode code point) быть первым символом в идентификаторе Java.
static boolean isJavaLetter(char ch)
Устарело.
Заменено на isJavaIdentifierStart(char).
static boolean isJavaLetterOrDigit(char ch)
Устаревшее. Заменено на isJavaIdentifierPart(char).
static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой.
static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой или цифрой.
static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчной буквой.
static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) строчной буквой.
static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char нижним суррогатным кодовым блоком Юникода (также известным как кодовый блок суррогата-приставки).
static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода.
static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) зеркальным в соответствии со спецификацией Юникода.
static boolean isSpace(char ch)
Устаревшее. Заменено на isWhitespace(char).
static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом пробела Юникода.
static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) символом пробела Юникода.
static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовый пункт Юникода) в диапазоне дополнительных символов.
static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char кодовым блоком суррогата Юникода.
static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char корректной парой суррогатных кодовых блоков Юникода.
static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом заглавной буквы.
static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) символом заглавной буквы.
static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Юникода, не являясь первым символом.
static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовый пункт Юникода) быть частью идентификатора Юникода, не являясь первым символом.
static boolean isUnicodeIdentifierStart(char ch)
Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Юникода.
static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, разрешен ли указанный символ (кодовый пункт Юникода) в качестве первого символа в идентификаторе Юникода.
static boolean isUpperCase(char ch)
Определяет, является ли указанный символ заглавной буквой.
static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) заглавной буквой.
static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный кодовый пункт допустимым кодовым пунктом Юникода.
static boolean isWhitespace(char ch)
Определяет, является ли указанный символ символом пробела согласно Java.
static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) символом пробела согласно Java.
static char lowSurrogate(int codePoint)
Возвращает суррогат-приставку (нижний суррогат кодовый блок суррогата) пары суррогатов, представляющей указанный дополнительный символ (кодовый пункт Юникода) в кодировке UTF-16.
static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в заданном подмассиве char, который смещен от заданного index на codePointOffset кодовых пункта.
static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в заданной последовательности символов, который смещен от заданного index на codePointOffset кодовых пункта.
static char reverseBytes(char ch)
Возвращает значение, полученное путем изменения порядка байтов в указанном значении char.
static char[] toChars(int codePoint)
Преобразует указанный символ (кодовый пункт Юникода) в его UTF-16 представление, хранящееся в массиве char.
static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (кодовый пункт Юникода) в его UTF-16 представление.
static int toCodePoint(char high, char low)
Преобразует указанную пару суррогатов в значение дополнительного кодового пункта.
static char toLowerCase(char ch)
Преобразует аргумент символа в строчные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
static int toLowerCase(int codePoint)
Преобразует аргумент символа (кодовый пункт Юникода) в строчные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
String toString()
Возвращает объект String, представляющий значение этого Character.
static String toString(char c)
Возвращает объект String, представляющий указанный char.
static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (кодовый пункт Юникода).
static char toTitleCase(char ch)
Преобразует аргумент символа в заглавные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
static int toTitleCase(int codePoint)
Преобразует аргумент символа (кодовый пункт Юникода) в заглавные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
static char toUpperCase(char ch)
Преобразует аргумент символа в прописные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
static int toUpperCase(int codePoint)
Преобразует аргумент символа (кодовый пункт Юникода) в прописные буквы, используя информацию о преобразовании регистра из файла UnicodeData.
static Character valueOf(char c)
Возвращает экземпляр Character, представляющий заданное значение char.

Методы, объявленные в классе java.lang.Object

clone, finalize, getClass, notify, notifyAll, wait, wait, wait

Подробное описание полей

MIN_RADIX

public static final int MIN_RADIX
Минимальное основание, доступное для преобразования в и из строк. Константа этого поля представляет собой наименьшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения постоянных полей

MAX_RADIX

public static final int MAX_RADIX
Максимальное основание, доступное для преобразования в и из строк. Константа этого поля представляет собой наибольшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения постоянных полей

MIN_VALUE

public static final char MIN_VALUE
Константа этого поля представляет собой наименьшее значение типа char, '\u0000'.
С:
1.0.2
См. также:
  • Значения постоянных полей

MAX_VALUE

public static final char MAX_VALUE
Константа этого поля представляет собой наибольшее значение типа char, '\uFFFF'.
С:
1.0.2
См. также:
  • Значения постоянных полей

TYPE

public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
С:
1.1

НЕНАЗНАЧЕННЫЙ

public static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

БУКВА_ВЕРХНЕГО_РЕГИСТРА

public static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

БУКВА_НИЖНЕГО_РЕГИСТРА

public static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

БУКВА_ЗАГОЛОВКА

public static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

БУКВА_МОДИФИКАТОРА

public static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

ДРУГАЯ_БУКВА

public static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_БЕЗ_ПРОБЕЛА

public static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

ВКЛЮЧАЮЩИЙ_РАЗДЕЛИТЕЛЬ

public static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

СОЧЕТАНИЕ_РАЗДЕЛИТЕЛЬ_С_ПРОБЕЛОМ

public static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

ДЕСЯТИЧНАЯ_ЦИФРА

public static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

БУКВА_ЦИФРА

public static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

ДРУГАЯ_ЦИФРА

public static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_ПРОБЕЛА

public static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_СТРОК

public static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_АБЗАЦОВ

public static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей

УПРАВЛЯЮЩИЙ

public static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
С:
1.1
См. также:
  • Значения постоянных полей
END_OF_DOCUMENT_MARKER

ФОРМАТ

public static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

ИСПОЛЬЗОВАНИЕ_В_ЧАСТНЫХ_ЦЕЛЯХ

public static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

СУРРОГАТ

public static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

ПОДЧЁРТНИК_ПУНКТУАЦИЯ

public static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

НАЧАЛЬНАЯ_ПУНКТУАЦИЯ

public static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

КОНЕЧНАЯ_ПУНКТУАЦИЯ

public static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

ПОДКЛЮЧАЮЩАЯ_ПУНКТУАЦИЯ

public static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

ПРОЧАЯ_ПУНКТУАЦИЯ

public static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

МАТЕМАТИЧЕСКИЙ_СИМВОЛ

public static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

СИМВОЛ_ВАЛЮТЫ

public static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

СИМВОЛ_МОДИФИКАТОРА

public static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

ПРОЧИЙ_СИМВОЛ

public static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
С момента:
1.1
См. также:
  • Значения постоянных полей

НАЧАЛЬНАЯ_КАВЫЧКА_ПУНКТУАЦИЯ

public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

КОНЕЧНАЯ_КАВЫЧКА_ПУНКТУАЦИЯ

public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_НЕОПРЕДЕЛЁННО

public static final byte DIRECTIONALITY_UNDEFINED
Неопределённый тип двунаправленного символа. Неопределённые char значения имеют неопределённое направление в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_СЛЕВА_НА_ПРАВО

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип двунаправленного символа "L" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_СПРАВА_НАЛЕВО

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип двунаправленного символа "R" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_СПРАВА_НАЛЕВО_АРАБСКОЕ

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип двунаправленного символа "AL" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_ЕВРОПЕЙСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип двунаправленного символа "EN" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_РАЗДЕЛИТЕЛЬ_ЕВРОПЕЙСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип двунаправленного символа "ES" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_ЗАВЕРШИТЕЛЬ_ЕВРОПЕЙСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип двунаправленного символа "ET" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НАПРАВЛЕНИЕ_АРАБСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип двунаправленного символа "AN" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_ОБЩИХ_ЧИСЕЛ

public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый двунаправленный тип символа "CS" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_НЕПОДЧИНЯЮЩИХСЯ_ЗАМЕТОК

public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый двунаправленный тип символа "NSM" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

НЕЙТРАЛЬНЫЙ_РАЗДЕЛИТЕЛЬ_ГРАНИЦ

public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый двунаправленный тип символа "BN" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_АБЗАЦОВ

public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный двунаправленный тип символа "B" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

РАЗДЕЛИТЕЛЬ_СЕГМЕНТОВ

public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный двунаправленный тип символа "S" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ПРОБЕЛ

public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный двунаправленный тип символа "WS" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ПРОЧИЕ_НЕЙТРАЛЬНЫЕ

public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный двунаправленный тип символа "ON" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ВКЛЮЧЕНИЕ_СЛЕВА_НАПРАВО

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный двунаправленный тип символа "LRE" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ПЕРЕОПРЕДЕЛЕНИЕ_СЛЕВА_НАПРАВО

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный двунаправленный тип символа "LRO" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ВКЛЮЧЕНИЕ_СПРАВА_НАЛЕВО

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный двунаправленный тип символа "RLE" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ПЕРЕОПРЕДЕЛЕНИЕ_СПРАВА_НАЛЕВО

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный двунаправленный тип символа "RLO" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ВЫВОД_ФОРМАТА_НАПРАВЛЕНИЯ

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый двунаправленный тип символа "PDF" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения постоянных полей

ИЗОЛИРОВАНИЕ_СЛЕВА_НАПРАВО

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый двунаправленный тип символа "LRI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения постоянных полей

ИЗОЛИРОВАНИЕ_СПРАВА_НАЛЕВО

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый двунаправленный тип символа "RLI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения постоянных полей

ПЕРВЫЙ_СИЛЬНЫЙ_ИЗОЛИРОВАННЫЙ

public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый двунаправленный тип символа "FSI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения постоянных полей

ВЫВОД_ИЗОЛИРОВАННОГО_НАПРАВЛЕНИЯ

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый двунаправленный тип символа "PDI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения постоянных полей

МИН_ВЫСОКИЙ_СУРРОГАТ

public static final char MIN_HIGH_SURROGATE
Минимальное значение кодового блока Unicode high-surrogate в кодировке UTF-16, константа '\uD800'. Высокий суррогат также известен как ведущий суррогат.
С момента:
1.5
См. также:
  • Значения постоянных полей

МАКС_ВЫСОКИЙ_СУРРОГАТ

public static final char MAX_HIGH_SURROGATE
Максимальное значение кодового блока Unicode high-surrogate в кодировке UTF-16, константа '\uDBFF'. Высокий суррогат также известен как ведущий суррогат.
С момента:
1.5
См. также:
  • Значения постоянных полей

МИН_НИЗКИЙ_СУРРОГАТ

public static final char MIN_LOW_SURROGATE
Минимальное значение кодового блока Unicode low-surrogate в кодировке UTF-16, константа '\uDC00'. Низкий суррогат также известен как завершающий суррогат.
С момента:
1.5
См. также:
  • Значения постоянных полей

MAX_LOW_SURROGATE

public static final char MAX_LOW_SURROGATE
Максимальное значение кодовой единицы низкого суррогата Unicode в кодировке UTF-16, константа '\uDFFF'. Низкий суррогат также известен как завершающий суррогат.
Since:
1.5
See Also:
  • Значения постоянных полей

MIN_SURROGATE

public static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uD800'.
Since:
1.5
See Also:
  • Значения постоянных полей

MAX_SURROGATE

public static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uDFFF'.
Since:
1.5
See Also:
  • Значения постоянных полей

MIN_SUPPLEMENTARY_CODE_POINT

public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительного кодового пункта Unicode, константа U+10000.
Since:
1.5
See Also:
  • Значения постоянных полей

MIN_CODE_POINT

public static final int MIN_CODE_POINT
Минимальное значение кодового пункта Unicode, константа U+0000.
Since:
1.5
See Also:
  • Значения постоянных полей

MAX_CODE_POINT

public static final int MAX_CODE_POINT
Максимальное значение кодового пункта Unicode, константа U+10FFFF.
Since:
1.5
See Also:
  • Значения постоянных полей

SIZE

public static final int SIZE
Количество бит, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
Since:
1.5
See Also:
  • Значения постоянных полей

BYTES

public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме.
Since:
1.8
See Also:
  • Значения постоянных полей

Constructor Details

Character

@Deprecated(since="9", forRemoval=true) public Character(char value)
Deprecated, for removal: This API element is subject to removal in a future version.
В редких случаях целесообразно использовать этот конструктор. Статический фабричный метод valueOf(char) обычно предпочтительнее, так как он, вероятно, обеспечит значительно лучшую производительность по памяти и времени.
Создаёт новый объект Character, который представляет заданное значение char.
Parameters:
value - значение, которое будет представлено объектом Character.

Method Details

describeConstable

public Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащий номинальный дескриптор для этого экземпляра.
Specified by:
describeConstable в интерфейсе Constable
Returns:
an Optional, описывающий экземпляр Character
Since:
15

valueOf

public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий заданное значение char. Если новый экземпляр Character не требуется, этот метод обычно предпочтительнее конструктора Character(char), так как этот метод, вероятно, обеспечит значительно лучшую производительность по памяти и времени, кэшируя часто запрашиваемые значения. Этот метод всегда будет кэшировать значения в диапазоне '\u0000' до '\u007F' включительно, и может кэшировать другие значения за пределами этого диапазона.
Parameters:
c - значение char.
Returns:
экземпляр Character, представляющий c.
Since:
1.5

charValue

public char charValue()
Возвращает значение этого объекта Character.
Returns:
примитивное значение char, представленное этим объектом.

hashCode

public int hashCode()
Возвращает хэш-код для этого объекта Character; равный результату вызова charValue().
Overrides:
hashCode в классе Object
Returns:
значение хэш-кода для этого объекта Character
See Also:
  • Object.equals(java.lang.Object)
  • System.identityHashCode(java.lang.Object)

hashCode

public static int hashCode(char value)
Возвращает хэш-код для значения char; совместимый с Character.hashCode().
Parameters:
value - Значение char, для которого требуется хэш-код.
Returns:
значение хэш-кода для значения char.
Since:
1.8

equals

public boolean equals(Object obj)
Сравнивает этот объект с указанным объектом. Результат равен true тогда и только тогда, когда аргумент не null и представляет собой объект Character, который представляет то же значение char, что и этот объект.
Overrides:
equals в классе Object
Parameters:
obj - объект для сравнения.
Returns:
true, если объекты идентичны; false в противном случае.
See Also:
  • Object.hashCode()
  • HashMap

toString

public String toString()
Возвращает объект String, представляющий значение этого объекта Character. Результатом является строка длиной 1, единственным компонентом которой является примитивное значение char, представленное этим объектом Character.
Overrides:
toString в классе Object
Returns:
строковое представление этого объекта.

toString

public static String toString(char c)
Возвращает объект String, представляющий указанное значение char. Результат — строка длиной 1, состоящая только из указанного значения char.
API Note:
Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toString(int).
Parameters:
c - значение char для преобразования
Returns:
строковое представление указанного значения char
Since:
1.4

toString

public static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (код Юникода). Результат — строка длиной 1 или 2, состоящая только из указанного codePoint.
Параметры:
codePoint - преобразуемый codePoint
Возвращает:
строковое представление указанного codePoint
Исключение:
IllegalArgumentException - если указанный codePoint не является валидным кодом Юникода.
С:
11

isValidCodePoint

public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный код Юникода допустимым значением кода Юникода.
Параметры:
codePoint - проверяемый код Юникода
Возвращает:
true, если значение указанного кода находится в диапазоне от MIN_CODE_POINT до MAX_CODE_POINT включительно; false в противном случае.
С:
1.5

isBmpCodePoint

public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Юникода) в основной многоязычной плоскости (BMP). Такие коды могут быть представлены с помощью одного char.
Параметры:
codePoint - тестируемый символ (код Юникода)
Возвращает:
true, если указанный код находится в диапазоне от MIN_VALUE до MAX_VALUE включительно; false в противном случае.
С:
1.7

isSupplementaryCodePoint

public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Юникода) в диапазоне дополнительных символов.
Параметры:
codePoint - тестируемый символ (код Юникода)
Возвращает:
true, если указанный код находится в диапазоне от MIN_SUPPLEMENTARY_CODE_POINT до MAX_CODE_POINT включительно; false в противном случае.
С:
1.5

isHighSurrogate

public static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char старшим замещающим кодом (также известным как старший код замещения).

Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch - тестируемое значение char.
Возвращает:
true, если значение char находится в диапазоне от MIN_HIGH_SURROGATE до MAX_HIGH_SURROGATE включительно; false в противном случае.
С:
1.5
См. также:
  • isLowSurrogate(char)
  • Character.UnicodeBlock.of(int)

isLowSurrogate

public static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char младшим замещающим кодом (также известным как следующий код замещения).

Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch - тестируемое значение char.
Возвращает:
true, если значение char находится в диапазоне от MIN_LOW_SURROGATE до MAX_LOW_SURROGATE включительно; false в противном случае.
С:
1.5
См. также:
  • isHighSurrogate(char)

isSurrogate

public static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char кодом Юникода замещающим кодом.

Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.

Значение char является замещающим кодом тогда и только тогда, когда оно является либо младшим замещающим кодом, либо старшим замещающим кодом.

Параметры:
ch - тестируемое значение char.
Возвращает:
true, если значение char находится в диапазоне от MIN_SURROGATE до MAX_SURROGATE включительно; false в противном случае.
С:
1.7

isSurrogatePair

public static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char валидной парой замещения Юникода.

Этот метод эквивалентен выражению:


 isHighSurrogate(high) && isLowSurrogate(low)
 
Параметры:
high - старшее замещающее значение кода, которое будет проверено
low - младшее замещающее значение кода, которое будет проверено
Возвращает:
true, если указанные старшее и младшее замещающие значения кода представляют валидную пару замещения; false в противном случае.
С:
1.5

charCount

public static int charCount(int codePoint)
Определяет количество значений char, необходимых для представления указанного символа (кода Юникода). Если указанный символ равен или больше 0x10000, метод возвращает 2. В противном случае метод возвращает 1.

Этот метод не проверяет, является ли указанный символ допустимым кодом Юникода. Вызывающий метод должен проверить значение символа с помощью isValidCodePoint, если необходимо.

Параметры:
codePoint - тестируемый символ (код Юникода).
Возвращает:
2, если символ является допустимым дополнительным символом; 1 в противном случае.
С:
1.5
См. также:
  • isSupplementaryCodePoint(int)

toCodePoint

public static int toCodePoint(char high, char low)
Преобразует указанную пару замещения в значение дополнительного кода Юникода. Этот метод не проверяет указанную пару замещения. Вызывающий метод должен проверить ее с помощью isSurrogatePair, если необходимо.
Параметры:
high - старший замещающий код
low - младший замещающий код
Возвращает:
дополнительный код Юникода, составленный из указанной пары замещения.
С:
1.5

codePointAt

public static int codePointAt(CharSequence seq, int index)
Возвращает код Юникода в заданном индексе CharSequence. Если значение char в заданном индексе CharSequence находится в диапазоне старших замещающих кодов, следующий индекс меньше длины CharSequence, и значение char в следующем индексе находится в диапазоне младших замещающих кодов, то возвращается дополнительный код Юникода, соответствующий этой паре замещения. В противном случае возвращается значение char в заданном индексе.
Параметры:
seq - последовательность значений char (единиц кодирования Юникода)
index - индекс значений char (единиц кодирования Юникода) в seq для преобразования
Возвращает:
код Юникода в заданном индексе
Исключение:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если значение index отрицательное или не меньше seq.length().
С:
1.5

codePointAt

public static int codePointAt(char[] a, int index)
Возвращает код символа по заданному индексу в массиве char. Если значение char по заданному индексу в массиве char находится в диапазоне высоких суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу находится в диапазоне низких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по заданному индексу.
Параметры:
a - массив char
index - индекс к значениям char (единицы кода Юникода) в массиве char для преобразования
Возвращаемое значение:
код символа Юникода по заданному индексу
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если значение index отрицательно или не меньше длины массива char.
С:
1.5

codePointAt

public static int codePointAt(char[] a, int index, int limit)
Возвращает код символа по заданному индексу в массиве char, где используются только элементы массива с индексом, меньшим чем limit. Если значение char по заданному индексу в массиве char находится в диапазоне высоких суррогатов, следующий индекс меньше limit, а значение char по следующему индексу находится в диапазоне низких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по заданному индексу.
Параметры:
a - массив char
index - индекс к значениям char (единицы кода Юникода) в массиве char для преобразования
limit - индекс после последнего элемента массива, который можно использовать в массиве char
Возвращаемое значение:
код символа Юникода по заданному индексу
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index отрицателен или не меньше аргумента limit, или если аргумент limit отрицателен или больше длины массива char.
С:
1.5

codePointBefore

public static int codePointBefore(CharSequence seq, int index)
Возвращает код символа, предшествующий заданному индексу в CharSequence. Если значение char по индексу (index - 1) в CharSequence находится в диапазоне низких суррогатов, (index - 2) не отрицательно, и значение char по индексу (index - 2) в CharSequence находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
seq - экземпляр CharSequence
index - индекс, следующий за кодом символа, который должен быть возвращен
Возвращаемое значение:
значение кода символа Юникода перед заданным индексом.
Исключения:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если аргумент index меньше 1 или больше seq.length().
С:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index)
Возвращает код символа, предшествующий заданному индексу в массиве char. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатов, (index - 2) не отрицательно, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
a - массив char
index - индекс, следующий за кодом символа, который должен быть возвращен
Возвращаемое значение:
значение кода символа Юникода перед заданным индексом.
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index меньше 1 или больше длины массива char
С:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index, int start)
Возвращает код символа, предшествующий заданному индексу в массиве char, где используются только элементы массива с индексом, большим или равным start. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатов, (index - 2) не меньше start, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатов, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
a - массив char
index - индекс, следующий за кодом символа, который должен быть возвращен
start - индекс первого элемента массива в массиве char
Возвращаемое значение:
значение кода символа Юникода перед заданным индексом.
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index не больше аргумента start или больше длины массива char, или если аргумент start отрицателен или не меньше длины массива char.
С:
1.5

highSurrogate

public static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (a ведущий суррогат код-единица) пары суррогатов, представляющей заданный дополнительный символ (код символа Юникода) в кодировке UTF-16. Если заданный символ не является дополнительным символом, возвращается неопределенное значение.

Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint - дополнительный символ (код символа Юникода)
Возвращаемое значение:
ведущая суррогат код-единица, используемая для представления символа в кодировке UTF-16
С:
1.7

lowSurrogate

public static char lowSurrogate(int codePoint)
Возвращает заключительный суррогат (a заключительный суррогат код-единица) пары суррогатов, представляющей заданный дополнительный символ (код символа Юникода) в кодировке UTF-16. Если заданный символ не является дополнительным символом, возвращается неопределенное значение.

Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint - дополнительный символ (код символа Юникода)
Возвращаемое значение:
заключительная суррогат код-единица, используемая для представления символа в кодировке UTF-16
С:
1.7

toChars

public static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (код Юникода) в его представление UTF-16. Если указанный код символа является значением BMP (Базовый многоязычный план или план 0), то это же значение сохраняется в dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогатов сохраняются в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.
Параметры:
codePoint - символ (код Юникода), который необходимо преобразовать.
dst - массив char, в котором хранится значение UTF-16 символа.
dstIndex - начальный индекс в массиве dst, где хранится преобразованное значение.
Возвращает:
1, если код символа — код BMP, 2, если код символа — дополнительный код.
Исключение:
IllegalArgumentException - если указанный codePoint не является допустимым кодом Юникода.
NullPointerException - если указанный dst равен null.
IndexOutOfBoundsException - если dstIndex отрицательно или не меньше dst.length, или если в dst по индексу dstIndex недостаточно элементов массива для хранения результата char (если dstIndex равно dst.length-1, и указанный codePoint — дополнительный символ, значение высокого суррогата не сохраняется в dst[dstIndex]).
С:
1.5

toChars

public static char[] toChars(int codePoint)
Преобразует указанный символ (код Юникода) в его представление UTF-16, которое хранится в массиве char. Если указанный код символа является значением BMP (Базовый многоязычный план или план 0), то результирующий массив char имеет то же значение, что и codePoint. Если указанный код символа является дополнительным кодом, результирующий массив char имеет соответствующую пару суррогатов.
Параметры:
codePoint - код Юникода.
Возвращает:
массив char, содержащий UTF-16 представление codePoint.
Исключение:
IllegalArgumentException - если указанный codePoint не является допустимым кодом Юникода.
С:
1.5

codePointCount

public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество символов Юникода в текстовом диапазоне указанной последовательности символов. Диапазон текста начинается в указанном beginIndex и простирается до char с индексом endIndex - 1. Таким образом, длина (в char) текстового диапазона равна endIndex-beginIndex. Непарные суррогаты в текстовом диапазоне считаются по одному символу Юникода.
Параметры:
seq - последовательность символов
beginIndex - индекс первого char текстового диапазона.
endIndex - индекс после последнего char текстового диапазона.
Возвращает:
количество символов Юникода в указанном текстовом диапазоне
Исключение:
NullPointerException - если seq равен null.
IndexOutOfBoundsException - если beginIndex отрицательный, или endIndex больше длины заданной последовательности, или beginIndex больше чем endIndex.
С:
1.5

codePointCount

public static int codePointCount(char[] a, int offset, int count)
Возвращает количество символов Юникода в подмассиве аргумента массива char. Аргумент offset — индекс первого char подмассива, а аргумент count задаёт длину подмассива в char. Непарные суррогаты в подмассиве считаются по одному символу Юникода.
Параметры:
a - массив char
offset - индекс первого char в заданном массиве char
count - длина подмассива в char
Возвращает:
количество символов Юникода в указанном подмассиве
Исключение:
NullPointerException - если a равен null.
IndexOutOfBoundsException - если offset или count отрицательные, или если offset + count больше длины данного массива.
С:
1.5

offsetByCodePoints

public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в данной последовательности символов, который смещён относительно данного index на codePointOffset символов Юникода. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу Юникода.
Параметры:
seq - последовательность символов
index - индекс, который необходимо сместить
codePointOffset - смещение в символах Юникода
Возвращает:
индекс в последовательности символов
Исключение:
NullPointerException - если seq равен null.
IndexOutOfBoundsException - если index отрицательный или больше длины последовательности символов, или если codePointOffset положительный, и подпоследовательность, начинающаяся с index, содержит меньше, чем codePointOffset символов Юникода, или если codePointOffset отрицательный, и подпоследовательность перед index содержит меньше, чем абсолютное значение codePointOffset символов Юникода.
С:
1.5

offsetByCodePoints

public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в заданном подмассиве char, который смещён относительно данного index на codePointOffset символов Юникода. Аргументы start и count задают подмассив массива char. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу Юникода.
Параметры:
a - массив char
start - индекс первого char подмассива
count - длина подмассива в char
index - индекс, который необходимо сместить
codePointOffset - смещение в символах Юникода
Возвращает:
индекс в подмассиве
Исключение:
NullPointerException - если a равен null.
IndexOutOfBoundsException - если start или count отрицательные, или если start + count больше длины данного массива, или если index меньше start или больше start + count, или если codePointOffset положительный, и текстовый диапазон, начинающийся с index и заканчивающийся start + count - 1, содержит меньше, чем codePointOffset символов Юникода, или если codePointOffset отрицательный, и текстовый диапазон, начинающийся с start и заканчивающийся index - 1, содержит меньше, чем абсолютное значение codePointOffset символов Юникода.
С:
1.5

isLowerCase

public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ символом строчной буквы.

Символ является строчной буквой, если его тип общей категории, предоставленный методом Character.getType(ch), равен LOWERCASE_LETTER, или если он обладает дополнительным свойством Other_Lowercase, как определено в стандарте Юникод.

Вот примеры символов строчных букв:

 a b c d e f g h i j k l m n o p q r s t u v w x y z
 '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
 '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
 '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
 '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
 

Многие другие символы Юникода также являются символами строчных букв.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isLowerCase(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является строчной буквой; false в противном случае.
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toLowerCase(char)
  • getType(char)

isLowerCase

public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) символом строчной буквы.

Символ является строчной буквой, если его тип общей категории, предоставленный методом getType(codePoint), равен LOWERCASE_LETTER, или если он обладает дополнительным свойством Other_Lowercase, как определено в стандарте Юникод.

Вот примеры символов строчных букв:

 a b c d e f g h i j k l m n o p q r s t u v w x y z
 '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
 '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
 '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
 '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
 

Многие другие символы Юникода также являются символами строчных букв.

Параметры:
codePoint - проверяемый символ (код Юникода).
Возвращает:
true, если символ является строчной буквой; false в противном случае.
С:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toLowerCase(int)
  • getType(int)

isUpperCase

public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ заглавной буквой.

Символ является заглавной буквой, если его тип общей категории, предоставленной Character.getType(ch), является UPPERCASE_LETTER или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.

Ниже приведены примеры заглавных символов:

 A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
 '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
 '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
 '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
 '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
 

Многие другие символы Unicode также являются заглавными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isUpperCase(int).

Параметры:
ch — тестируемый символ.
Возвращает:
true, если символ является заглавной буквой; false в противном случае.
С:
1.0
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toUpperCase(char)
  • getType(char)

isUpperCase

public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) заглавной буквой.

Символ является заглавной буквой, если его тип общей категории, предоставленной getType(codePoint), является UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.

Ниже приведены примеры заглавных символов:

 A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
 '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
 '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
 '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
 '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
 

Многие другие символы Unicode также являются заглавными.

Параметры:
codePoint — тестируемый символ (код точки Unicode).
Возвращает:
true, если символ является заглавной буквой; false в противном случае.
С:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toUpperCase(int)
  • getType(int)

isTitleCase

public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ заглавной буквой в стиле заголовка.

Символ является заглавной буквой в стиле заголовка, если его тип общей категории, предоставленной Character.getType(ch), является TITLECASE_LETTER.

Некоторые символы похожи на пары латинских букв. Например, существует заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей для рендеринга слова строчными буквами с заглавными начальными буквами, как в заголовках книг.

Вот некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются заглавными буквами в стиле заголовка.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isTitleCase(int).

Параметры:
ch — тестируемый символ.
Возвращает:
true, если символ является заглавной буквой в стиле заголовка; false в противном случае.
С:
1.0.2
См. также:
  • isLowerCase(char)
  • isUpperCase(char)
  • toTitleCase(char)
  • getType(char)

isTitleCase

public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) заглавной буквой в стиле заголовка.

Символ является заглавной буквой в стиле заголовка, если его тип общей категории, предоставленной getType(codePoint), является TITLECASE_LETTER.

Некоторые символы похожи на пары латинских букв. Например, существует заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей для рендеринга слова строчными буквами с заглавными начальными буквами, как в заголовках книг.

Вот некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются заглавными буквами в стиле заголовка.

Параметры:
codePoint — тестируемый символ (код точки Unicode).
Возвращает:
true, если символ является заглавной буквой в стиле заголовка; false в противном случае.
С:
1.5
См. также:
  • isLowerCase(int)
  • isUpperCase(int)
  • toTitleCase(int)
  • getType(int)

isDigit

public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.

Символ является цифрой, если его тип общей категории, предоставленной Character.getType(ch), является DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030' по '\u0039', цифры ISO-LATIN-1 ('0' по '9')
  • '\u0660' по '\u0669', арабские цифры
  • '\u06F0' по '\u06F9', расширенные арабские цифры
  • '\u0966' по '\u096F', деванагари цифры
  • '\uFF10' по '\uFF19', полноширинные цифры
Многие другие диапазоны символов также содержат цифры.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDigit(int).

Параметры:
ch — тестируемый символ.
Возвращает:
true, если символ является цифрой; false в противном случае.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • getType(char)

isDigit

public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) цифрой.

Символ является цифрой, если его тип общей категории, предоставленной getType(codePoint), является DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030' по '\u0039', цифры ISO-LATIN-1 ('0' по '9')
  • '\u0660' по '\u0669', арабские цифры
  • '\u06F0' по '\u06F9', расширенные арабские цифры
  • '\u0966' по '\u096F', деванагари цифры
  • '\uFF10' по '\uFF19', полноширинные цифры
Многие другие диапазоны символов также содержат цифры.
Параметры:
codePoint — тестируемый символ (код точки Unicode).
Возвращает:
true, если символ является цифрой; false в противном случае.
С:
1.5
См. также:
  • forDigit(int, int)
  • getType(int)

isDefined

public static boolean isDefined(char ch)
Определяет, определен ли символ в Unicode.

Символ определен, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Он имеет значение в диапазоне, определенном файлом UnicodeData.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDefined(int).

Параметры:
ch — тестируемый символ
Возвращает:
true, если символ имеет определенное значение в Unicode; false в противном случае.
С:
1.0.2
См. также:
  • isDigit(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUpperCase(char)

isDefined

public static boolean isDefined(int codePoint)
Определяет, определён ли символ (код точки Unicode) в Unicode.

Символ считается определённым, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Он имеет значение в диапазоне, определённом файлом UnicodeData.
Параметры:
codePoint - проверяемый символ (код точки Unicode).
Возвращает:
true, если символ имеет определённое значение в Unicode; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isLetter(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUpperCase(int)

isLetter

public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.

Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), является любым из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не являются заглавными, строчными или прописными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isLetter(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является буквой; false в противном случае.
См. также:
  • isDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUnicodeIdentifierStart(char)
  • isUpperCase(char)

isLetter

public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) буквой.

Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), является одним из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не являются заглавными, строчными или прописными.
Параметры:
codePoint - проверяемый символ (код точки Unicode).
Возвращает:
true, если символ является буквой; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUnicodeIdentifierStart(int)
  • isUpperCase(int)

isLetterOrDigit

public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.

Символ считается буквой или цифрой, если либо Character.isLetter(char ch), либо Character.isDigit(char ch) возвращает true для символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isLetterOrDigit(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является буквой или цифрой; false в противном случае.
С:
1.0.2
См. также:
  • isDigit(char)
  • isJavaIdentifierPart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isLetterOrDigit

public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) буквой или цифрой.

Символ считается буквой или цифрой, если либо isLetter(codePoint), либо isDigit(codePoint) возвращает true для символа.

Параметры:
codePoint - проверяемый символ (код точки Unicode).
Возвращает:
true, если символ является буквой или цифрой; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isJavaLetter

@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Устаревшее.
Заменено на isJavaIdentifierStart(char).
Определяет, может ли указанный символ быть первым символом в идентификаторе Java.

Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является символом пунктуации соединения (например, '_').
Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Java; false в противном случае.
С:
1.0.2
См. также:
  • isJavaLetterOrDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isJavaLetterOrDigit

@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Устаревшее.
Заменено на isJavaIdentifierPart(char).
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа.

Символ может быть частью идентификатора Java, если и только если выполняется одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ пунктуации соединения (например, '_')
  • это цифра
  • это буквенная цифра (например, символ римской цифры)
  • это знак сочетания
  • это знак без пробела
  • isIdentifierIgnorable возвращает true для символа.
Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ может быть частью идентификатора Java; false в противном случае.
С:
1.0.2
См. также:
  • isJavaLetter(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • isIdentifierIgnorable(char)

isAlphabetic

public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Юникода) буквенным.

Символ считается буквенным, если его тип общей категории, предоставленной getType(codePoint), является одним из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
  • LETTER_NUMBER
или он обладает вспомогательным свойством Other_Alphabetic, как определено в стандарте Юникод.
Parameters:
codePoint - тестируемый символ (кодовая точка Юникода).
Returns:
true, если символ является буквенным символом Юникода, false в противном случае.
Since:
1.7

isIdeographic

public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Юникода) идеограммой CJKV (китайская, японская, корейская и вьетнамская), как определено стандартом Юникод.
Parameters:
codePoint - тестируемый символ (кодовая точка Юникода).
Returns:
true, если символ является идеограммой Юникода, false в противном случае.
Since:
1.7

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(char ch)
Определяет, может ли указанный символ быть первой буквой в идентификаторе Java.

Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является символом соединительной пунктуации (например, '_').

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).

Parameters:
ch - тестируемый символ.
Returns:
true, если символ может начинать идентификатор Java; false в противном случае.
Since:
1.1
See Also:
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isUnicodeIdentifierStart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(int codePoint)
Определяет, может ли символ (кодовая точка Юникода) быть первой буквой в идентификаторе Java.

Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER
  • указанный символ является символом валюты (например, '$')
  • указанный символ является символом соединительной пунктуации (например, '_').
Parameters:
codePoint - тестируемый символ (кодовая точка Юникода).
Returns:
true, если символ может начинать идентификатор Java; false в противном случае.
Since:
1.5
See Also:
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierStart(int)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, отличного от первой буквы.

Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это буквенно-цифровой символ (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный знак
  • isIdentifierIgnorable возвращает true для символа

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).

Parameters:
ch - тестируемый символ.
Returns:
true, если символ может быть частью идентификатора Java; false в противном случае.
Since:
1.1
See Also:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierStart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (кодовая точка Юникода) быть частью идентификатора Java, отличного от первой буквы.

Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это буквенно-цифровой символ (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный знак
  • isIdentifierIgnorable(codePoint) возвращает true для кодовой точки
Parameters:
codePoint - тестируемый символ (кодовая точка Юникода).
Returns:
true, если символ может быть частью идентификатора Java; false в противном случае.
Since:
1.5
See Also:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierPart(int)
  • SourceVersion.isIdentifier(CharSequence)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(char ch)
Определяет, может ли указанный символ быть первой буквой в идентификаторе Юникода.

Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: По умолчанию идентификаторы стандарта Юникод, со следующим профилем UAX31:

 Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
 
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).

Parameters:
ch - тестируемый символ.
Returns:
true, если символ может начинать идентификатор Юникода; false в противном случае.
Since:
1.1
External Specifications
  • База данных символов Юникода
  • Синтаксис идентификаторов и шаблонов Юникода
See Also:
  • isJavaIdentifierStart(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, разрешено ли указанный символ (кодовый пункт Юникода) в качестве первого символа в идентификаторе Юникода.

Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:

 Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
 
'VERTICAL TILDE' добавлено в Start для обратной совместимости.
Параметры:
codePoint - символ (кодовый пункт Юникода), который нужно проверить.
Возвращает:
true, если символ может начинать идентификатор Юникода; false в противном случае.
С:
1.5
Внешние спецификации
  • База данных символов Юникода
  • Синтаксис идентификаторов и шаблонов Юникода
См. также:
  • isJavaIdentifierStart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Юникода, отличной от первой.

Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:

  • это буква
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный диакритический знак
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:

 Continue := Start + ID_Continue + ignorable
 Medial := empty
 ignorable := isIdentifierIgnorable(char) returns true for the character
 
ignorable добавлено в Continue для обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).

Параметры:
ch - символ для проверки.
Возвращает:
true, если символ может быть частью идентификатора Юникода; false в противном случае.
С:
1.1
Внешние спецификации
  • База данных символов Юникода
  • Синтаксис идентификаторов и шаблонов Юникода
См. также:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierPart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовый пункт Юникода) быть частью идентификатора Юникода, отличной от первой.

Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:

  • это буква
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный диакритический знак
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: Значения идентификаторов по умолчанию стандарта Юникод со следующим профилем UAX31:

 Continue := Start + ID_Continue + ignorable
 Medial := empty
 ignorable := isIdentifierIgnorable(int) returns true for the character
 
ignorable добавлено в Continue для обратной совместимости.
Параметры:
codePoint - символ (кодовый пункт Юникода) для проверки.
Возвращает:
true, если символ может быть частью идентификатора Юникода; false в противном случае.
С:
1.5
Внешние спецификации
  • База данных символов Юникода
  • Синтаксис идентификаторов и шаблонов Юникода
См. также:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierPart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierStart(int)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или Юникода.

Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:

  • Управляющие символы ISO, которые не являются пробелами
    • '\u0000' по '\u0008'
    • '\u000E' по '\u001B'
    • '\u007F' по '\u009F'
  • все символы, имеющие значение общей категории FORMAT

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Юникода, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).

Параметры:
ch - символ для проверки.
Возвращает:
true, если символ является управляющим символом, который можно игнорировать и который может быть частью идентификатора Java или Юникода; false в противном случае.
С:
1.1
См. также:
  • isJavaIdentifierPart(char)
  • isUnicodeIdentifierPart(char)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли рассматривать указанный символ (кодовый пункт Юникода) как игнорируемый символ в идентификаторе Java или Юникода.

Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:

  • Управляющие символы ISO, которые не являются пробелами
    • '\u0000' по '\u0008'
    • '\u000E' по '\u001B'
    • '\u007F' по '\u009F'
  • все символы, имеющие значение общей категории FORMAT
Параметры:
codePoint - символ (кодовый пункт Юникода) для проверки.
Возвращает:
true, если символ является управляющим символом, который можно игнорировать и который может быть частью идентификатора Java или Юникода; false в противном случае.
С:
1.5
См. также:
  • isJavaIdentifierPart(int)
  • isUnicodeIdentifierPart(int)

isEmoji

public static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) смайликом.

Символ считается смайликом, только если он имеет свойство Emoji, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовый пункт Юникода) для проверки.
Возвращает:
true, если символ является смайликом; false в противном случае.
С:
21

isEmojiPresentation

public static boolean isEmojiPresentation(int codePoint)
Определяет, имеет ли указанный символ (кодовое значение Юникода) свойство Emoji Presentation по умолчанию.

Символ считается имеющим свойство Emoji Presentation только в том случае, если он имеет свойство Emoji_Presentation, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно проверить.
Возвращает:
true, если символ имеет свойство Emoji Presentation; false в противном случае.
С:
21

isEmojiModifier

public static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (кодовое значение Юникода) модификатором Emoji.

Символ считается модификатором Emoji только в том случае, если он имеет свойство Emoji_Modifier, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно проверить.
Возвращает:
true, если символ является модификатором Emoji; false в противном случае.
С:
21

isEmojiModifierBase

public static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (кодовое значение Юникода) базовым модификатором Emoji.

Символ считается базовым модификатором Emoji только в том случае, если он имеет свойство Emoji_Modifier_Base, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно проверить.
Возвращает:
true, если символ является базовым модификатором Emoji; false в противном случае.
С:
21

isEmojiComponent

public static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (кодовое значение Юникода) компонентом Emoji.

Символ считается компонентом Emoji только в том случае, если он имеет свойство Emoji_Component, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно проверить.
Возвращает:
true, если символ является компонентом Emoji; false в противном случае.
С:
21

isExtendedPictographic

public static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (кодовое значение Юникода) расширенным пиктографическим символом.

Символ считается расширенным пиктографическим символом только в том случае, если он имеет свойство Extended_Pictographic, определенное в Unicode Emoji (Технический стандарт #51).

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно проверить.
Возвращает:
true, если символ является расширенным пиктографическим символом; false в противном случае.
С:
21

toLowerCase

public static char toLowerCase(char ch)
Преобразует символ в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, следует использовать String.toLowerCase() для преобразования символов в нижний регистр. Методы преобразования в нижний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toLowerCase(int).

Параметры:
ch - символ, который нужно преобразовать.
Возвращает:
эквивалент символа в нижнем регистре, если он существует; в противном случае, сам символ.
См. также:
  • isLowerCase(char)
  • String.toLowerCase()

toLowerCase

public static int toLowerCase(int codePoint)
Преобразует символ (кодовое значение Юникода) в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, следует использовать String.toLowerCase() для преобразования символов в нижний регистр. Методы преобразования в нижний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно преобразовать.
Возвращает:
эквивалент символа в нижнем регистре (кодовое значение Юникода), если он существует; в противном случае, сам символ.
С:
1.5
См. также:
  • isLowerCase(int)
  • String.toLowerCase()

toUpperCase

public static char toUpperCase(char ch)
Преобразует символ в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, следует использовать String.toUpperCase() для преобразования символов в верхний регистр. Методы преобразования в верхний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).

Параметры:
ch - символ, который нужно преобразовать.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае, сам символ.
См. также:
  • isUpperCase(char)
  • String.toUpperCase()

toUpperCase

public static int toUpperCase(int codePoint)
Преобразует символ (кодовое значение Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, следует использовать String.toUpperCase() для преобразования символов в верхний регистр. Методы преобразования в верхний регистр String имеют ряд преимуществ перед методами преобразования Character. Методы преобразования String могут выполнять регистрозависимые преобразования, контекстно-зависимые преобразования и преобразования 1:М для символов, в то время как методы Character этого не могут.

Параметры:
codePoint - символ (кодовое значение Юникода), который нужно преобразовать.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае, сам символ.
С:
1.5
См. также:
  • isUpperCase(int)
  • String.toUpperCase()

toTitleCase

public static char toTitleCase(char ch)
Преобразует символ в заглавный регистр, используя информацию о преобразовании регистра из файла UnicodeData. Если для символа нет явного преобразования в заглавный регистр и он сам по себе не является заглавным символом согласно UnicodeData, то возвращается преобразование в верхний регистр в качестве эквивалентного преобразования в заглавный регистр. Если символ char уже является символом заглавного регистра char, то будет возвращено то же самое значение char.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).

Параметры:
ch - символ, который нужно преобразовать.
Возвращает:
эквивалент символа в заглавном регистре, если он существует; в противном случае, сам символ.
С:
1.0.2
См. также:
  • isTitleCase(char)
  • toLowerCase(char)
  • toUpperCase(char)

toTitleCase

public static int toTitleCase(int codePoint)
Преобразует символ (код Юникода) в заглавную букву с использованием информации о сопоставлении регистров из файла UnicodeData. Если для символа нет явного сопоставления в заглавную букву и сам символ не является символом заглавной буквы согласно UnicodeData, то возвращается сопоставление в верхний регистр в качестве эквивалентного сопоставления в заглавную букву. Если символ уже является символом заглавной буквы, возвращается тот же символ.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.

Параметры:
codePoint - символ (код Юникода), который нужно преобразовать.
Возвращает:
эквивалент символа в заглавной букве, если есть; в противном случае, сам символ.
С:
1.5
См. также:
  • isTitleCase(int)
  • toLowerCase(int)
  • toUpperCase(int)

digit

public static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанном радиксе.

Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:

  • Метод isDigit возвращает true для символа, и десятичное значение цифры Юникода символа (или его разложения на один символ) меньше указанного радикса. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', и его код меньше radix + 'A' - 10. В этом случае, возвращается ch - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', и его код меньше radix + 'a' - 10. В этом случае, возвращается ch - 'a' + 10.
  • Символ является одной из заглавных латинских букв в полном формате от A ('\uFF21') до Z ('\uFF3A'), и его код меньше radix + '\uFF21' - 10. В этом случае, возвращается ch - '\uFF21' + 10.
  • Символ является одной из строчных латинских букв в полном формате от a ('\uFF41') до z ('\uFF5A'), и его код меньше radix + '\uFF41' - 10. В этом случае, возвращается ch - '\uFF41' + 10.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод digit(int, int).

Параметры:
ch - символ для преобразования.
radix - радикс.
Возвращает:
числовое значение, представленное символом в указанном радиксе.
См. также:
  • forDigit(int, int)
  • isDigit(char)

digit

public static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (код Юникода) в указанном радиксе.

Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:

  • Метод isDigit(codePoint) возвращает true для символа, и десятичное значение цифры Юникода символа (или его разложения на один символ) меньше указанного радикса. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', и его код меньше radix + 'A' - 10. В этом случае, возвращается codePoint - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', и его код меньше radix + 'a' - 10. В этом случае, возвращается codePoint - 'a' + 10.
  • Символ является одной из заглавных латинских букв в полном формате от A ('\uFF21') до Z ('\uFF3A'), и его код меньше radix + '\uFF21' - 10. В этом случае, возвращается codePoint - '\uFF21' + 10.
  • Символ является одной из строчных латинских букв в полном формате от a ('\uFF41') до z ('\uFF5A'), и его код меньше radix + '\uFF41'- 10. В этом случае, возвращается codePoint - '\uFF41' + 10.
Параметры:
codePoint - символ (код Юникода) для преобразования.
radix - радикс.
Возвращает:
числовое значение, представленное символом в указанном радиксе.
С:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

getNumericValue

public static int getNumericValue(char ch)
Возвращает числовое значение, которое представляет указанный символ Юникода. Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.

Буквы A-Z в их заглавных ('\u0041' через '\u005A'), строчных ('\u0061' через '\u007A') и полных вариантах ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.

Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getNumericValue(int).

Параметры:
ch - символ для преобразования.
Возвращает:
числовое значение символа, как неотрицательное целое значение; -2, если у символа есть числовое значение, но значение нельзя представить как неотрицательное целое значение; -1, если у символа нет числового значения.
С:
1.1
См. также:
  • forDigit(int, int)
  • isDigit(char)

getNumericValue

public static int getNumericValue(int codePoint)
Возвращает числовое значение, которое представляет указанный символ (код Юникода). Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.

Буквы A-Z в их заглавных ('\u0041' через '\u005A'), строчных ('\u0061' через '\u007A') и полных вариантах ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.

Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.

Параметры:
codePoint - символ (код Юникода) для преобразования.
Возвращает:
числовое значение символа, как неотрицательное целое значение; -2, если у символа есть числовое значение, но значение нельзя представить как неотрицательное целое значение; -1, если у символа нет числового значения.
С:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

isSpace

@Deprecated(since="1.1") public static boolean isSpace(char ch)
Устаревшее.
Заменено на isWhitespace(char).
Определяет, является ли указанный символ пробелом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
truechars
Символ Код Имя
'\t' U+0009 HORIZONTAL TABULATION
'\n' U+000A NEW LINE
'\f' U+000C FORM FEED
'\r' U+000D CARRIAGE RETURN
' ' U+0020 SPACE
Параметры:
ch - символ для проверки.
Возвращает:
true, если символ является пробелом ISO-LATIN-1; false в противном случае.
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ Unicode-пробелом. Символ считается пробелом, если и только если он определён как пробел в стандарте Unicode. Этот метод возвращает true, если тип общей категории символа — любой из следующих:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isSpaceChar(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является пробелом; false в противном случае.
С:
1.1
См. также:
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Unicode) символом Unicode-пробела. Символ считается пробелом, если и только если он определён как пробел в стандарте Unicode. Этот метод возвращает true, если тип общей категории символа — любой из следующих:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR
Параметры:
codePoint - проверяемый символ (кодовый пункт Unicode).
Возвращает:
true, если символ является пробелом; false в противном случае.
С:
1.5
См. также:
  • isWhitespace(int)

isWhitespace

public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробелом в соответствии с Java. Символ является пробелом Java, если и только если он удовлетворяет одному из следующих критериев:
  • Он является символом Unicode-пробела (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), но не является также неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Он равен '\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\n', U+000A ПЕРЕВОД СТРОКИ.
  • Он равен '\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\f', U+000C ПЕРЕВОД СТРАНИЦЫ.
  • Он равен '\r', U+000D ВОЗВРАТ КАРЕТКИ.
  • Он равен '\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ.
  • Он равен '\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП.
  • Он равен '\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ.
  • Он равен '\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isWhitespace(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является пробелом Java; false в противном случае.
С:
1.1
См. также:
  • isSpaceChar(char)

isWhitespace

public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Unicode) пробелом в соответствии с Java. Символ является пробелом Java, если и только если он удовлетворяет одному из следующих критериев:
  • Он является символом Unicode-пробела (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), но не является также неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Он равен '\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\n', U+000A ПЕРЕВОД СТРОКИ.
  • Он равен '\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\f', U+000C ПЕРЕВОД СТРАНИЦЫ.
  • Он равен '\r', U+000D ВОЗВРАТ КАРЕТКИ.
  • Он равен '\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ.
  • Он равен '\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП.
  • Он равен '\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ.
  • Он равен '\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Параметры:
codePoint - проверяемый символ (кодовый пункт Unicode).
Возвращает:
true, если символ является пробелом Java; false в противном случае.
С:
1.5
См. также:
  • isSpaceChar(int)

isISOControl

public static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' — '\u001F' или в диапазоне '\u007F' — '\u009F'.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isISOControl(int).

Параметры:
ch - проверяемый символ.
Возвращает:
true, если символ является управляющим символом ISO; false в противном случае.
С:
1.1
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isISOControl

public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Unicode) управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' — '\u001F' или в диапазоне '\u007F' — '\u009F'.
Параметры:
codePoint - проверяемый символ (кодовый пункт Unicode).
Возвращает:
true, если символ является управляющим символом ISO; false в противном случае.
С:
1.5
См. также:
  • isSpaceChar(int)
  • isWhitespace(int)

getType

public static int getType(char ch)
Возвращает значение, обозначающее общую категорию символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод getType(int).

Параметры:
ch - проверяемый символ.
Возвращает:
значение типа int, представляющее общую категорию символа.
С:
1.1
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

getType

public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
Параметры:
codePoint - символ (код Юникода) для проверки.
Возвращает:
значение типа int, представляющее общую категорию символа.
С тех пор:
1.5
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

forDigit

public static char forDigit(int digit, int radix)
Определяет представление символа для конкретной цифры в заданном радиксе. Если значение radix не является допустимым радиксом, или значение digit не является допустимой цифрой в заданном радиксе, возвращается нулевой символ ('\u0000').

Аргумент radix допустим, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.

Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.

Параметры:
digit - число, которое нужно преобразовать в символ.
radix - радикс.
Возвращает:
символьное представление указанной цифры в указанном радиксе.
См. также:
  • MIN_RADIX
  • MAX_RADIX
  • digit(char, int)

getDirectionality

public static byte getDirectionality(char ch)
Возвращает свойство направленности Юникода для данного символа. Направленность символа используется для расчета визуального порядка текста. Значение направленности для неопределенных char значений равно DIRECTIONALITY_UNDEFINED.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getDirectionality(int).

Параметры:
ch - char, для которого требуется свойство направленности.
Возвращает:
свойство направленности значения char.
С тех пор:
1.4
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

getDirectionality

public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Юникода для данного символа (кода Юникода). Направленность символа используется для расчета визуального порядка текста. Значение направленности неопределенного символа — DIRECTIONALITY_UNDEFINED.
Параметры:
codePoint - символ (код Юникода), для которого требуется свойство направленности.
Возвращает:
свойство направленности символа.
С тех пор:
1.5
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

isMirrored

public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. Зеркальные символы должны иметь свои глифы, горизонтально отраженные при отображении в тексте справа налево. Например, '\u0028' левая скобка по смыслу определена как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).

Параметры:
ch - char, для которого требуется свойство зеркальности.
Возвращает:
true, если символ зеркальный, false, если символ не зеркальный или не определен.
С тех пор:
1.4
END_OF_DOCUMENT_MARKER

isMirrored

public static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовое значение Unicode) зеркальным в соответствии со спецификацией Unicode. Зеркальные символы должны отображаться с горизонтальным зеркальным отображением при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА семантически определена как открывающая скобка. Она будет отображаться как «(» в тексте слева направо, но как «)» в тексте справа налево.
Параметры:
codePoint - символ (кодовое значение Unicode) для проверки.
Возвращает:
true, если символ зеркальный; false, если символ не зеркальный или не определён.
С версии:
1.5

compareTo

public int compareTo(Character anotherCharacter)
Сравнивает два объекта типа Character численно.
Определено в:
compareTo в интерфейсе Comparable<Character>
Параметры:
anotherCharacter - объект Character для сравнения.
Возвращает:
значение 0, если переданный аргумент Character равен этому объекту Character; значение меньше 0, если этот объект Character численно меньше аргумента Character; и значение больше 0, если этот объект Character численно больше аргумента Character (сравнение без учёта знака). Обратите внимание, что это строго численное сравнение; оно не зависит от локали.
С версии:
1.2

compare

public static int compare(char x, char y)
Сравнивает два значения типа char численно. Возвращаемое значение идентично тому, что было бы возвращено:
    Character.valueOf(x).compareTo(Character.valueOf(y))
 
Параметры:
x - первое значение типа char для сравнения
y - второе значение типа char для сравнения
Возвращает:
значение 0, если x == y; значение меньше 0, если x < y; и значение больше 0, если x > y
С версии:
1.7

reverseBytes

public static char reverseBytes(char ch)
Возвращает значение, полученное путём перестановки байтов в указанном значении типа char.
Параметры:
ch - Значение типа char, для которого требуется перестановка байтов.
Возвращает:
значение, полученное путём перестановки (или, эквивалентно, обмена) байтов в указанном значении типа char.
С версии:
1.5

getName

public static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если кодовое значение не присвоено unassigned.

Если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), возвращаемое имя совпадает с результатом выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для символов в файле UnicodeData имя, возвращаемое этим методом, соответствует схеме именования в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, таких как хангыль/идеограммы, правило генерации имени отличается от правила, определенного в стандарте Unicode.
Параметры:
codePoint - символ (кодовое значение Unicode)
Возвращает:
имя указанного символа или null, если кодовое значение не присвоено.
Исключения:
IllegalArgumentException - если указанное codePoint не является допустимым кодовым значением Unicode.
С версии:
1.7

codePointOf

public static int codePointOf(String name)
Возвращает числовое кодовое значение Unicode символа, указанного заданным именем символа.

Если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), его имя определяется как результат выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);

Совпадение по имени name не учитывает регистр и удаляет все ведущие и хвостовые пробельные символы. Для кодовых точек в файле UnicodeData этот метод распознаёт имя, соответствующее имени, определённому в разделе «Свойство имени Unicode» в стандарте Unicode. Для других кодовых точек этот метод распознаёт имя, сгенерированное методом getName(int).

Параметры:
name - имя символа
Возвращает:
числовое кодовое значение Unicode символа, указанного его именем.
Исключения:
IllegalArgumentException - если указанное name не является допустимым именем символа.
NullPointerException - если name является null
С версии:
9

© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://download.java.net/java/early_access/jdk24/docs/api/java.base/java/lang/Character.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API