Spec-Zone.ru › OpenJDK 25

Класс Character

java.lang.Object
java.lang.Character
Все реализуемые интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Класс Character является классом-обёрткой для значений примитивного типа char. Объект типа Character содержит одно поле типа char.

Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.), а также для преобразования символов из верхнего регистра в нижний и наоборот.

Соответствие Unicode

Поля и методы класса Character определяются на основе сведений о символах из стандарта Unicode, в частности файла UnicodeData, входящего в базу данных символов Unicode. Этот файл задаёт свойства, включая имя и категорию, для каждой назначенной кодовой точки Unicode или диапазона символов. Файл доступен на сайте консорциума Unicode: http://www.unicode.org.

Сведения о символах основаны на версии 16.0 стандарта Unicode.

Платформа Java со временем поддерживала различные версии стандарта Unicode. Переходы на новые версии стандарта Unicode происходили в следующих выпусках Java; в каждом указан номер новой версии:

Выпуски Java и поддерживаемые версии Unicode
Выпуск Java Версия Unicode
Java SE 24 Unicode 16.0
Java SE 22 Unicode 15.1
Java SE 20 Unicode 15.0
Java SE 19 Unicode 14.0
Java SE 15 Unicode 13.0
Java SE 13 Unicode 12.1
Java SE 12 Unicode 11.0
Java SE 11 Unicode 10.0
Java SE 9 Unicode 8.0
Java SE 8 Unicode 6.2
Java SE 7 Unicode 6.0
Java SE 5.0 Unicode 4.0
Java SE 1.4 Unicode 3.0
JDK 1.1 Unicode 2.0
JDK 1.0.2 Unicode 1.1.5
Отклонения от этих базовых версий Unicode, например распознаваемые приложения, описаны в других разделах.

Представление символов Unicode

Тип данных char (а значит, и значение, инкапсулированное объектом Character) основан на исходной спецификации Unicode, в которой символы определялись как сущности фиксированной ширины 16 бит. Впоследствии стандарт Unicode был изменён, чтобы допустить символы, представление которых требует более 16 бит. Диапазон допустимых кодовых точек теперь составляет от U+0000 до U+10FFFF; они называются скалярными значениями Unicode. (См. определение обозначения U+n в стандарте Unicode.)

Набор символов от U+0000 до U+FFFF иногда называют основной многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char: первое берётся из диапазона старших суррогатов (\uD800-\uDBFF), второе — из диапазона младших суррогатов (\uDC00-\uDFFF).

Таким образом, значение char представляет кодовые точки основной многоязычной плоскости (BMP), включая суррогатные кодовые точки, или кодовые единицы кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Младшие (наименее значащие) 21 бит int используются для представления кодовых точек Unicode, а старшие (наиболее значащие) 11 бит должны быть равны нулю. Если не указано иное, поведение методов в отношении дополнительных символов и суррогатных значений char следующее:

  • Методы, принимающие только значение char, не поддерживают дополнительные символы. Они рассматривают значения char из суррогатных диапазонов как неопределённые символы. Например, Character.isLetter('\uD840') возвращает false, хотя это конкретное значение, за которым в строке следует любое значение младшего суррогата, представляло бы букву.
  • Методы, принимающие значение int, поддерживают все символы Unicode, включая дополнительные символы. Например, Character.isLetter(0x2F81A) возвращает true, поскольку значение кодовой точки соответствует букве (иероглифу CJK).

В документации API Java SE термин кодовая точка Unicode используется для значений символов в диапазоне от U+0000 до U+10FFFF, а термин кодовая единица Unicode — для 16-разрядных значений char, являющихся кодовыми единицами кодировки UTF-16. Дополнительные сведения о терминологии Unicode см. в глоссарии Unicode.

Это класс, основанный на значениях; программистам следует считать экземпляры, которые равны, взаимозаменяемыми и не использовать экземпляры для синхронизации, иначе поведение может быть непредсказуемым. Например, в одном из будущих выпусков синхронизация может завершиться неудачно.

Начиная с:
1.0
Внешние спецификации
  • Unicode 3.1.0
См. также:
  • Сериализованная форма

Краткое описание вложенных классов

Модификатор и тип Класс Описание
static class  Character.Subset
Экземпляры этого класса представляют определённые подмножества набора символов Unicode.
static final class  Character.UnicodeBlock
Семейство подмножеств символов, представляющих блоки символов, определённые в спецификации Unicode.
static enum  Character.UnicodeScript
Семейство подмножеств символов, представляющих письменности, определённые в приложении № 24 к стандарту Unicode: названия письменностей.

Краткое описание полей

Модификатор и тип Поле Описание
static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме.
static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый двунаправленный тип символа "AN" в спецификации Unicode.
static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый двунаправленный тип символа "BN" в спецификации Unicode.
static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый двунаправленный тип символа "CS" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый двунаправленный тип символа "EN" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый двунаправленный тип символа "ES" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый двунаправленный тип символа "ET" в спецификации Unicode.
static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый двунаправленный тип символа "FSI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный двунаправленный тип символа "L" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный двунаправленный тип символа "LRE" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый двунаправленный тип символа "LRI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный двунаправленный тип символа "LRO" в спецификации Unicode.
static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый двунаправленный тип символа "NSM" в спецификации Unicode.
static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный двунаправленный тип символа "ON" в спецификации Unicode.
static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный двунаправленный тип символа "B" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый двунаправленный тип символа "PDF" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый двунаправленный тип символа "PDI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный двунаправленный тип символа "R" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный двунаправленный тип символа "AL" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный двунаправленный тип символа "RLE" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый двунаправленный тип символа "RLI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный двунаправленный тип символа "RLO" в спецификации Unicode.
static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный двунаправленный тип символа "S" в спецификации Unicode.
static final byte DIRECTIONALITY_UNDEFINED
Неопределённый двунаправленный тип символа.
static final byte DIRECTIONALITY_WHITESPACE
Нейтральный двунаправленный тип символа "WS" в спецификации Unicode.
static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
static final int MAX_CODE_POINT
Максимальное значение кодовой точки Unicode, константа U+10FFFF.
static final char MAX_HIGH_SURROGATE
Максимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uDBFF'.
static final char MAX_LOW_SURROGATE
Максимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDFFF'.
static final int MAX_RADIX
Максимальное основание системы счисления, доступное для преобразования в строки и из строк.
static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uDFFF'.
static final char MAX_VALUE
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'.
static final int MIN_CODE_POINT
Минимальное значение кодовой точки Unicode, константа U+0000.
static final char MIN_HIGH_SURROGATE
Минимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uD800'.
static final char MIN_LOW_SURROGATE
Минимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDC00'.
static final int MIN_RADIX
Минимальное основание системы счисления, доступное для преобразования в строки и из строк.
static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000.
static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uD800'.
static final char MIN_VALUE
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'.
static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
static final int SIZE
Количество битов, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.

Краткое описание конструкторов

Конструктор Описание
Character(char value)
Устарел.
Использование этого конструктора редко бывает целесообразным.

Краткое описание методов

Модификатор и тип Метод Описание
static int charCount(int codePoint)
Определяет количество значений char, необходимых для представления указанного символа (кодовой точки Unicode).
char charValue()
Возвращает значение этого объекта Character.
static int codePointAt(char[] a, int index)
Возвращает кодовую точку по заданному индексу массива char.
static int codePointAt(char[] a, int index, int limit)
Возвращает кодовую точку по заданному индексу массива char, используя только элементы массива с index меньше limit.
static int codePointAt(CharSequence seq, int index)
Возвращает кодовую точку по заданному индексу CharSequence.
static int codePointBefore(char[] a, int index)
Возвращает кодовую точку, предшествующую заданному индексу массива char.
static int codePointBefore(char[] a, int index, int start)
Возвращает кодовую точку, предшествующую заданному индексу массива char, используя только элементы массива с index больше или равным start.
static int codePointBefore(CharSequence seq, int index)
Возвращает кодовую точку, предшествующую заданному индексу CharSequence.
static int codePointCount(char[] a, int offset, int count)
Возвращает количество кодовых точек Unicode в подмассиве аргумента массива char.
static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество кодовых точек Unicode в диапазоне текста указанной последовательности символов.
static int codePointOf(String name)
Возвращает значение кодовой точки символа Unicode, указанного заданным именем символа.
static int compare(char x, char y)
Сравнивает два значения char численно.
int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра.
static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанной системе счисления.
static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кодовой точки Unicode) в заданной системе счисления.
boolean equals(Object obj)
Сравнивает этот объект с указанным объектом.
static char forDigit(int digit, int radix)
Определяет представление символа для заданной цифры в указанной системе счисления.
static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для заданного символа.
static byte getDirectionality(int codePoint)
Возвращает свойство направленности Unicode для заданного символа (кодовой точки Unicode).
static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если кодовая точка unassigned.
static int getNumericValue(char ch)
Возвращает значение int, представляемое указанным символом Unicode.
static int getNumericValue(int codePoint)
Возвращает значение int, представляемое указанным символом (кодовой точкой Unicode).
static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
int hashCode()
Возвращает хеш-код этого объекта Character; он равен результату вызова charValue().
static int hashCode(char value)
Возвращает хеш-код значения char; совместим с Character.hashCode().
static char highSurrogate(int codePoint)
Возвращает старший суррогат ( кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16.
static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквенным.
static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в основной многоязычной плоскости (BMP).
static boolean isDefined(char ch)
Определяет, определен ли символ в Unicode.
static boolean isDefined(int codePoint)
Определяет, определен ли символ (кодовая точка Unicode) в Unicode.
static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой.
static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи.
static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом эмодзи.
static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором эмодзи.
static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом-модификатором эмодзи.
static boolean isEmojiPresentation(int codePoint)
Определяет, обладает ли указанный символ (кодовая точка Unicode) по умолчанию свойством представления эмодзи.
static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом.
static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица ведущего суррогата).
static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или идентификаторе Unicode.
static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или идентификаторе Unicode.
static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайской, японской, корейской и вьетнамской), как определено стандартом Unicode.
static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO.
static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO.
static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ входить в идентификатор Java в позиции, отличной от первой.
static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (кодовая точка Unicode) входить в идентификатор Java в позиции, отличной от первой.
static boolean isJavaIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.
static boolean isJavaIdentifierStart(int codePoint)
Определяет, допустим ли символ (кодовая точка Unicode) в качестве первого символа идентификатора Java.
static boolean isJavaLetter(char ch)
Устарел.
Заменен методом isJavaIdentifierStart(char).
static boolean isJavaLetterOrDigit(char ch)
Устарел.
Заменен методом isJavaIdentifierPart(char).
static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой.
static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой.
static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчным.
static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) строчным.
static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица завершающего суррогата).
static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным согласно спецификации Unicode.
static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode.
static boolean isSpace(char ch)
Устарел.
Заменен методом isWhitespace(char).
static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом-пробелом Unicode.
static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) символом-пробелом Unicode.
static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов.
static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char суррогатной кодовой единицей Unicode.
static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char допустимой суррогатной парой Unicode.
static boolean isTitleCase(char ch)
Определяет, является ли указанный символ прописным символом с заглавной формой.
static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) прописным символом с заглавной формой.
static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ входить в идентификатор Unicode в позиции, отличной от первой.
static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовая точка Unicode) входить в идентификатор Unicode в позиции, отличной от первой.
static boolean isUnicodeIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode.
static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode.
static boolean isUpperCase(char ch)
Определяет, является ли указанный символ прописным.
static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) прописным.
static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode.
static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробельным символом согласно Java.
static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java.
static char lowSurrogate(int codePoint)
Возвращает младший суррогат ( кодовую единицу младшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16.
static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в заданном подмассиве char, смещенный от заданного index на codePointOffset кодовых точек.
static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в заданной последовательности символов, смещенный от заданного index на codePointOffset кодовых точек.
static char reverseBytes(char ch)
Возвращает значение, полученное путем обращения порядка байтов указанного значения char.
static char[] toChars(int codePoint)
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16, сохраненное в массиве char.
static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16.
static int toCodePoint(char high, char low)
Преобразует указанную суррогатную пару в значение дополнительной кодовой точки.
static char toLowerCase(char ch)
Преобразует аргумент-символ в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.
static int toLowerCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.
String toString()
Возвращает объект String, представляющий значение этого Character.
static String toString(char c)
Возвращает объект String, представляющий указанное значение char.
static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode).
static char toTitleCase(char ch)
Преобразует аргумент-символ в заглавную форму, используя сведения о преобразовании регистра из файла UnicodeData.
static int toTitleCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в заглавную форму, используя сведения о преобразовании регистра из файла UnicodeData.
static char toUpperCase(char ch)
Преобразует аргумент-символ в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.
static int toUpperCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.
static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char.

Методы, объявленные в классе Object

clone, finalize, getClass, notify, notifyAll, wait, wait, wait

Подробное описание полей

MIN_RADIX

public static final int MIN_RADIX
Минимальное основание системы счисления, доступное для преобразования строк и обратно. Значение этой константы — наименьшее значение, допустимое для аргумента radix в методах преобразования систем счисления, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MAX_RADIX

public static final int MAX_RADIX
Максимальное основание системы счисления, доступное для преобразования строк и обратно. Значение этой константы — наибольшее значение, допустимое для аргумента radix в методах преобразования систем счисления, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MIN_VALUE

public static final char MIN_VALUE
Значение этой константы — наименьшее значение типа char, '\u0000'.
С версии:
1.0.2
См. также:
  • Значения константных полей

MAX_VALUE

public static final char MAX_VALUE
Значение этой константы — наибольшее значение типа char, '\uFFFF'.
С версии:
1.0.2
См. также:
  • Значения константных полей

TYPE

public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
С версии:
1.1

UNASSIGNED

public static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

UPPERCASE_LETTER

public static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

LOWERCASE_LETTER

public static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

TITLECASE_LETTER

public static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

MODIFIER_LETTER

public static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

OTHER_LETTER

public static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

NON_SPACING_MARK

public static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

ENCLOSING_MARK

public static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

COMBINING_SPACING_MARK

public static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

DECIMAL_DIGIT_NUMBER

public static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

LETTER_NUMBER

public static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

OTHER_NUMBER

public static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

SPACE_SEPARATOR

public static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

LINE_SEPARATOR

public static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

PARAGRAPH_SEPARATOR

public static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

CONTROL

public static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

FORMAT

public static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

PRIVATE_USE

public static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

SURROGATE

public static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

DASH_PUNCTUATION

public static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

START_PUNCTUATION

public static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

END_PUNCTUATION

public static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

CONNECTOR_PUNCTUATION

public static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

OTHER_PUNCTUATION

public static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

MATH_SYMBOL

public static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

CURRENCY_SYMBOL

public static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

MODIFIER_SYMBOL

public static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

OTHER_SYMBOL

public static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
С версии:
1.1
См. также:
  • Значения константных полей

INITIAL_QUOTE_PUNCTUATION

public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

FINAL_QUOTE_PUNCTUATION

public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_UNDEFINED

public static final byte DIRECTIONALITY_UNDEFINED
Неопределённый тип символа с двунаправленным текстом. Для неопределённых значений char в спецификации Unicode направление не задано.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип символа с двунаправленным текстом "L" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип символа с двунаправленным текстом "R" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип символа с двунаправленным текстом "AL" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип символа с двунаправленным текстом "EN" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип символа с двунаправленным текстом "ES" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип символа с двунаправленным текстом "ET" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_ARABIC_NUMBER

public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип символа с двунаправленным текстом "AN" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_COMMON_NUMBER_SEPARATOR

public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип символа с двунаправленным текстом "CS" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_NONSPACING_MARK

public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип символа с двунаправленным текстом "NSM" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_BOUNDARY_NEUTRAL

public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип символа с двунаправленным текстом "BN" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_PARAGRAPH_SEPARATOR

public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип символа с двунаправленным текстом "B" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_SEGMENT_SEPARATOR

public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип символа с двунаправленным текстом "S" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_WHITESPACE

public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип символа с двунаправленным текстом "WS" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_OTHER_NEUTRALS

public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип символа с двунаправленным текстом "ON" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип символа с двунаправленным текстом "LRE" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип символа с двунаправленным текстом "LRO" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип символа с двунаправленным текстом "RLE" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип символа с двунаправленным текстом "RLO" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_FORMAT

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип символа с двунаправленным текстом "PDF" в спецификации Unicode.
С версии:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый тип символа с двунаправленным текстом "LRI" в спецификации Unicode.
С версии:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый тип символа с двунаправленным текстом "RLI" в спецификации Unicode.
С версии:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_FIRST_STRONG_ISOLATE

public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый тип символа с двунаправленным текстом "FSI" в спецификации Unicode.
С версии:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый тип символа с двунаправленным текстом "PDI" в спецификации Unicode.
С версии:
9
См. также:
  • Значения константных полей

MIN_HIGH_SURROGATE

public static final char MIN_HIGH_SURROGATE
Минимальное значение 16-разрядной кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uD800'. Старший суррогат также называется ведущим суррогатом.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_HIGH_SURROGATE

public static final char MAX_HIGH_SURROGATE
Максимальное значение 16-разрядной кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uDBFF'. Старший суррогат также называется ведущим суррогатом.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_LOW_SURROGATE

public static final char MIN_LOW_SURROGATE
Минимальное значение 16-разрядной кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDC00'. Младший суррогат также называется замыкающим суррогатом.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_LOW_SURROGATE

public static final char MAX_LOW_SURROGATE
Максимальное значение 16-разрядной кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDFFF'. Младший суррогат также называется замыкающим суррогатом.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_SURROGATE

public static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uD800'.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_SURROGATE

public static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uDFFF'.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_SUPPLEMENTARY_CODE_POINT

public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_CODE_POINT

public static final int MIN_CODE_POINT
Минимальное значение кодовой точки Unicode, константа U+0000.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_CODE_POINT

public static final int MAX_CODE_POINT
Максимальное значение кодовой точки Unicode, константа U+10FFFF.
Начиная с:
1.5
См. также:
  • Значения констант полей

SIZE

public static final int SIZE
Количество битов, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
Начиная с:
1.5
См. также:
  • Значения констант полей

BYTES

public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме.
Начиная с:
1.8
См. также:
  • Значения констант полей

Подробное описание конструкторов

Character

@Deprecated(since="9") public Character(char value)
Устарело.
Использование этого конструктора редко бывает целесообразным. Обычно предпочтительнее использовать статический фабричный метод valueOf(char), поскольку он, вероятно, обеспечит значительно более высокую эффективность использования памяти и производительность.
Создает вновь выделенный объект Character, представляющий указанное значение char.
Параметры:
value — значение, которое будет представлено объектом Character.

Подробное описание методов

describeConstable

public Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра.
Указано в:
describeConstable в интерфейсе Constable
Возвращает:
Optional, описывающий экземпляр Character
Начиная с:
15

valueOf

public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char. Если создавать новый экземпляр Character не требуется, обычно следует предпочесть этот метод конструктору Character(char), поскольку этот метод, кэшируя часто запрашиваемые значения, вероятно, обеспечит значительно более высокую эффективность использования памяти и производительность. Этот метод всегда кэширует значения в диапазоне от '\u0000' до '\u007F' включительно и может кэшировать другие значения за пределами этого диапазона.
Параметры:
c — значение типа char.
Возвращает:
экземпляр Character, представляющий c.
Начиная с:
1.5

charValue

public char charValue()
Возвращает значение этого объекта Character.
Возвращает:
примитивное значение char, представленное этим объектом.

hashCode

public int hashCode()
Возвращает хэш-код объекта Character; он равен результату вызова charValue().
Переопределяет:
hashCode в классе Object
Возвращает:
значение хэш-кода этого объекта Character
См. также:
  • Object.equals(java.lang.Object)
  • System.identityHashCode(Object)

hashCode

public static int hashCode(char value)
Возвращает хэш-код значения char; совместим с Character.hashCode().
Параметры:
value — значение char, для которого требуется вернуть хэш-код.
Возвращает:
значение хэш-кода значения char.
Начиная с:
1.8

equals

public boolean equals(Object obj)
Сравнивает этот объект с указанным объектом. Результат равен true тогда и только тогда, когда аргумент не равен null и является объектом Character, представляющим то же значение char, что и этот объект.
Переопределяет:
equals в классе Object
Параметры:
obj — объект для сравнения.
Возвращает:
true, если объекты одинаковы; в противном случае — false.
См. также:
  • Object.hashCode()
  • HashMap

toString

public String toString()
Возвращает объект String, представляющий значение этого объекта Character. Результатом является строка длины 1, единственным компонентом которой служит примитивное значение char, представленное этим объектом Character.
Переопределяет:
toString в классе Object
Возвращает:
строковое представление этого объекта.

toString

public static String toString(char c)
Возвращает объект String, представляющий указанный char. Результатом является строка длины 1, состоящая только из указанного char.
Примечание к API:
Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные символы, используйте метод toString(int).
Параметры:
c — char для преобразования
Возвращает:
строковое представление указанного char
Начиная с:
1.4

toString

public static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode). Результатом является строка длины 1 или 2, состоящая только из указанного codePoint.
Параметры:
codePoint — codePoint для преобразования
Возвращает:
строковое представление указанного codePoint
Выбрасывает:
IllegalArgumentException — если указанное значение codePoint не является допустимой кодовой точкой Unicode.
Начиная с:
11

isValidCodePoint

public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode.
Параметры:
codePoint — кодовая точка Unicode для проверки
Возвращает:
true, если указанное значение кодовой точки находится в диапазоне от MIN_CODE_POINT до MAX_CODE_POINT включительно; в противном случае — false.
Начиная с:
1.5

isBmpCodePoint

public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в основной многоязычной плоскости (BMP). Такие кодовые точки можно представить одной char.
Параметры:
codePoint — символ (кодовая точка Unicode) для проверки
Возвращает:
true, если указанная кодовая точка находится в диапазоне от MIN_VALUE до MAX_VALUE включительно; в противном случае — false.
Начиная с:
1.7

isSupplementaryCodePoint

public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов.
Параметры:
codePoint — символ (кодовая точка Unicode) для проверки
Возвращает:
true, если указанная кодовая точка находится в диапазоне от MIN_SUPPLEMENTARY_CODE_POINT до MAX_CODE_POINT включительно; в противном случае — false.
Начиная с:
1.5

isHighSurrogate

public static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица ведущего суррогата).

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch — значение char для проверки.
Возвращает:
true, если значение char находится в диапазоне от MIN_HIGH_SURROGATE до MAX_HIGH_SURROGATE включительно; в противном случае — false.
Начиная с:
1.5
См. также:
  • isLowSurrogate(char)
  • Character.UnicodeBlock.of(int)

isLowSurrogate

public static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица замыкающего суррогата).

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch — значение char для проверки.
Возвращает:
true, если значение char находится в диапазоне от MIN_LOW_SURROGATE до MAX_LOW_SURROGATE включительно; в противном случае — false.
Начиная с:
1.5
См. также:
  • isHighSurrogate(char)

isSurrogate

public static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей суррогата Unicode.

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Значение char является кодовой единицей суррогата тогда и только тогда, когда оно представляет собой кодовую единицу младшего суррогата или старшего суррогата.

Параметры:
ch — значение char для проверки.
Возвращает:
true, если значение char находится в диапазоне от MIN_SURROGATE до MAX_SURROGATE включительно; в противном случае — false.
Начиная с:
1.7

isSurrogatePair

public static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char допустимой парой суррогатов Unicode.

Этот метод эквивалентен выражению:

isHighSurrogate(high) && isLowSurrogate(low)
Параметры:
high — значение кодовой единицы старшего суррогата для проверки
low — значение кодовой единицы младшего суррогата для проверки
Возвращает:
true, если указанные значения кодовых единиц старшего и младшего суррогатов образуют допустимую пару суррогатов; в противном случае — false.
Начиная с:
1.5

charCount

public static int charCount(int codePoint)
Определяет количество значений char, необходимых для представления указанного символа (кодовой точки Unicode). Если указанный символ равен 0x10000 или больше, метод возвращает 2. В противном случае метод возвращает 1.

Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. При необходимости вызывающий код должен проверить значение символа с помощью isValidCodePoint.

Параметры:
codePoint — символ (кодовая точка Unicode) для проверки.
Возвращает:
2, если символ является допустимым дополнительным символом; в противном случае — 1.
Начиная с:
1.5
См. также:
  • isSupplementaryCodePoint(int)

toCodePoint

public static int toCodePoint(char high, char low)
Преобразует указанную пару суррогатов в значение соответствующей дополнительной кодовой точки. Этот метод не проверяет указанную пару суррогатов. При необходимости вызывающий код должен проверить ее с помощью isSurrogatePair.
Параметры:
high — кодовая единица старшего суррогата
low — кодовая единица младшего суррогата
Возвращает:
дополнительную кодовую точку, образованную указанной парой суррогатов.
Начиная с:
1.5

codePointAt

public static int codePointAt(CharSequence seq, int index)
Возвращает кодовую точку по указанному индексу в CharSequence. Если значение char по указанному индексу в CharSequence находится в диапазоне старших суррогатов, следующий индекс меньше длины CharSequence, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
seq — последовательность значений char (кодовых единиц Unicode)
index — индекс значения char (кодовых единиц Unicode) в seq, которое требуется преобразовать
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если seq равен null.
IndexOutOfBoundsException — если значение index отрицательно или не меньше seq.length().
Начиная с:
1.5

codePointAt

public static int codePointAt(char[] a, int index)
Возвращает кодовую точку по указанному индексу в массиве char. Если значение char по указанному индексу в массиве char находится в диапазоне старших суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
a — массив char
index — индекс значения char (кодовых единиц Unicode) в массиве char, которое требуется преобразовать
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если a равен null.
IndexOutOfBoundsException — если значение index отрицательно или не меньше длины массива char.
Начиная с:
1.5

codePointAt

public static int codePointAt(char[] a, int index, int limit)
Возвращает кодовую точку по указанному индексу в массиве char; использовать можно только элементы массива с index меньше limit. Если значение char по указанному индексу в массиве char находится в диапазоне старших суррогатов, следующий индекс меньше limit, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
a — массив char
index — индекс значения char (кодовых единиц Unicode) в массиве char, которое требуется преобразовать
limit — индекс после последнего элемента массива, который можно использовать в массиве char
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если a равен null.
IndexOutOfBoundsException — если аргумент index отрицателен или не меньше аргумента limit, либо если аргумент limit отрицателен или больше длины массива char.
Начиная с:
1.5

codePointBefore

public static int codePointBefore(CharSequence seq, int index)
Возвращает кодовую точку, предшествующую указанному индексу в CharSequence. Если значение char в позиции (index - 1) в CharSequence находится в диапазоне младших суррогатов, (index - 2) не является отрицательным, а значение char в позиции (index - 2) в CharSequence находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).
Параметры:
seq — экземпляр CharSequence
index — индекс после кодовой точки, которую следует вернуть
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Выбрасывает:
NullPointerException — если seq равен null.
IndexOutOfBoundsException — если аргумент index меньше 1 или больше seq.length().
Начиная с:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index)
Возвращает кодовую точку, предшествующую указанному индексу в массиве char. Если значение char в позиции (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не является отрицательным, а значение char в позиции (index - 2) в массиве char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).
Параметры:
a — массив char
index — индекс после кодовой точки, которую следует вернуть
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Выбрасывает:
NullPointerException — если a равен null.
IndexOutOfBoundsException — если аргумент index меньше 1 или больше длины массива char
Начиная с:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index, int start)
Возвращает кодовую точку, предшествующую указанному индексу в массиве char; использовать можно только элементы массива с index, большим или равным start. Если значение char в позиции (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не меньше start, а значение char в позиции (index - 2) в массиве char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).
Параметры:
a — массив char
index — индекс после кодовой точки, которую следует вернуть
start — индекс первого элемента массива в массиве char
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Выбрасывает:
NullPointerException — если a равен null.
IndexOutOfBoundsException — если аргумент index не больше аргумента start или больше длины массива char, либо если аргумент start отрицателен или не меньше длины массива char.
Начиная с:
1.5

highSurrogate

public static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение char.

Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint — дополнительный символ (кодовая точка Unicode)
Возвращает:
кодовую единицу ведущего суррогата, используемую для представления символа в кодировке UTF-16
С версии:
1.7

lowSurrogate

public static char lowSurrogate(int codePoint)
Возвращает замыкающий суррогат (кодовую единицу младшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение char.

Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint — дополнительный символ (кодовая точка Unicode)
Возвращает:
кодовую единицу замыкающего суррогата, используемую для представления символа в кодировке UTF-16
С версии:
1.7

toChars

public static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16. Если указанная кодовая точка является значением BMP (базовой многоязычной плоскости, или плоскости 0), то это же значение сохраняется в dst[dstIndex], а возвращается 1. Если указанная кодовая точка является дополнительным символом, значения суррогатов сохраняются в dst[dstIndex] (старшего суррогата) и dst[dstIndex+1] (младшего суррогата), а возвращается 2.
Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо преобразовать.
dst — массив char, в который сохраняется значение UTF-16 для codePoint.
dstIndex — начальный индекс в массиве dst, по которому сохраняется преобразованное значение.
Возвращает:
1, если кодовая точка является кодовой точкой BMP; 2, если кодовая точка является дополнительной кодовой точкой.
Исключения:
IllegalArgumentException — если указанная codePoint не является допустимой кодовой точкой Unicode.
NullPointerException — если указанная dst равна null.
IndexOutOfBoundsException — если dstIndex отрицателен или не меньше dst.length, либо если в dst, начиная с dstIndex, недостаточно элементов массива для сохранения результирующих значений char. (Если dstIndex равно dst.length-1 и указанная codePoint является дополнительным символом, значение старшего суррогата не сохраняется в dst[dstIndex].)
С версии:
1.5

toChars

public static char[] toChars(int codePoint)
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16, сохранённое в массиве char. Если указанная кодовая точка является значением BMP (базовой многоязычной плоскости, или плоскости 0), результирующий массив char содержит то же значение, что и codePoint. Если указанная кодовая точка является дополнительной кодовой точкой, результирующий массив char содержит соответствующую суррогатную пару.
Параметры:
codePoint — кодовая точка Unicode
Возвращает:
массив char, содержащий представление UTF-16 для codePoint.
Исключения:
IllegalArgumentException — если указанная codePoint не является допустимой кодовой точкой Unicode.
С версии:
1.5

codePointCount

public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество кодовых точек Unicode в диапазоне текста указанной последовательности символов. Диапазон текста начинается с указанного beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина диапазона текста (в charах) равна endIndex-beginIndex. Непарные суррогаты в диапазоне текста считаются отдельными кодовыми точками.
Параметры:
seq — последовательность символов
beginIndex — индекс первого char диапазона текста.
endIndex — индекс после последнего char диапазона текста.
Возвращает:
количество кодовых точек Unicode в указанном диапазоне текста
Исключения:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если beginIndex отрицателен, endIndex больше длины указанной последовательности или beginIndex больше endIndex.
С версии:
1.5

codePointCount

public static int codePointCount(char[] a, int offset, int count)
Возвращает количество кодовых точек Unicode в подмассиве массива char, переданного в качестве аргумента. Аргумент offset задаёт индекс первого char подмассива, а аргумент count — длину подмассива в charах. Непарные суррогаты в подмассиве считаются отдельными кодовыми точками.
Параметры:
a — массив char
offset — индекс первого char в указанном массиве char
count — длина подмассива в charах
Возвращает:
количество кодовых точек Unicode в указанном подмассиве
Исключения:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если offset или count отрицателен либо если offset + count больше длины указанного массива.
С версии:
1.5

offsetByCodePoints

public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в указанной последовательности символов, смещённый относительно заданного index на codePointOffset кодовых точек. Непарные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.
Параметры:
seq — последовательность символов
index — индекс, относительно которого вычисляется смещение
codePointOffset — смещение в кодовых точках
Возвращает:
индекс в последовательности символов
Исключения:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если index отрицателен или больше длины последовательности символов, либо если codePointOffset положителен и в подпоследовательности, начинающейся с index, меньше codePointOffset кодовых точек, либо если codePointOffset отрицателен и в подпоследовательности перед index меньше кодовых точек, чем абсолютное значение codePointOffset.
С версии:
1.5

offsetByCodePoints

public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в указанном подмассиве char, смещённый относительно заданного index на codePointOffset кодовых точек. Аргументы start и count задают подмассив массива char. Непарные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.
Параметры:
a — массив char
start — индекс первого char подмассива
count — длина подмассива в charах
index — индекс, относительно которого вычисляется смещение
codePointOffset — смещение в кодовых точках
Возвращает:
индекс в подмассиве
Исключения:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если start или count отрицателен, либо если start + count больше длины указанного массива, либо если index меньше start или больше start + count, либо если codePointOffset положителен и в диапазоне текста, начинающемся с index и заканчивающемся start + count - 1, меньше codePointOffset кодовых точек, либо если codePointOffset отрицателен и в диапазоне текста, начинающемся с start и заканчивающемся index - 1, меньше кодовых точек, чем абсолютное значение codePointOffset.
С версии:
1.5

isLowerCase

public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчным.

Символ является строчным, если его тип общей категории, предоставляемый Character.getType(ch), — LOWERCASE_LETTER, либо если он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.

Примеры строчных символов:

a b c d e f g h i j k l m n o p q r s t u v w x y z
'\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
'\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
'\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
'\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'

Многие другие символы Unicode также являются строчными.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является строчным; в противном случае — false.
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toLowerCase(char)
  • getType(char)

isLowerCase

public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) строчным.

Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), — LOWERCASE_LETTER, либо если он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.

Примеры строчных символов:

a b c d e f g h i j k l m n o p q r s t u v w x y z
'\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
'\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
'\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
'\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'

Многие другие символы Unicode также являются строчными.

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является строчным; в противном случае — false.
С версии:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toLowerCase(int)
  • getType(int)

isUpperCase

public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ прописным.

Символ является прописным, если его тип общей категории, предоставляемый Character.getType(ch), — UPPERCASE_LETTER, либо если он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.

Примеры прописных символов:

A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
'\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
'\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
'\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
'\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'

Многие другие символы Unicode также являются прописными.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isUpperCase(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является прописным; в противном случае — false.
С версии:
1.0
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toUpperCase(char)
  • getType(char)

isUpperCase

public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) прописным.

Символ является прописным, если его тип общей категории, предоставляемый getType(codePoint), — UPPERCASE_LETTER, либо если он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.

Примеры прописных символов:

A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
'\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
'\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
'\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
'\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'

Многие другие символы Unicode также являются прописными.

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является прописным; в противном случае — false.
С версии:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toUpperCase(int)
  • getType(int)

isTitleCase

public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом в верхнем регистре заголовка.

Символ является символом в верхнем регистре заголовка, если его тип общей категории, предоставляемый Character.getType(ch), — TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», которой соответствует строчная буква, похожая на «lj». Третья форма, похожая на «Lj», является подходящей для отображения слова строчными буквами с заглавной первой буквой, например в названии книги.

Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются символами в верхнем регистре заголовка.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isTitleCase(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является символом в верхнем регистре заголовка; в противном случае — false.
С версии:
1.0.2
См. также:
  • isLowerCase(char)
  • isUpperCase(char)
  • toTitleCase(char)
  • getType(char)

isTitleCase

public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) символом в верхнем регистре заголовка.

Символ является символом в верхнем регистре заголовка, если его тип общей категории, предоставляемый getType(codePoint), — TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», которой соответствует строчная буква, похожая на «lj». Третья форма, похожая на «Lj», является подходящей для отображения слова строчными буквами с заглавной первой буквой, например в названии книги.

Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются символами в верхнем регистре заголовка.

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является символом в верхнем регистре заголовка; в противном случае — false.
С версии:
1.5
См. также:
  • isLowerCase(int)
  • isUpperCase(int)
  • toTitleCase(int)
  • getType(int)

isDigit

public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.

Символ является цифрой, если его тип общей категории, предоставляемый Character.getType(ch), — DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030'–'\u0039', цифры ISO-LATIN-1 ('0'–'9')
  • '\u0660'–'\u0669', арабско-индийские цифры
  • '\u06F0'–'\u06F9', расширенные арабско-индийские цифры
  • '\u0966'–'\u096F', цифры деванагари
  • '\uFF10'–'\uFF19', полноширинные цифры
Многие другие диапазоны символов также содержат цифры.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isDigit(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является цифрой; в противном случае — false.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • getType(char)

isDigit

public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой.

Символ является цифрой, если его тип общей категории, предоставляемый getType(codePoint), — DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030'–'\u0039', цифры ISO-LATIN-1 ('0'–'9')
  • '\u0660'–'\u0669', арабско-индийские цифры
  • '\u06F0'–'\u06F9', расширенные арабско-индийские цифры
  • '\u0966'–'\u096F', цифры деванагари
  • '\uFF10'–'\uFF19', полноширинные цифры
Многие другие диапазоны символов также содержат цифры.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является цифрой; в противном случае — false.
С версии:
1.5
См. также:
  • forDigit(int, int)
  • getType(int)

isDefined

public static boolean isDefined(char ch)
Определяет, задан ли символ в Unicode.

Символ считается заданным, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Он имеет значение в диапазоне, определённом файлом UnicodeData.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isDefined(int).

Параметры:
ch — проверяемый символ
Возвращает:
true, если символ имеет определённое значение в Unicode; в противном случае — false.
С версии:
1.0.2
См. также:
  • isDigit(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUpperCase(char)

isDefined

public static boolean isDefined(int codePoint)
Определяет, задан ли символ (кодовая точка Unicode) в Unicode.

Символ считается заданным, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Он имеет значение в диапазоне, определённом файлом UnicodeData.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ имеет определённое значение в Unicode; в противном случае — false.
С версии:
1.5
См. также:
  • isDigit(int)
  • isLetter(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUpperCase(int)

isLetter

public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.

Символ считается буквой, если его тип общей категории, предоставляемый Character.getType(ch), относится к одному из следующих типов:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не относятся ни к прописным, ни к строчным, ни к символам в верхнем регистре заголовка.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLetter(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является буквой; в противном случае — false.
См. также:
  • isDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUnicodeIdentifierStart(char)
  • isUpperCase(char)

isLetter

public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой.

Символ считается буквой, если его тип общей категории, предоставляемый getType(codePoint), относится к одному из следующих типов:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не относятся ни к прописным, ни к строчным, ни к символам в верхнем регистре заголовка.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является буквой; в противном случае — false.
С версии:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUnicodeIdentifierStart(int)
  • isUpperCase(int)

isLetterOrDigit

public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.

Символ считается буквой или цифрой, если для него Character.isLetter(char ch) или Character.isDigit(char ch) возвращает true.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLetterOrDigit(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является буквой или цифрой; в противном случае — false.
С версии:
1.0.2
См. также:
  • isDigit(char)
  • isJavaIdentifierPart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isLetterOrDigit

public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой.

Символ считается буквой или цифрой, если для него isLetter(codePoint) или isDigit(codePoint) возвращает true.

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является буквой или цифрой; в противном случае — false.
Начиная с:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isJavaLetter

@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Устарел.
Заменён на isJavaIdentifierStart(char).
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является соединительным знаком пунктуации (например, '_').
Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Java; в противном случае — false.
Начиная с:
1.0.2
См. также:
  • isJavaLetterOrDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isJavaLetterOrDigit

@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Устарел.
Заменён на isJavaIdentifierPart(char).
Определяет, может ли указанный символ входить в состав идентификатора Java не в качестве первого символа.

Символ может входить в состав идентификатора Java тогда и только тогда, когда истинно одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это числовая буква (например, символ римской цифры)
  • это комбинируемый знак
  • это невидимый знак
  • для символа isIdentifierIgnorable возвращает true.
Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может входить в состав идентификатора Java; в противном случае — false.
Начиная с:
1.0.2
См. также:
  • isJavaLetter(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • isIdentifierIgnorable(char)

isAlphabetic

public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) алфавитным.

Символ считается алфавитным, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
  • LETTER_NUMBER
либо он имеет дополнительное свойство Other_Alphabetic, определённое стандартом Unicode.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является алфавитным символом Unicode; в противном случае — false.
Начиная с:
1.7

isIdeographic

public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайского, японского, корейского или вьетнамского письма), как определено стандартом Unicode.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является идеографическим символом Unicode; в противном случае — false.
Начиная с:
1.7

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является соединительным знаком пунктуации (например, '_').

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Java; в противном случае — false.
Начиная с:
1.1
См. также:
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isUnicodeIdentifierStart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER
  • указанный символ является символом валюты (например, '$')
  • указанный символ является соединительным знаком пунктуации (например, '_').
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может начинать идентификатор Java; в противном случае — false.
Начиная с:
1.5
См. также:
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierStart(int)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ входить в состав идентификатора Java не в качестве первого символа.

Символ может входить в состав идентификатора Java, если истинно одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это числовая буква (например, символ римской цифры)
  • это комбинируемый знак
  • это невидимый знак
  • для символа isIdentifierIgnorable возвращает true

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может входить в состав идентификатора Java; в противном случае — false.
Начиная с:
1.1
См. также:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierStart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовая точка Unicode) входить в состав идентификатора Java не в качестве первого символа.

Символ может входить в состав идентификатора Java, если истинно одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это числовая буква (например, символ римской цифры)
  • это комбинируемый знак
  • это невидимый знак
  • isIdentifierIgnorable(codePoint) возвращает true для этой кодовой точки
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может входить в состав идентификатора Java; в противном случае — false.
Начиная с:
1.5
См. также:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierPart(int)
  • SourceVersion.isIdentifier(CharSequence)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode.

Символ может начинать идентификатор Unicode тогда и только тогда, когда истинно одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:

Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Unicode; в противном случае — false.
Начиная с:
1.1
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isJavaIdentifierStart(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode.

Символ может начинать идентификатор Unicode тогда и только тогда, когда истинно одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:

Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может начинать идентификатор Unicode; в противном случае — false.
Начиная с:
1.5
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isJavaIdentifierStart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ входить в состав идентификатора Unicode не в качестве первого символа.

Символ может входить в состав идентификатора Unicode тогда и только тогда, когда истинно одно из следующих утверждений:

  • это буква
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это числовая буква (например, символ римской цифры)
  • это комбинируемый знак
  • это невидимый знак
  • для этого символа isIdentifierIgnorable возвращает true.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:

Continue := Start + ID_Continue + ignorable
Medial := empty
ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавляется к Continue для обеспечения обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может входить в состав идентификатора Unicode; в противном случае — false.
Начиная с:
1.1
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierPart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовая точка Unicode) входить в состав идентификатора Unicode не в качестве первого символа.

Символ может входить в состав идентификатора Unicode тогда и только тогда, когда истинно одно из следующих утверждений:

  • это буква
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это числовая буква (например, символ римской цифры)
  • это комбинируемый знак
  • это невидимый знак
  • для этого символа isIdentifierIgnorable возвращает true.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:

Continue := Start + ID_Continue + ignorable
Medial := empty
ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавляется к Continue для обеспечения обратной совместимости.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может входить в состав идентификатора Unicode; в противном случае — false.
Начиная с:
1.5
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierPart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierStart(int)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или Unicode.

Следующие символы Unicode являются игнорируемыми в идентификаторах Java и Unicode:

  • управляющие символы ISO, не являющиеся пробельными символами
    • '\u0000' — '\u0008'
    • '\u000E' — '\u001B'
    • '\u007F' — '\u009F'
  • все символы со значением общей категории FORMAT

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является игнорируемым управляющим символом, который может входить в состав идентификатора Java или Unicode; в противном случае — false.
Начиная с:
1.1
См. также:
  • isJavaIdentifierPart(char)
  • isUnicodeIdentifierPart(char)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или Unicode.

Следующие символы Unicode являются игнорируемыми в идентификаторах Java и Unicode:

  • управляющие символы ISO, не являющиеся пробельными символами
    • '\u0000' — '\u0008'
    • '\u000E' — '\u001B'
    • '\u007F' — '\u009F'
  • все символы со значением общей категории FORMAT
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является игнорируемым управляющим символом, который может входить в состав идентификатора Java или Unicode; в противном случае — false.
Начиная с:
1.5
См. также:
  • isJavaIdentifierPart(int)
  • isUnicodeIdentifierPart(int)

isEmoji

public static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи.

Символ считается эмодзи тогда и только тогда, когда он имеет свойство Emoji, определённое в стандарте Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является эмодзи; в противном случае — false.
Начиная с:
21
Внешние спецификации
  • Эмодзи Unicode

isEmojiPresentation

public static boolean isEmojiPresentation(int codePoint)
Определяет, имеет ли указанный символ (кодовая точка Unicode) свойство Emoji Presentation по умолчанию.

Символ считается имеющим свойство Emoji Presentation тогда и только тогда, когда он имеет свойство Emoji_Presentation, определённое в стандарте Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ имеет свойство Emoji Presentation; в противном случае — false.
Начиная с:
21
Внешние спецификации
  • Эмодзи Unicode

isEmojiModifier

public static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором эмодзи.

Символ считается модификатором эмодзи тогда и только тогда, когда он имеет свойство Emoji_Modifier, определённое в стандарте Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является модификатором эмодзи; в противном случае — false.
Начиная с:
21
Внешние спецификации
  • Эмодзи Unicode

isEmojiModifierBase

public static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом-модификатором эмодзи.

Символ считается базовым символом-модификатором эмодзи тогда и только тогда, когда он имеет свойство Emoji_Modifier_Base, определённое в стандарте Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является базовым символом-модификатором эмодзи; в противном случае — false.
Начиная с:
21
Внешние спецификации
  • Эмодзи Unicode

isEmojiComponent

public static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом эмодзи.

Символ считается компонентом эмодзи тогда и только тогда, когда он имеет свойство Emoji_Component, определённое в стандарте Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является компонентом эмодзи; в противном случае — false.
Начиная с:
21
Внешние спецификации
  • Эмодзи Unicode

isExtendedPictographic

public static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом.

Символ считается расширенным пиктографическим символом тогда и только тогда, когда у него есть свойство Extended_Pictographic, определённое в Emoji Unicode (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), подлежащий проверке.
Возвращает:
true, если символ является расширенным пиктографическим символом; false в противном случае.
Начиная с:
21
Внешние спецификации
  • Emoji Unicode

toLowerCase

public static char toLowerCase(char ch)
Преобразует аргумент-символ в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.

В общем случае для преобразования символов в нижний регистр следует использовать String.toLowerCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).

Параметры:
ch — символ для преобразования.
Возвращает:
эквивалент символа в нижнем регистре, если он существует; в противном случае сам символ.
См. также:
  • isLowerCase(char)
  • String.toLowerCase()

toLowerCase

public static int toLowerCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.

В общем случае для преобразования символов в нижний регистр следует использовать String.toLowerCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.

Параметры:
codePoint — символ (кодовая точка Unicode) для преобразования.
Возвращает:
эквивалент символа (кодовой точки Unicode) в нижнем регистре, если он существует; в противном случае сам символ.
Начиная с:
1.5
См. также:
  • isLowerCase(int)
  • String.toLowerCase()

toUpperCase

public static char toUpperCase(char ch)
Преобразует аргумент-символ в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.

В общем случае для преобразования символов в верхний регистр следует использовать String.toUpperCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toUpperCase(int).

Параметры:
ch — символ для преобразования.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае сам символ.
См. также:
  • isUpperCase(char)
  • String.toUpperCase()

toUpperCase

public static int toUpperCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.

В общем случае для преобразования символов в верхний регистр следует использовать String.toUpperCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.

Параметры:
codePoint — символ (кодовая точка Unicode) для преобразования.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае сам символ.
Начиная с:
1.5
См. также:
  • isUpperCase(int)
  • String.toUpperCase()

toTitleCase

public static char toTitleCase(char ch)
Преобразует аргумент-символ в заглавный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа не задано явное преобразование в заглавный регистр и согласно UnicodeData он сам не является символом в заглавном регистре, возвращается преобразование в верхний регистр как эквивалентное преобразование в заглавный регистр. Если аргумент char уже является символом char в заглавном регистре, возвращается то же значение char.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toTitleCase(int).

Параметры:
ch — символ для преобразования.
Возвращает:
эквивалент символа в заглавном регистре, если он существует; в противном случае сам символ.
Начиная с:
1.0.2
См. также:
  • isTitleCase(char)
  • toLowerCase(char)
  • toUpperCase(char)

toTitleCase

public static int toTitleCase(int codePoint)
Преобразует аргумент-символ (кодовую точку Unicode) в заглавный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа не задано явное преобразование в заглавный регистр и согласно UnicodeData он сам не является символом в заглавном регистре, возвращается преобразование в верхний регистр как эквивалентное преобразование в заглавный регистр. Если аргумент-символ уже является символом в заглавном регистре, возвращается то же значение символа.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.

Параметры:
codePoint — символ (кодовая точка Unicode) для преобразования.
Возвращает:
эквивалент символа в заглавном регистре, если он существует; в противном случае сам символ.
Начиная с:
1.5
См. также:
  • isTitleCase(int)
  • toLowerCase(int)
  • toUpperCase(int)

digit

public static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанной системе счисления.

Если система счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:

  • Метод isDigit возвращает true для символа, а десятичное значение цифры Unicode для этого символа (или его разложения на один символ) меньше указанной системы счисления. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', а его код меньше radix + 'A' - 10. В этом случае возвращается ch - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', а его код меньше radix + 'a' - 10. В этом случае возвращается ch - 'a' + 10.
  • Символ является одной из полноширинных заглавных латинских букв от A ('\uFF21') до Z ('\uFF3A'), а его код меньше radix + '\uFF21' - 10. В этом случае возвращается ch - '\uFF21' + 10.
  • Символ является одной из полноширинных строчных латинских букв от a ('\uFF41') до z ('\uFF5A'), а его код меньше radix + '\uFF41' - 10. В этом случае возвращается ch - '\uFF41' + 10.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).

Параметры:
ch — символ для преобразования.
radix — система счисления.
Возвращает:
числовое значение, представленное символом в указанной системе счисления.
См. также:
  • forDigit(int, int)
  • isDigit(char)

digit

public static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кодовой точки Unicode) в указанной системе счисления.

Если система счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:

  • Метод isDigit(codePoint) возвращает true для символа, а десятичное значение цифры Unicode для этого символа (или его разложения на один символ) меньше указанной системы счисления. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', а его код меньше radix + 'A' - 10. В этом случае возвращается codePoint - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', а его код меньше radix + 'a' - 10. В этом случае возвращается codePoint - 'a' + 10.
  • Символ является одной из полноширинных заглавных латинских букв от A ('\uFF21') до Z ('\uFF3A'), а его код меньше radix + '\uFF21' - 10. В этом случае возвращается codePoint - '\uFF21' + 10.
  • Символ является одной из полноширинных строчных латинских букв от a ('\uFF41') до z ('\uFF5A'), а его код меньше radix + '\uFF41'- 10. В этом случае возвращается codePoint - '\uFF41' + 10.
Параметры:
codePoint — символ (кодовая точка Unicode) для преобразования.
radix — система счисления.
Возвращает:
числовое значение, представленное символом в указанной системе счисления.
Начиная с:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

getNumericValue

public static int getNumericValue(char ch)
Возвращает числовое значение int, которое представляет указанный символ Unicode. Например, символ '\u216C' (римское число пятьдесят) вернёт значение int, равное 50.

Заглавные буквы A–Z (от '\u0041' до '\u005A'), строчные буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим значениям char.

Если символ не имеет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).

Параметры:
ch — символ для преобразования.
Возвращает:
числовое значение символа в виде неотрицательного значения int; -2, если символ имеет числовое значение, но его нельзя представить в виде неотрицательного значения int; -1, если символ не имеет числового значения.
Начиная с:
1.1
См. также:
  • forDigit(int, int)
  • isDigit(char)

getNumericValue

public static int getNumericValue(int codePoint)
Возвращает числовое значение int, которое представляет указанный символ (кодовая точка Unicode). Например, символ '\u216C' (римское число пятьдесят) вернёт значение int, равное 50.

Заглавные буквы A–Z (от '\u0041' до '\u005A'), строчные буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим значениям char.

Если символ не имеет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.

Параметры:
codePoint — символ (кодовая точка Unicode) для преобразования.
Возвращает:
числовое значение символа в виде неотрицательного значения int; -2, если символ имеет числовое значение, но его нельзя представить в виде неотрицательного значения int; -1, если символ не имеет числового значения.
Начиная с:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

isSpace

@Deprecated(since="1.1") public static boolean isSpace(char ch)
Устарело.
Заменён методом isWhitespace(char).
Определяет, является ли указанный символ пробельным символом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
truechars
Символ Код Название
'\t' U+0009 HORIZONTAL TABULATION
'\n' U+000A NEW LINE
'\f' U+000C FORM FEED
'\r' U+000D CARRIAGE RETURN
' ' U+0020 SPACE
Параметры:
ch — символ, подлежащий проверке.
Возвращает:
true, если символ является пробельным символом ISO-LATIN-1; false в противном случае.
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ пробельным символом Unicode. Символ считается пробельным тогда и только тогда, когда стандарт Unicode определяет его как пробельный. Метод возвращает true, если символ относится к одному из следующих типов общей категории:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).

Параметры:
ch — символ, подлежащий проверке.
Возвращает:
true, если символ является пробельным; false в противном случае.
Начиная с:
1.1
См. также:
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом Unicode. Символ считается пробельным тогда и только тогда, когда стандарт Unicode определяет его как пробельный. Метод возвращает true, если символ относится к одному из следующих типов общей категории:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR
Параметры:
codePoint — символ (кодовая точка Unicode), подлежащий проверке.
Возвращает:
true, если символ является пробельным; false в противном случае.
Начиная с:
1.5
См. также:
  • isWhitespace(int)

isWhitespace

public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробельным символом согласно Java. Символ считается пробельным символом Java тогда и только тогда, когда он удовлетворяет одному из следующих критериев:
  • Он является пробельным символом Unicode (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Это '\t', U+0009 HORIZONTAL TABULATION.
  • Это '\n', U+000A LINE FEED.
  • Это '\u000B', U+000B VERTICAL TABULATION.
  • Это '\f', U+000C FORM FEED.
  • Это '\r', U+000D CARRIAGE RETURN.
  • Это '\u001C', U+001C FILE SEPARATOR.
  • Это '\u001D', U+001D GROUP SEPARATOR.
  • Это '\u001E', U+001E RECORD SEPARATOR.
  • Это '\u001F', U+001F UNIT SEPARATOR.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isWhitespace(int).

Параметры:
ch — символ, подлежащий проверке.
Возвращает:
true, если символ является пробельным символом Java; false в противном случае.
Начиная с:
1.1
См. также:
  • isSpaceChar(char)

isWhitespace

public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java. Символ считается пробельным символом Java тогда и только тогда, когда он удовлетворяет одному из следующих критериев:
  • Он является пробельным символом Unicode (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Это '\t', U+0009 HORIZONTAL TABULATION.
  • Это '\n', U+000A LINE FEED.
  • Это '\u000B', U+000B VERTICAL TABULATION.
  • Это '\f', U+000C FORM FEED.
  • Это '\r', U+000D CARRIAGE RETURN.
  • Это '\u001C', U+001C FILE SEPARATOR.
  • Это '\u001D', U+001D GROUP SEPARATOR.
  • Это '\u001E', U+001E RECORD SEPARATOR.
  • Это '\u001F', U+001F UNIT SEPARATOR.
Параметры:
codePoint — символ (кодовая точка Unicode), подлежащий проверке.
Возвращает:
true, если символ является пробельным символом Java; false в противном случае.
Начиная с:
1.5
См. также:
  • isSpaceChar(int)

isISOControl

public static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO. Символ считается управляющим символом ISO, если его код входит в диапазон от '\u0000' до '\u001F' или в диапазон от '\u007F' до '\u009F'.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).

Параметры:
ch — символ, подлежащий проверке.
Возвращает:
true, если символ является управляющим символом ISO; false в противном случае.
Начиная с:
1.1
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isISOControl

public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO. Символ считается управляющим символом ISO, если его код входит в диапазон от '\u0000' до '\u001F' или в диапазон от '\u007F' до '\u009F'.
Параметры:
codePoint — символ (кодовая точка Unicode), подлежащий проверке.
Возвращает:
true, если символ является управляющим символом ISO; false в противном случае.
Начиная с:
1.5
См. также:
  • isSpaceChar(int)
  • isWhitespace(int)

getType

public static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).

Параметры:
ch — символ, подлежащий проверке.
Возвращает:
значение типа int, представляющее общую категорию символа.
Начиная с:
1.1
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

getType

public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
Параметры:
codePoint — символ (кодовая точка Unicode), который требуется проверить.
Возвращает:
значение типа int, представляющее общую категорию символа.
Начиная с:
1.5
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

forDigit

public static char forDigit(int digit, int radix)
Определяет символьное представление заданной цифры в указанной системе счисления. Если значение radix не является допустимым основанием системы счисления или значение digit не является допустимой цифрой в указанной системе счисления, возвращается нулевой символ ('\u0000').

Аргумент radix допустим, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.

Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.

Параметры:
digit — число, которое требуется преобразовать в символ.
radix — основание системы счисления.
Возвращает:
представление char заданной цифры в указанной системе счисления.
См. также:
  • MIN_RADIX
  • MAX_RADIX
  • digit(char, int)

getDirectionality

public static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для заданного символа. Направленность символов используется для вычисления визуального порядка текста. Значение направленности неопределенных значений char равно DIRECTIONALITY_UNDEFINED.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).

Параметры:
ch — char, для которого запрашивается свойство направленности.
Возвращает:
свойство направленности значения char.
Начиная с:
1.4
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

getDirectionality

public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Unicode для заданного символа (кодовой точки Unicode). Направленность символов используется для вычисления визуального порядка текста. Значение направленности неопределенного символа — DIRECTIONALITY_UNDEFINED.
Параметры:
codePoint — символ (кодовая точка Unicode), для которого запрашивается свойство направленности.
Возвращает:
свойство направленности символа.
Начиная с:
1.5
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

isMirrored

public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным согласно спецификации Unicode. При отображении в тексте с направлением справа налево глифы зеркальных символов должны отражаться по горизонтали. Например, '\u0028' LEFT PARENTHESIS семантически определена как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isMirrored(int).

Параметры:
ch — char, для которого запрашивается свойство зеркальности
Возвращает:
true, если символ зеркальный; false, если char не является зеркальным или не определен.
Начиная с:
1.4

isMirrored

public static boolean isMirrored(int codePoint)
Определяет, является ли заданный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode. При отображении в тексте с направлением справа налево глифы зеркальных символов должны отражаться по горизонтали. Например, '\u0028' LEFT PARENTHESIS семантически определена как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».
Параметры:
codePoint — символ (кодовая точка Unicode), который требуется проверить.
Возвращает:
true, если символ зеркальный; false, если символ не является зеркальным или не определен.
Начиная с:
1.5

compareTo

public int compareTo(Character anotherCharacter)
Сравнивает численно два объекта Character.
Определено в:
compareTo в интерфейсе Comparable<Character>
Параметры:
anotherCharacter — объект Character для сравнения.
Возвращает:
значение 0, если аргумент Character равен этому объекту Character; значение меньше 0, если этот объект Character численно меньше аргумента Character; и значение больше 0, если этот объект Character численно больше аргумента Character (беззнаковое сравнение). Обратите внимание, что это исключительно числовое сравнение; оно не зависит от локали.
Начиная с:
1.2

compare

public static int compare(char x, char y)
Сравнивает численно два значения char. Возвращаемое значение совпадает со значением, которое было бы возвращено следующим выражением:
   Character.valueOf(x).compareTo(Character.valueOf(y))
Параметры:
x — первое значение char для сравнения
y — второе значение char для сравнения
Возвращает:
значение 0, если x == y; значение меньше 0, если x < y; и значение больше 0, если x > y
Начиная с:
1.7

reverseBytes

public static char reverseBytes(char ch)
Возвращает значение, полученное перестановкой байтов в заданном значении char.
Параметры:
ch — значение char, в котором требуется изменить порядок байтов.
Возвращает:
значение, полученное перестановкой (или, что эквивалентно, обменом местами) байтов в заданном значении char.
Начиная с:
1.5

getName

public static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если кодовая точка является unassigned.

Если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Консорциумом Unicode), возвращаемое имя совпадает с результатом выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для codePointов из файла UnicodeData имя, возвращаемое этим методом, соответствует схеме именования, описанной в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, таких как Hangul/Ideographs, приведенное выше правило формирования имени отличается от правила, определенного в стандарте Unicode.
Параметры:
codePoint — символ (кодовая точка Unicode)
Возвращает:
имя указанного символа или null, если кодовая точка не назначена.
Вызывает исключение:
IllegalArgumentException — если указанное значение codePoint не является допустимой кодовой точкой Unicode.
Начиная с:
1.7

codePointOf

public static int codePointOf(String name)
Возвращает значение кодовой точки символа Unicode, указанного заданным именем символа.

Если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Консорциумом Unicode), его имя определяется как результат выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);

Сопоставление name не учитывает регистр; все начальные и конечные пробельные символы удаляются. Для кодовых точек из файла UnicodeData этот метод распознает имена, соответствующие определениям из раздела «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек метод распознает имена, сформированные методом getName(int).

Параметры:
name — имя символа
Возвращает:
значение кодовой точки символа, заданного его именем.
Вызывает исключение:
IllegalArgumentException — если указанное значение name не является допустимым именем символа.
NullPointerException — если name равно null
Начиная с:
9

Сообщить об ошибке или предложить улучшение
Дополнительные справочные материалы по API и документацию для разработчиков см. в разделе Документация Java SE, содержащем более подробные описания для разработчиков, обзоры концепций, определения терминов, обходные решения и примеры работающего кода. Другие версии.
Java является товарным знаком или зарегистрированным товарным знаком Oracle и/или ее аффилированных лиц в США и других странах.
Авторские права © 1993, 2025, Oracle и/или ее аффилированные лица, 500 Oracle Parkway, Redwood Shores, CA 94065 USA.
Все права защищены. Использование регулируется условиями лицензии и политикой распространения документации.

© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/25/docs/api/java.base/java/lang/Character.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API