Spec-Zone.ru › OpenJDK 27

Класс Character

java.lang.Object
java.lang.Character
Все реализуемые интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Класс Character является классом-обёрткой для значений примитивного типа char. Объект типа Character содержит одно поле типа char.

Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.), а также для преобразования символов из верхнего регистра в нижний и наоборот.

Соответствие Unicode

Поля и методы класса Character определяются на основе информации о символах из стандарта Unicode, в частности файла UnicodeData, входящего в базу данных символов Unicode. В этом файле указаны такие свойства, как имя и категория, для каждой назначенной кодовой точки Unicode или диапазона символов. Файл доступен на сайте Консорциума Unicode: http://www.unicode.org.

Информация о символах основана на стандарте Unicode версии 17.0.

Со временем платформа Java поддерживала различные версии стандарта Unicode. В следующих таблицах указана версия Unicode, используемая в каждом выпуске Java. Если не указано иное, во всех обновлениях одного семейства выпусков Java используется одна и та же версия Unicode.

Показывает выпуски Java и поддерживаемые версии Unicode
Выпуск Java Версия Unicode
Java SE 26 Unicode 17.0
Java SE 25 Unicode 16.0
Java SE 21 Unicode 15.0
Java SE 17 Unicode 13.0
Java SE 11 Unicode 10.0
Java SE 8 Unicode 6.2
Показать другие выпуски Java

Выпуски Java, предшествующие Java SE 8, перечислены только в том случае, если в них обновлялась версия Unicode

Показывает другие выпуски Java и поддерживаемые версии Unicode
Выпуск Java Версия Unicode
Java SE 24 Unicode 16.0
Java SE 23 Unicode 15.1
Java SE 22 Unicode 15.1
Java SE 20 Unicode 15.0
Java SE 19 Unicode 14.0
Java SE 18 Unicode 13.0
Java SE 16 Unicode 13.0
Java SE 15 Unicode 13.0
Java SE 14 Unicode 12.1
Java SE 13 Unicode 12.1
Java SE 12 Unicode 11.0
Java SE 10 Unicode 8.0
Java SE 9 Unicode 8.0
Java SE 7 Unicode 6.0
Java SE 5.0 Unicode 4.0
Java SE 1.4 Unicode 3.0
JDK 1.1 Unicode 2.0
JDK 1.0.2 Unicode 1.1.5

Отличия от этих базовых версий Unicode, например распознаваемые дополнения, описаны в других местах.

Представление символов Unicode

Тип данных char (и, следовательно, значение, инкапсулируемое объектом Character) основан на исходной спецификации Unicode, в которой символы определялись как сущности фиксированной ширины размером 16 бит. Позднее стандарт Unicode был изменён, чтобы допустить символы, для представления которых требуется более 16 бит. Диапазон допустимых кодовых точек теперь составляет от U+0000 до U+10FFFF и называется скалярным значением Unicode.

Набор символов от U+0000 до U+FFFF иногда называют основной многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char: первое значение принадлежит диапазону старших суррогатов (\uD800-\uDBFF), второе — диапазону младших суррогатов (\uDC00-\uDFFF).

Таким образом, значение char представляет кодовые точки основной многоязычной плоскости (BMP), включая суррогатные кодовые точки, или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Для представления кодовых точек Unicode используются младшие (наименее значащие) 21 бит значения int, а старшие (наиболее значащие) 11 бит должны быть равны нулю. Если не указано иное, поведение в отношении дополнительных символов и суррогатных значений char следующее:

  • Методы, принимающие только значение char, не поддерживают дополнительные символы. Они считают значения char из суррогатных диапазонов неопределёнными символами. Например, Character.isLetter('\uD840') возвращает false, хотя это конкретное значение, если за ним в строке следует любое значение младшего суррогата, представляет букву.
  • Методы, принимающие значение int, поддерживают все символы Unicode, включая дополнительные символы. Например, Character.isLetter(0x2F81A) возвращает true, поскольку значение кодовой точки представляет собой букву (иероглиф ККЯ).

В документации API Java SE термин кодовая точка Unicode используется для значений символов в диапазоне от U+0000 до U+10FFFF, а термин единица кода Unicode — для 16-битных значений char, являющихся единицами кода кодировки UTF-16. Дополнительные сведения о терминологии Unicode см. в глоссарии Unicode.

Это класс, основанный на значениях; программистам следует считать экземпляры, которые равны, взаимозаменяемыми и не использовать экземпляры для синхронизации, иначе возможно непредсказуемое поведение. Например, в одном из будущих выпусков синхронизация может завершиться неудачей.

Начиная с:
1.0
Внешние спецификации
  • База данных символов Unicode
См. также:
  • Сериализованная форма

Краткое описание вложенных классов

Модификатор и тип Класс Описание
static class  Character.Subset
Экземпляры этого класса представляют определённые подмножества набора символов Юникода.
static final class  Character.UnicodeBlock
Семейство подмножеств символов, представляющих блоки символов в спецификации Юникода.
static enum  Character.UnicodeScript
Семейство подмножеств символов, представляющих письменности, определённые в Техническом стандарте Юникода № 24: названия письменностей.

Краткое описание полей

Модификатор и тип Поле Описание
static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковом двоичном формате.
static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Юникода.
static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Юникода.
static final byte CONTROL
Общая категория "Cc" в спецификации Юникода.
static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Юникода.
static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Юникода.
static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Юникода.
static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый двунаправленный тип символа "AN" в спецификации Юникода.
static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый двунаправленный тип символа "BN" в спецификации Юникода.
static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый двунаправленный тип символа "CS" в спецификации Юникода.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый двунаправленный тип символа "EN" в спецификации Юникода.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый двунаправленный тип символа "ES" в спецификации Юникода.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый двунаправленный тип символа "ET" в спецификации Юникода.
static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый двунаправленный тип символа "FSI" в спецификации Юникода.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный двунаправленный тип символа "L" в спецификации Юникода.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный двунаправленный тип символа "LRE" в спецификации Юникода.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый двунаправленный тип символа "LRI" в спецификации Юникода.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный двунаправленный тип символа "LRO" в спецификации Юникода.
static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый двунаправленный тип символа "NSM" в спецификации Юникода.
static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный двунаправленный тип символа "ON" в спецификации Юникода.
static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный двунаправленный тип символа "B" в спецификации Юникода.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый двунаправленный тип символа "PDF" в спецификации Юникода.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый двунаправленный тип символа "PDI" в спецификации Юникода.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный двунаправленный тип символа "R" в спецификации Юникода.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный двунаправленный тип символа "AL" в спецификации Юникода.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный двунаправленный тип символа "RLE" в спецификации Юникода.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый двунаправленный тип символа "RLI" в спецификации Юникода.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный двунаправленный тип символа "RLO" в спецификации Юникода.
static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный двунаправленный тип символа "S" в спецификации Юникода.
static final byte DIRECTIONALITY_UNDEFINED
Неопределённый двунаправленный тип символа.
static final byte DIRECTIONALITY_WHITESPACE
Нейтральный двунаправленный тип символа "WS" в спецификации Юникода.
static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Юникода.
static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Юникода.
static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Юникода.
static final byte FORMAT
Общая категория "Cf" в спецификации Юникода.
static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Юникода.
static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Юникода.
static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Юникода.
static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Юникода.
static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Юникода.
static final int MAX_CODE_POINT
Максимальное значение кодовой точки Юникода, константа U+10FFFF.
static final char MAX_HIGH_SURROGATE
Максимальное значение кодовой единицы старшего суррогата Юникода в кодировке UTF-16, константа '\uDBFF'.
static final char MAX_LOW_SURROGATE
Максимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDFFF'.
static final int MAX_RADIX
Максимальное основание системы счисления, доступное для преобразования в строки и из строк.
static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uDFFF'.
static final char MAX_VALUE
Константное значение этого поля — наибольшее значение типа char, '\uFFFF'.
static final int MIN_CODE_POINT
Минимальное значение кодовой точки Юникода, константа U+0000.
static final char MIN_HIGH_SURROGATE
Минимальное значение кодовой единицы старшего суррогата Юникода в кодировке UTF-16, константа '\uD800'.
static final char MIN_LOW_SURROGATE
Минимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDC00'.
static final int MIN_RADIX
Минимальное основание системы счисления, доступное для преобразования в строки и из строк.
static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительной кодовой точки Юникода, константа U+10000.
static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uD800'.
static final char MIN_VALUE
Константное значение этого поля — наименьшее значение типа char, '\u0000'.
static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Юникода.
static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Юникода.
static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Юникода.
static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Юникода.
static final byte OTHER_NUMBER
Общая категория "No" в спецификации Юникода.
static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Юникода.
static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Юникода.
static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Юникода.
static final byte PRIVATE_USE
Общая категория "Co" в спецификации Юникода.
static final int SIZE
Количество битов, используемых для представления значения char в беззнаковом двоичном формате, константа 16.
static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Юникода.
static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Юникода.
static final byte SURROGATE
Общая категория "Cs" в спецификации Юникода.
static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Юникода.
static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
static final byte UNASSIGNED
Общая категория "Cn" в спецификации Юникода.
static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Юникода.

Краткое описание конструкторов

Конструктор Описание
Character(char value)
Устарел.
Использование этого конструктора редко бывает уместным.

Краткое описание методов

Модификатор и тип Метод Описание
static int charCount(int codePoint)
Определяет количество значений char, необходимое для представления указанного символа (кодовой точки Unicode).
char charValue()
Возвращает значение этого объекта Character.
static int codePointAt(char[] a, int index)
Возвращает кодовую точку по указанному индексу массива char.
static int codePointAt(char[] a, int index, int limit)
Возвращает кодовую точку по указанному индексу массива char, где можно использовать только элементы массива с index меньше limit.
static int codePointAt(CharSequence seq, int index)
Возвращает кодовую точку по указанному индексу CharSequence.
static int codePointBefore(char[] a, int index)
Возвращает кодовую точку перед указанным индексом массива char.
static int codePointBefore(char[] a, int index, int start)
Возвращает кодовую точку перед указанным индексом массива char, где можно использовать только элементы массива с index больше или равным start.
static int codePointBefore(CharSequence seq, int index)
Возвращает кодовую точку перед указанным индексом CharSequence.
static int codePointCount(char[] a, int offset, int count)
Возвращает количество кодовых точек Unicode в подмассиве аргумента-массива char.
static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество кодовых точек Unicode в текстовом диапазоне указанной последовательности символов.
static int codePointOf(String name)
Возвращает значение кодовой точки символа Unicode, заданного указанным именем символа.
static int compare(char x, char y)
Сравнивает два значения char численно.
int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра.
static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанной системе счисления.
static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кодовой точки Unicode) в указанной системе счисления.
boolean equals(Object obj)
Сравнивает этот объект с указанным объектом.
static char forDigit(int digit, int radix)
Определяет представление символа для указанной цифры в заданной системе счисления.
static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для указанного символа.
static byte getDirectionality(int codePoint)
Возвращает свойство направленности Unicode для указанного символа (кодовой точки Unicode).
static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если кодовая точка является unassigned.
static int getNumericValue(char ch)
Возвращает значение int, которое представляет указанный символ Unicode.
static int getNumericValue(int codePoint)
Возвращает значение int, которое представляет указанный символ (кодовая точка Unicode).
static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
int hashCode()
Возвращает хеш-код этого объекта Character; он равен результату вызова charValue().
static int hashCode(char value)
Возвращает хеш-код значения char; совместим с Character.hashCode().
static char highSurrogate(int codePoint)
Возвращает старший суррогат ( кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16.
static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) алфавитным.
static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в основной многоязычной плоскости (BMP).
static boolean isDefined(char ch)
Определяет, задан ли символ в Unicode.
static boolean isDefined(int codePoint)
Определяет, задан ли символ (кодовая точка Unicode) в Unicode.
static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой.
static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи.
static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом эмодзи.
static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором эмодзи.
static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом для модификатора эмодзи.
static boolean isEmojiPresentation(int codePoint)
Определяет, обладает ли указанный символ (кодовая точка Unicode) свойством отображения эмодзи по умолчанию.
static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом.
static boolean isHighSurrogate(char ch)
Определяет, является ли указанное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица начального суррогата).
static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или идентификаторе Unicode.
static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или идентификаторе Unicode.
static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайской, японской, корейской и вьетнамской), согласно определению стандарта Unicode.
static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO.
static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO.
static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, но не его первым символом.
static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (кодовая точка Unicode) быть частью идентификатора Java, но не его первым символом.
static boolean isJavaIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.
static boolean isJavaIdentifierStart(int codePoint)
Определяет, допустим ли символ (кодовая точка Unicode) в качестве первого символа идентификатора Java.
static boolean isJavaLetter(char ch)
Устарело.
Заменено на isJavaIdentifierStart(char).
static boolean isJavaLetterOrDigit(char ch)
Устарело.
Заменено на isJavaIdentifierPart(char).
static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой.
static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой.
static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчным.
static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) строчным.
static boolean isLowSurrogate(char ch)
Определяет, является ли указанное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица конечного суррогата).
static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным согласно спецификации Unicode.
static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode.
static boolean isSpace(char ch)
Устарело.
Заменено на isWhitespace(char).
static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ пробельным символом Unicode.
static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом Unicode.
static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов.
static boolean isSurrogate(char ch)
Определяет, является ли указанное значение char суррогатной кодовой единицей Unicode.
static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char допустимой суррогатной парой Unicode.
static boolean isTitleCase(char ch)
Определяет, является ли указанный символ заглавным.
static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) заглавным.
static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Unicode, но не его первым символом.
static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовая точка Unicode) входить в идентификатор Unicode не в качестве первого символа.
static boolean isUnicodeIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode.
static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode.
static boolean isUpperCase(char ch)
Определяет, является ли указанный символ заглавной буквой.
static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) заглавной буквой.
static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode.
static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробельным символом согласно Java.
static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java.
static char lowSurrogate(int codePoint)
Возвращает замыкающий суррогат (кодовую единицу младшего суррогата) из суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16.
static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в указанном подмассиве char, смещённый относительно заданного index на codePointOffset кодовых точек.
static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в указанной последовательности символов, смещённый относительно заданного index на codePointOffset кодовых точек.
static char reverseBytes(char ch)
Возвращает значение, полученное обращением порядка байтов в указанном значении char.
static char[] toChars(int codePoint)
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16, сохранённое в массиве char.
static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16.
static int toCodePoint(char high, char low)
Преобразует указанную суррогатную пару в значение дополнительной кодовой точки.
static char toLowerCase(char ch)
Преобразует символ-аргумент в нижний регистр, используя сведения о регистре из файла UnicodeData.
static int toLowerCase(int codePoint)
Преобразует символ (кодовую точку Unicode)-аргумент в нижний регистр, используя сведения о регистре из файла UnicodeData.
String toString()
Возвращает объект String, представляющий значение этого Character.
static String toString(char c)
Возвращает объект String, представляющий указанный char.
static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode).
static char toTitleCase(char ch)
Преобразует символ-аргумент в заглавную форму, используя сведения о регистре из файла UnicodeData.
static int toTitleCase(int codePoint)
Преобразует символ (кодовую точку Unicode)-аргумент в заглавную форму, используя сведения о регистре из файла UnicodeData.
static char toUpperCase(char ch)
Преобразует символ-аргумент в верхний регистр, используя сведения о регистре из файла UnicodeData.
static int toUpperCase(int codePoint)
Преобразует символ (кодовую точку Unicode)-аргумент в верхний регистр, используя сведения о регистре из файла UnicodeData.
static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char.

Методы, объявленные в классе Object

clone, finalize, getClass, notify, notifyAll, wait, wait, wait
Модификатор и тип Метод Описание
protected Object clone()
Создаёт и возвращает копию этого объекта.
protected void finalize()
Устарело, планируется удаление: этот элемент API подлежит удалению в будущей версии.
Финализация объявлена устаревшей и подлежит удалению в одном из следующих выпусков.
final Class<?> getClass()
Возвращает класс времени выполнения этого Object.
final void notify()
Пробуждает одну нить, ожидающую на мониторе этого объекта.
final void notifyAll()
Пробуждает все нити, ожидающие на мониторе этого объекта.
final void wait()
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания.
final void wait(long timeoutMillis)
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания, либо до истечения заданного промежутка реального времени.
final void wait(long timeoutMillis, int nanos)
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания, либо до истечения заданного промежутка реального времени.

Подробное описание полей

MIN_RADIX

public static final int MIN_RADIX
Минимальное основание системы счисления, доступное для преобразования строк в числа и обратно. Постоянное значение этого поля является наименьшим значением, допустимым для аргумента основания в методах преобразования систем счисления, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MAX_RADIX

public static final int MAX_RADIX
Максимальное основание системы счисления, доступное для преобразования строк в числа и обратно. Постоянное значение этого поля является наибольшим значением, допустимым для аргумента основания в методах преобразования систем счисления, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MIN_VALUE

public static final char MIN_VALUE
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'.
Начиная с версии:
1.0.2
См. также:
  • Значения константных полей

MAX_VALUE

public static final char MAX_VALUE
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'.
Начиная с версии:
1.0.2
См. также:
  • Значения константных полей

TYPE

public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
Начиная с версии:
1.1

UNASSIGNED

public static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

UPPERCASE_LETTER

public static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

LOWERCASE_LETTER

public static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

TITLECASE_LETTER

public static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

MODIFIER_LETTER

public static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

OTHER_LETTER

public static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

NON_SPACING_MARK

public static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

ENCLOSING_MARK

public static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

COMBINING_SPACING_MARK

public static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

DECIMAL_DIGIT_NUMBER

public static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

LETTER_NUMBER

public static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

OTHER_NUMBER

public static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

SPACE_SEPARATOR

public static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

LINE_SEPARATOR

public static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

PARAGRAPH_SEPARATOR

public static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

CONTROL

public static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

FORMAT

public static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

PRIVATE_USE

public static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

SURROGATE

public static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

DASH_PUNCTUATION

public static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

START_PUNCTUATION

public static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

END_PUNCTUATION

public static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

CONNECTOR_PUNCTUATION

public static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

OTHER_PUNCTUATION

public static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

MATH_SYMBOL

public static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
Начиная с версии:
1.1
См. также:
  • Значения константных полей

CURRENCY_SYMBOL

public static final byte CURRENCY_SYMBOL
Общая категория «Sc» в спецификации Unicode.
Начиная с:
1.1
См. также:
  • Значения константных полей

MODIFIER_SYMBOL

public static final byte MODIFIER_SYMBOL
Общая категория «Sk» в спецификации Unicode.
Начиная с:
1.1
См. также:
  • Значения константных полей

OTHER_SYMBOL

public static final byte OTHER_SYMBOL
Общая категория «So» в спецификации Unicode.
Начиная с:
1.1
См. также:
  • Значения константных полей

INITIAL_QUOTE_PUNCTUATION

public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория «Pi» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

FINAL_QUOTE_PUNCTUATION

public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория «Pf» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_UNDEFINED

public static final byte DIRECTIONALITY_UNDEFINED
Неопределённый тип символа двунаправленного текста. Для неопределённых значений char в спецификации Unicode направление не определено.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип символа двунаправленного текста «L» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип символа двунаправленного текста «R» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип символа двунаправленного текста «AL» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип символа двунаправленного текста «EN» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип символа двунаправленного текста «ES» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип символа двунаправленного текста «ET» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_ARABIC_NUMBER

public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип символа двунаправленного текста «AN» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_COMMON_NUMBER_SEPARATOR

public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип символа двунаправленного текста «CS» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_NONSPACING_MARK

public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип символа двунаправленного текста «NSM» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_BOUNDARY_NEUTRAL

public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип символа двунаправленного текста «BN» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_PARAGRAPH_SEPARATOR

public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип символа двунаправленного текста «B» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_SEGMENT_SEPARATOR

public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип символа двунаправленного текста «S» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_WHITESPACE

public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип символа двунаправленного текста «WS» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_OTHER_NEUTRALS

public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип символа двунаправленного текста «ON» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип символа двунаправленного текста «LRE» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип символа двунаправленного текста «LRO» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип символа двунаправленного текста «RLE» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип символа двунаправленного текста «RLO» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_FORMAT

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип символа двунаправленного текста «PDF» в спецификации Unicode.
Начиная с:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый тип символа двунаправленного текста «LRI» в спецификации Unicode.
Начиная с:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый тип символа двунаправленного текста «RLI» в спецификации Unicode.
Начиная с:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_FIRST_STRONG_ISOLATE

public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый тип символа двунаправленного текста «FSI» в спецификации Unicode.
Начиная с:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый двунаправленный тип символа «PDI» в спецификации Unicode.
Начиная с:
9
См. также:
  • Значения констант полей

MIN_HIGH_SURROGATE

public static final char MIN_HIGH_SURROGATE
Минимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uD800'. Старший суррогат также известен как начальный суррогат.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_HIGH_SURROGATE

public static final char MAX_HIGH_SURROGATE
Максимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uDBFF'. Старший суррогат также известен как начальный суррогат.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_LOW_SURROGATE

public static final char MIN_LOW_SURROGATE
Минимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDC00'. Младший суррогат также известен как конечный суррогат.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_LOW_SURROGATE

public static final char MAX_LOW_SURROGATE
Максимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDFFF'. Младший суррогат также известен как конечный суррогат.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_SURROGATE

public static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uD800'.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_SURROGATE

public static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uDFFF'.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_SUPPLEMENTARY_CODE_POINT

public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000.
Начиная с:
1.5
См. также:
  • Значения констант полей

MIN_CODE_POINT

public static final int MIN_CODE_POINT
Минимальное значение кодовой точки Unicode, константа U+0000.
Начиная с:
1.5
См. также:
  • Значения констант полей

MAX_CODE_POINT

public static final int MAX_CODE_POINT
Максимальное значение кодовой точки Unicode, константа U+10FFFF.
Начиная с:
1.5
См. также:
  • Значения констант полей

SIZE

public static final int SIZE
Количество битов, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
Начиная с:
1.5
См. также:
  • Значения констант полей

BYTES

public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме.
Начиная с:
1.8
См. также:
  • Значения констант полей

Подробное описание конструкторов

Character

@Deprecated(since="9") public Character(char value)
Устарело.
Использование этого конструктора редко бывает уместным. Обычно предпочтительнее использовать статическую фабрику valueOf(char), поскольку она, вероятно, обеспечит значительно более высокую эффективность использования памяти и быстродействие.
Создает новый объект Character, представляющий указанное значение char.
Параметры:
value — значение, которое будет представлено объектом Character.

Подробное описание методов

describeConstable

public Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра.
Указан в:
describeConstable в интерфейсе Constable
Возвращает:
Optional, описывающий экземпляр Character
Начиная с:
15

valueOf

public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char. Если создание нового экземпляра Character не требуется, обычно следует предпочесть этот метод конструктору Character(char), поскольку благодаря кэшированию часто запрашиваемых значений этот метод, вероятно, обеспечит значительно более высокую эффективность использования памяти и быстродействие. Этот метод всегда кэширует значения в диапазоне от '\u0000' до '\u007F' включительно и может кэшировать другие значения за пределами этого диапазона.
Параметры:
c — значение типа char.
Возвращает:
экземпляр Character, представляющий c.
Начиная с:
1.5

charValue

public char charValue()
Возвращает значение этого объекта Character.
Возвращает:
примитивное значение char, представленное этим объектом.

hashCode

public int hashCode()
Возвращает хеш-код этого Character; он равен результату вызова charValue().
Переопределяет:
hashCode в классе Object
Возвращает:
значение хеш-кода для этого Character
См. также:
  • Object.equals(java.lang.Object)
  • System.identityHashCode(Object)

hashCode

public static int hashCode(char value)
Возвращает хеш-код значения char; совместим с Character.hashCode().
Параметры:
value — char, для которого нужно вернуть хеш-код.
Возвращает:
значение хеш-кода для значения char.
Начиная с:
1.8

equals

public boolean equals(Object obj)
Сравнивает этот объект с указанным объектом. Результат равен true тогда и только тогда, когда аргумент не равен null и является объектом Character, представляющим то же значение char, что и этот объект.
Переопределяет:
equals в классе Object
Параметры:
obj — объект для сравнения.
Возвращает:
true, если объекты совпадают; в противном случае — false.
См. также:
  • Object.hashCode()
  • HashMap

toString

public String toString()
Возвращает объект String, представляющий значение этого Character. Результат — строка длиной 1, единственным элементом которой является примитивное значение char, представленное этим объектом Character.
Переопределяет:
toString в классе Object
Возвращает:
строковое представление этого объекта.

toString

public static String toString(char c)
Возвращает объект String, представляющий указанный char. Результат — строка длиной 1, состоящая только из указанного char.
Примечание к API:
Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toString(int).
Параметры:
c — char для преобразования
Возвращает:
строковое представление указанного char
Начиная с:
1.4

toString

public static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode). Результат — строка длиной 1 или 2, состоящая только из указанного codePoint.
Параметры:
codePoint — codePoint для преобразования
Возвращает:
строковое представление указанного codePoint
Выбрасывает:
IllegalArgumentException — если указанный codePoint не является допустимой кодовой точкой Unicode.
Начиная с:
11

isValidCodePoint

public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode.
Параметры:
codePoint — проверяемая кодовая точка Unicode
Возвращает:
true, если значение указанной кодовой точки находится в диапазоне от MIN_CODE_POINT до MAX_CODE_POINT включительно; в противном случае — false.
Начиная с:
1.5

isBmpCodePoint

public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в базовой многоязычной плоскости (BMP). Такие кодовые точки можно представить с помощью одной char.
Параметры:
codePoint — символ (кодовая точка Unicode), который требуется проверить
Возвращает:
true, если указанная кодовая точка находится в диапазоне от MIN_VALUE до MAX_VALUE включительно; в противном случае — false.
С версии:
1.7

isSupplementaryCodePoint

public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов.
Параметры:
codePoint — символ (кодовая точка Unicode), который требуется проверить
Возвращает:
true, если указанная кодовая точка находится в диапазоне от MIN_SUPPLEMENTARY_CODE_POINT до MAX_CODE_POINT включительно; в противном случае — false.
С версии:
1.5

isHighSurrogate

public static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица начального суррогата).

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch — значение char, которое требуется проверить.
Возвращает:
true, если значение char находится в диапазоне от MIN_HIGH_SURROGATE до MAX_HIGH_SURROGATE включительно; в противном случае — false.
С версии:
1.5
См. также:
  • isLowSurrogate(char)
  • Character.UnicodeBlock.of(int)

isLowSurrogate

public static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица конечного суррогата).

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Параметры:
ch — значение char, которое требуется проверить.
Возвращает:
true, если значение char находится в диапазоне от MIN_LOW_SURROGATE до MAX_LOW_SURROGATE включительно; в противном случае — false.
С версии:
1.5
См. также:
  • isHighSurrogate(char)

isSurrogate

public static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей суррогата Unicode.

Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.

Значение char является кодовой единицей суррогата тогда и только тогда, когда оно является кодовой единицей младшего суррогата или кодовой единицей старшего суррогата.

Параметры:
ch — значение char, которое требуется проверить.
Возвращает:
true, если значение char находится в диапазоне от MIN_SURROGATE до MAX_SURROGATE включительно; в противном случае — false.
С версии:
1.7

isSurrogatePair

public static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char допустимой парой суррогатов Unicode.

Этот метод эквивалентен выражению:

isHighSurrogate(high) && isLowSurrogate(low)
Параметры:
high — проверяемое значение кода старшего суррогата
low — проверяемое значение кода младшего суррогата
Возвращает:
true, если указанные значения кодов старшего и младшего суррогатов образуют допустимую пару суррогатов; в противном случае — false.
С версии:
1.5

charCount

public static int charCount(int codePoint)
Определяет количество значений char, необходимых для представления указанного символа (кодовой точки Unicode). Если значение указанного символа равно 0x10000 или больше, метод возвращает 2. В противном случае метод возвращает 1.

Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. При необходимости вызывающий код должен проверить значение символа с помощью isValidCodePoint.

Параметры:
codePoint — символ (кодовая точка Unicode), который требуется проверить.
Возвращает:
2, если символ является допустимым дополнительным символом; в противном случае — 1.
С версии:
1.5
См. также:
  • isSupplementaryCodePoint(int)

toCodePoint

public static int toCodePoint(char high, char low)
Преобразует указанную пару суррогатов в значение соответствующей дополнительной кодовой точки. Этот метод не проверяет указанную пару суррогатов. При необходимости вызывающий код должен проверить её с помощью isSurrogatePair.
Параметры:
high — кодовая единица старшего суррогата
low — кодовая единица младшего суррогата
Возвращает:
дополнительную кодовую точку, составленную из указанной пары суррогатов.
С версии:
1.5

codePointAt

public static int codePointAt(CharSequence seq, int index)
Возвращает кодовую точку по указанному индексу в CharSequence. Если значение char по указанному индексу в CharSequence входит в диапазон старших суррогатов, следующий индекс меньше длины CharSequence, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
seq — последовательность значений char (кодовых единиц Unicode)
index — индекс значений char (кодовых единиц Unicode) в seq, которые требуется преобразовать
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если значение index отрицательно или не меньше seq.length().
С версии:
1.5

codePointAt

public static int codePointAt(char[] a, int index)
Возвращает кодовую точку по указанному индексу в массиве char. Если значение char по указанному индексу в массиве char входит в диапазон старших суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
a — массив char
index — индекс значений char (кодовых единиц Unicode) в массиве char, которые требуется преобразовать
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если значение index отрицательно или не меньше длины массива char.
С версии:
1.5

codePointAt

public static int codePointAt(char[] a, int index, int limit)
Возвращает кодовую точку по указанному индексу в массиве char; при этом могут использоваться только элементы массива с индексом index меньше limit. Если значение char по указанному индексу в массиве char входит в диапазон старших суррогатов, следующий индекс меньше limit, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.
Параметры:
a — массив char
index — индекс значений char (кодовых единиц Unicode) в массиве char, которые требуется преобразовать
limit — индекс после последнего элемента массива, который можно использовать в массиве char
Возвращает:
кодовую точку Unicode по указанному индексу
Выбрасывает:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если аргумент index отрицателен или не меньше аргумента limit, либо если аргумент limit отрицателен или больше длины массива char.
С версии:
1.5

codePointBefore

public static int codePointBefore(CharSequence seq, int index)
Возвращает кодовую точку, предшествующую указанному индексу в CharSequence. Если значение char по индексу (index - 1) в CharSequence входит в диапазон младших суррогатов, (index - 2) не является отрицательным, а значение char по индексу (index - 2) в CharSequence входит в диапазон старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
seq — экземпляр CharSequence
index — индекс, следующий за кодовой точкой, которую требуется вернуть
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Выбрасывает:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если аргумент index меньше 1 или больше seq.length().
С версии:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index)
Возвращает кодовую точку, предшествующую указанному индексу в массиве char. Если значение char по индексу (index - 1) в массиве char входит в диапазон младших суррогатов, (index - 2) не является отрицательным, а значение char по индексу (index - 2) в массиве char входит в диапазон старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
a — массив char
index — индекс, следующий за кодовой точкой, которую требуется вернуть
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Выбрасывает:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если аргумент index меньше 1 или больше длины массива char
С версии:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index, int start)
Возвращает кодовую точку, предшествующую указанному индексу массива char, в котором можно использовать только элементы массива с index, большим или равным start. Если значение char в позиции (index - 1) массива char находится в диапазоне младших суррогатов, (index - 2) не меньше start, а значение char в позиции (index - 2) массива char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой суррогатной паре. В противном случае возвращается значение char в позиции (index - 1).
Параметры:
a — массив char
index — индекс, следующий за кодовой точкой, которую следует вернуть
start — индекс первого элемента массива в массиве char
Возвращает:
значение кодовой точки Unicode перед указанным индексом.
Вызывает исключение:
NullPointerException — если a равен null.
IndexOutOfBoundsException — если аргумент index не больше аргумента start или больше длины массива char, либо если аргумент start отрицателен или не меньше длины массива char.
Начиная с версии:
1.5

highSurrogate

public static char highSurrogate(int codePoint)
Возвращает начальный суррогат ( кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение char.

Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint — дополнительный символ (кодовая точка Unicode)
Возвращает:
начальную кодовую единицу суррогата, используемую для представления символа в кодировке UTF-16
Начиная с версии:
1.7

lowSurrogate

public static char lowSurrogate(int codePoint)
Возвращает конечный суррогат ( кодовую единицу младшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение char.

Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.

Параметры:
codePoint — дополнительный символ (кодовая точка Unicode)
Возвращает:
конечную кодовую единицу суррогата, используемую для представления символа в кодировке UTF-16
Начиная с версии:
1.7

toChars

public static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16. Если указанная кодовая точка является значением BMP (Basic Multilingual Plane, или плоскость 0), то это же значение сохраняется в dst[dstIndex], и возвращается 1. Если указанная кодовая точка является дополнительным символом, его суррогатные значения сохраняются в dst[dstIndex] (старший суррогат) и dst[dstIndex+1] (младший суррогат), и возвращается 2.
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно преобразовать.
dst — массив char, в котором сохраняется значение UTF-16 для codePoint.
dstIndex — начальный индекс в массиве dst, по которому сохраняется преобразованное значение.
Возвращает:
1, если кодовая точка является кодовой точкой BMP, и 2, если кодовая точка является дополнительной кодовой точкой.
Вызывает исключение:
IllegalArgumentException — если указанное значение codePoint не является допустимой кодовой точкой Unicode.
NullPointerException — если указанное значение dst равно null.
IndexOutOfBoundsException — если dstIndex отрицателен или не меньше dst.length, либо если в массиве dst начиная с позиции dstIndex недостаточно элементов для хранения результирующего значения char. (Если dstIndex равен dst.length-1, а указанное значение codePoint является дополнительным символом, значение старшего суррогата не сохраняется в dst[dstIndex].)
Начиная с версии:
1.5

toChars

public static char[] toChars(int codePoint)
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16, сохранённое в массиве char. Если указанная кодовая точка является значением BMP (Basic Multilingual Plane, или плоскость 0), результирующий массив char содержит то же значение, что и codePoint. Если указанная кодовая точка является дополнительной кодовой точкой, результирующий массив char содержит соответствующую суррогатную пару.
Параметры:
codePoint — кодовая точка Unicode
Возвращает:
массив char, содержащий представление UTF-16 значения codePoint.
Вызывает исключение:
IllegalArgumentException — если указанное значение codePoint не является допустимой кодовой точкой Unicode.
Начиная с версии:
1.5

codePointCount

public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество кодовых точек Unicode в диапазоне текста указанной символьной последовательности. Диапазон текста начинается с указанного beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина диапазона текста (в charах) равна endIndex-beginIndex. Несоставленные суррогаты в диапазоне текста считаются отдельными кодовыми точками.
Параметры:
seq — символьная последовательность
beginIndex — индекс первого char диапазона текста.
endIndex — индекс после последнего char диапазона текста.
Возвращает:
количество кодовых точек Unicode в указанном диапазоне текста
Вызывает исключение:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если beginIndex отрицателен, или endIndex больше длины указанной последовательности, или beginIndex больше endIndex.
Начиная с версии:
1.5

codePointCount

public static int codePointCount(char[] a, int offset, int count)
Возвращает количество кодовых точек Unicode в подмассиве, заданном аргументом-массивом char. Аргумент offset задаёт индекс первого char подмассива, а аргумент count — длину подмассива в charах. Несоставленные суррогаты в подмассиве считаются отдельными кодовыми точками.
Параметры:
a — массив char
offset — индекс первого char в указанном массиве char
count — длина подмассива в charах
Возвращает:
количество кодовых точек Unicode в указанном подмассиве
Вызывает исключение:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если offset или count отрицателен либо если offset + count больше длины указанного массива.
Начиная с версии:
1.5

offsetByCodePoints

public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в указанной символьной последовательности, смещённый относительно заданного index на codePointOffset кодовых точек. Несоставленные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.
Параметры:
seq — символьная последовательность
index — индекс, относительно которого вычисляется смещение
codePointOffset — смещение в кодовых точках
Возвращает:
индекс в символьной последовательности
Вызывает исключение:
NullPointerException — если seq равно null.
IndexOutOfBoundsException — если index отрицателен или больше длины символьной последовательности, либо если codePointOffset положителен и подстрока, начинающаяся с index, содержит меньше codePointOffset кодовых точек, либо если codePointOffset отрицателен и подпоследовательность перед index содержит меньше кодовых точек, чем абсолютное значение codePointOffset.
Начиная с версии:
1.5

offsetByCodePoints

public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в указанном подмассиве char, смещённый относительно заданного index на codePointOffset кодовых точек. Аргументы start и count задают подмассив массива char. Несоставленные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.
Параметры:
a — массив char
start — индекс первого char подмассива
count — длина подмассива в charах
index — индекс, относительно которого вычисляется смещение
codePointOffset — смещение в кодовых точках
Возвращает:
индекс в подмассиве
Вызывает исключение:
NullPointerException — если a равно null.
IndexOutOfBoundsException — если start или count отрицателен, либо если start + count больше длины указанного массива, либо если index меньше start или больше start + count, либо если codePointOffset положителен и диапазон текста, начинающийся с index и заканчивающийся start + count - 1, содержит меньше codePointOffset кодовых точек, либо если codePointOffset отрицателен и диапазон текста, начинающийся с start и заканчивающийся index - 1, содержит меньше кодовых точек, чем абсолютное значение codePointOffset.
Начиная с версии:
1.5

isLowerCase

public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчным.

Символ является строчным, если его тип общей категории, определяемый с помощью Character.getType(ch), равен LOWERCASE_LETTER или если он обладает свойством Other_Lowercase, определённым стандартом Unicode.

Примеры строчных символов:

a b c d e f g h i j k l m n o p q r s t u v w x y z
'\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
'\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
'\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
'\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'

Многие другие символы Unicode также являются строчными.

Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является строчным; в противном случае — false.
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toLowerCase(char)
  • getType(char)

isLowerCase

public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) строчным символом.

Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), — LOWERCASE_LETTER или он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.

Примеры строчных символов:

a b c d e f g h i j k l m n o p q r s t u v w x y z
'\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
'\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
'\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
'\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'

Многие другие символы Unicode также являются строчными.

Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ является строчным; в противном случае — false.
Начиная с:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toLowerCase(int)
  • getType(int)

isUpperCase

public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ прописным.

Символ является прописным, если его тип общей категории, предоставляемый Character.getType(ch), — UPPERCASE_LETTER, или он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.

Примеры прописных символов:

A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
'\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
'\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
'\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
'\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'

Многие другие символы Unicode также являются прописными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isUpperCase(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является прописным; в противном случае — false.
Начиная с:
1.0
См. также:
  • isLowerCase(char)
  • isTitleCase(char)
  • toUpperCase(char)
  • getType(char)

isUpperCase

public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) прописным.

Символ является прописным, если его тип общей категории, предоставляемый getType(codePoint), — UPPERCASE_LETTER или он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.

Примеры прописных символов:

A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
'\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
'\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
'\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
'\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'

Многие другие символы Unicode также являются прописными.

Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ является прописным; в противном случае — false.
Начиная с:
1.5
См. также:
  • isLowerCase(int)
  • isTitleCase(int)
  • toUpperCase(int)
  • getType(int)

isTitleCase

public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом титульного регистра.

Символ относится к титульному регистру, если его тип общей категории, предоставляемый Character.getType(ch), — TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», и соответствующая ей строчная буква, похожая на «lj». Третья форма, похожая на «Lj», — подходящая форма для отображения слова в нижнем регистре с заглавной первой буквой, например в названии книги.

Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также относятся к титульному регистру.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isTitleCase(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ относится к титульному регистру; в противном случае — false.
Начиная с:
1.0.2
См. также:
  • isLowerCase(char)
  • isUpperCase(char)
  • toTitleCase(char)
  • getType(char)

isTitleCase

public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) символом титульного регистра.

Символ относится к титульному регистру, если его тип общей категории, предоставляемый getType(codePoint), — TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», и соответствующая ей строчная буква, похожая на «lj». Третья форма, похожая на «Lj», — подходящая форма для отображения слова в нижнем регистре с заглавной первой буквой, например в названии книги.

Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также относятся к титульному регистру.

Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ относится к титульному регистру; в противном случае — false.
Начиная с:
1.5
См. также:
  • isLowerCase(int)
  • isUpperCase(int)
  • toTitleCase(int)
  • getType(int)

isDigit

public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.

Символ является цифрой, если его тип общей категории, предоставляемый Character.getType(ch), — DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030' — '\u0039', цифры ISO-LATIN-1 ('0' — '9')
  • '\u0660' — '\u0669', арабско-индийские цифры
  • '\u06F0' — '\u06F9', расширенные арабско-индийские цифры
  • '\u0966' — '\u096F', цифры деванагари
  • '\uFF10' — '\uFF19', полноширинные цифры
Цифры также содержатся во многих других диапазонах символов.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDigit(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является цифрой; в противном случае — false.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • getType(char)

isDigit

public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой.

Символ является цифрой, если его тип общей категории, предоставляемый getType(codePoint), — DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Unicode, содержащие цифры:

  • '\u0030' — '\u0039', цифры ISO-LATIN-1 ('0' — '9')
  • '\u0660' — '\u0669', арабско-индийские цифры
  • '\u06F0' — '\u06F9', расширенные арабско-индийские цифры
  • '\u0966' — '\u096F', цифры деванагари
  • '\uFF10' — '\uFF19', полноширинные цифры
Цифры также содержатся во многих других диапазонах символов.
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ является цифрой; в противном случае — false.
Начиная с:
1.5
См. также:
  • forDigit(int, int)
  • getType(int)

isDefined

public static boolean isDefined(char ch)
Определяет, определён ли символ в Unicode.

Символ считается определённым, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Для него задано значение в диапазоне, определённом файлом UnicodeData.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDefined(int).

Параметры:
ch — символ, который нужно проверить
Возвращает:
true, если символ имеет определённое значение в Unicode; в противном случае — false.
Начиная с:
1.0.2
См. также:
  • isDigit(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUpperCase(char)

isDefined

public static boolean isDefined(int codePoint)
Определяет, определён ли символ (кодовая точка Unicode) в Unicode.

Символ считается определённым, если выполняется хотя бы одно из следующих условий:

  • Он имеет запись в файле UnicodeData.
  • Для него задано значение в диапазоне, определённом файлом UnicodeData.
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ имеет определённое значение в Unicode; в противном случае — false.
Начиная с:
1.5
См. также:
  • isDigit(int)
  • isLetter(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUpperCase(int)

isLetter

public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.

Символ считается буквой, если его тип общей категории, предоставляемый Character.getType(ch), относится к одному из следующих типов:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не у всех букв есть регистр. Многие символы являются буквами, но не относятся ни к прописным, ни к строчным, ни к символам титульного регистра.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isLetter(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является буквой; в противном случае — false.
См. также:
  • isDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUnicodeIdentifierStart(char)
  • isUpperCase(char)

isLetter

public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовой точкой Unicode) буквой.

Символ считается буквой, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не относятся ни к прописным, ни к строчным буквам, ни к буквам в заглавном регистре.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является буквой; false в противном случае.
Начиная с версии:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUnicodeIdentifierStart(int)
  • isUpperCase(int)

isLetterOrDigit

public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.

Символ считается буквой или цифрой, если для него метод Character.isLetter(char ch) или Character.isDigit(char ch) возвращает true.

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isLetterOrDigit(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является буквой или цифрой; false в противном случае.
Начиная с версии:
1.0.2
См. также:
  • isDigit(char)
  • isJavaIdentifierPart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isLetterOrDigit

public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой.

Символ считается буквой или цифрой, если для него метод isLetter(codePoint) или isDigit(codePoint) возвращает true.

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является буквой или цифрой; false в противном случае.
Начиная с версии:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isJavaLetter

@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Устарел.
Заменён методом isJavaIdentifierStart(char).
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:

  • метод isLetter(ch) возвращает true
  • метод getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является соединительным знаком пунктуации (например, '_').
Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Java; false в противном случае.
Начиная с версии:
1.0.2
См. также:
  • isJavaLetterOrDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isJavaLetterOrDigit

@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Устарел.
Заменён методом isJavaIdentifierPart(char).
Определяет, может ли указанный символ входить в идентификатор Java не в качестве первого символа.

Символ может входить в идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:

  • он является буквой
  • он является символом валюты (например, '$')
  • он является соединительным знаком пунктуации (например, '_')
  • он является цифрой
  • он является числовой буквой (например, символом римской цифры)
  • он является комбинирующим знаком
  • он является невидимым диакритическим знаком
  • метод isIdentifierIgnorable возвращает true для этого символа.
Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может входить в идентификатор Java; false в противном случае.
Начиная с версии:
1.0.2
См. также:
  • isJavaLetter(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • isIdentifierIgnorable(char)

isAlphabetic

public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) алфавитным.

Символ считается алфавитным, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
  • LETTER_NUMBER
либо имеет дополнительное свойство Other_Alphabetic, определённое стандартом Unicode.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является буквой Unicode, и false в противном случае.
Начиная с версии:
1.7

isIdeographic

public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайской, японской, корейской или вьетнамской), определённой стандартом Unicode.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является идеограммой Unicode, и false в противном случае.
Начиная с версии:
1.7

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:

  • метод isLetter(ch) возвращает true
  • метод getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является соединительным знаком пунктуации (например, '_').

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isJavaIdentifierStart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может начинать идентификатор Java; false в противном случае.
Начиная с версии:
1.1
См. также:
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isUnicodeIdentifierStart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(int codePoint)
Определяет, допустим ли символ (кодовая точка Unicode) в качестве первого символа идентификатора Java.

Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:

  • метод isLetter(codePoint) возвращает true
  • метод getType(codePoint) возвращает LETTER_NUMBER
  • указанный символ является символом валюты (например, '$')
  • указанный символ является соединительным знаком пунктуации (например, '_').
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может начинать идентификатор Java; false в противном случае.
Начиная с версии:
1.5
См. также:
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierStart(int)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ входить в идентификатор Java не в качестве первого символа.

Символ может входить в идентификатор Java, если выполняется хотя бы одно из следующих условий:

  • он является буквой
  • он является символом валюты (например, '$')
  • он является соединительным знаком пунктуации (например, '_')
  • он является цифрой
  • он является числовой буквой (например, символом римской цифры)
  • он является комбинирующим знаком
  • он является невидимым диакритическим знаком
  • метод isIdentifierIgnorable возвращает true для этого символа

Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isJavaIdentifierPart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может входить в идентификатор Java; false в противном случае.
Начиная с версии:
1.1
См. также:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierStart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (кодовая точка Unicode) быть частью идентификатора Java, кроме первого символа.

Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это буквенный символ числа (например, римская цифра)
  • это комбинируемый знак
  • это неинтервальный знак
  • isIdentifierIgnorable(codePoint) возвращает true для этой кодовой точки
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может быть частью идентификатора Java; в противном случае — false.
С версии:
1.5
См. также:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierPart(int)
  • SourceVersion.isIdentifier(CharSequence)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode.

Символ может быть первым символом идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:

Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обратной совместимости.

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может быть первым символом идентификатора Unicode; в противном случае — false.
С версии:
1.1
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isJavaIdentifierStart(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode.

Символ может быть первым символом идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:

Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обратной совместимости.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может быть первым символом идентификатора Unicode; в противном случае — false.
С версии:
1.5
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isJavaIdentifierStart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Unicode, кроме первого символа.

Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:

  • это буква
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это буквенный символ числа (например, римская цифра)
  • это комбинируемый знак
  • это неинтервальный знак
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:

Continue := Start + ID_Continue + ignorable
Medial := empty
ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавляется к Continue для обратной совместимости.

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ может быть частью идентификатора Unicode; в противном случае — false.
С версии:
1.1
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierPart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовая точка Unicode) быть частью идентификатора Unicode, кроме первого символа.

Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:

  • это буква
  • это соединительный знак пунктуации (например, '_')
  • это цифра
  • это буквенный символ числа (например, римская цифра)
  • это комбинируемый знак
  • это неинтервальный знак
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:

Continue := Start + ID_Continue + ignorable
Medial := empty
ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавляется к Continue для обратной совместимости.
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ может быть частью идентификатора Unicode; в противном случае — false.
С версии:
1.5
Внешние спецификации
  • База данных символов Unicode
  • Синтаксис идентификаторов и шаблонов Unicode
См. также:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierPart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierStart(int)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или Unicode.

Следующие символы Unicode являются игнорируемыми в идентификаторе Java или Unicode:

  • управляющие символы ISO, не являющиеся пробельными символами
    • от '\u0000' до '\u0008'
    • от '\u000E' до '\u001B'
    • от '\u007F' до '\u009F'
  • все символы, имеющие значение общей категории FORMAT

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).

Параметры:
ch — проверяемый символ.
Возвращает:
true, если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode; в противном случае — false.
С версии:
1.1
См. также:
  • isJavaIdentifierPart(char)
  • isUnicodeIdentifierPart(char)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или Unicode.

Следующие символы Unicode являются игнорируемыми в идентификаторе Java или Unicode:

  • управляющие символы ISO, не являющиеся пробельными символами
    • от '\u0000' до '\u0008'
    • от '\u000E' до '\u001B'
    • от '\u007F' до '\u009F'
  • все символы, имеющие значение общей категории FORMAT
Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode; в противном случае — false.
С версии:
1.5
См. также:
  • isJavaIdentifierPart(int)
  • isUnicodeIdentifierPart(int)

isEmoji

public static boolean isEmoji(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи.

Символ считается эмодзи тогда и только тогда, когда ему присвоено свойство Emoji, определенное в документе Unicode Emoji (Технический стандарт № 51).

Параметры:
codePoint — проверяемый символ (кодовая точка Unicode).
Возвращает:
true, если символ является эмодзи; в противном случае — false.
С версии:
21
Внешние спецификации
  • Эмодзи Unicode

isEmojiPresentation

public static boolean isEmojiPresentation(int codePoint)
Определяет, имеет ли указанный символ (кодовая точка Unicode) по умолчанию свойство Emoji Presentation.

Символ считается имеющим свойство Emoji Presentation тогда и только тогда, когда он имеет свойство Emoji_Presentation, определённое в Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ имеет свойство Emoji Presentation; в противном случае — false.
Начиная с версии:
21
Внешние спецификации
  • Unicode Emoji

isEmojiModifier

public static boolean isEmojiModifier(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором Emoji.

Символ считается модификатором Emoji тогда и только тогда, когда он имеет свойство Emoji_Modifier, определённое в Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является модификатором Emoji; в противном случае — false.
Начиная с версии:
21
Внешние спецификации
  • Unicode Emoji

isEmojiModifierBase

public static boolean isEmojiModifierBase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом для модификатора Emoji.

Символ считается базовым символом для модификатора Emoji тогда и только тогда, когда он имеет свойство Emoji_Modifier_Base, определённое в Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является базовым символом для модификатора Emoji; в противном случае — false.
Начиная с версии:
21
Внешние спецификации
  • Unicode Emoji

isEmojiComponent

public static boolean isEmojiComponent(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом Emoji.

Символ считается компонентом Emoji тогда и только тогда, когда он имеет свойство Emoji_Component, определённое в Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является компонентом Emoji; в противном случае — false.
Начиная с версии:
21
Внешние спецификации
  • Unicode Emoji

isExtendedPictographic

public static boolean isExtendedPictographic(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом.

Символ считается расширенным пиктографическим символом тогда и только тогда, когда он имеет свойство Extended_Pictographic, определённое в Unicode Emoji (технический стандарт № 51).

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является расширенным пиктографическим символом; в противном случае — false.
Начиная с версии:
21
Внешние спецификации
  • Unicode Emoji

toLowerCase

public static char toLowerCase(char ch)
Преобразует символ в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.

Как правило, для преобразования символов в нижний регистр следует использовать String.toLowerCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).

Параметры:
ch — символ, который необходимо преобразовать.
Возвращает:
эквивалент символа в нижнем регистре, если он существует; в противном случае — сам символ.
См. также:
  • isLowerCase(char)
  • String.toLowerCase()

toLowerCase

public static int toLowerCase(int codePoint)
Преобразует символ (кодовую точку Unicode) в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.

Как правило, для преобразования символов в нижний регистр следует использовать String.toLowerCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо преобразовать.
Возвращает:
эквивалент символа (кодовой точки Unicode) в нижнем регистре, если он существует; в противном случае — сам символ.
Начиная с версии:
1.5
См. также:
  • isLowerCase(int)
  • String.toLowerCase()

toUpperCase

public static char toUpperCase(char ch)
Преобразует символ в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.

Как правило, для преобразования символов в верхний регистр следует использовать String.toUpperCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toUpperCase(int).

Параметры:
ch — символ, который необходимо преобразовать.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае — сам символ.
См. также:
  • isUpperCase(char)
  • String.toUpperCase()

toUpperCase

public static int toUpperCase(int codePoint)
Преобразует символ (кодовую точку Unicode) в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.

Как правило, для преобразования символов в верхний регистр следует использовать String.toUpperCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо преобразовать.
Возвращает:
эквивалент символа в верхнем регистре, если он существует; в противном случае — сам символ.
Начиная с версии:
1.5
См. также:
  • isUpperCase(int)
  • String.toUpperCase()

toTitleCase

public static char toTitleCase(char ch)
Преобразует символ в титульный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа не задано явное преобразование в титульный регистр и, согласно UnicodeData, он сам не является символом титульного регистра, в качестве эквивалентного преобразования в титульный регистр возвращается преобразование в верхний регистр. Если аргумент char уже является символом титульного регистра char, будет возвращено то же значение char.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toTitleCase(int).

Параметры:
ch — символ, который необходимо преобразовать.
Возвращает:
эквивалент символа в титульном регистре, если он существует; в противном случае — сам символ.
Начиная с версии:
1.0.2
См. также:
  • isTitleCase(char)
  • toLowerCase(char)
  • toUpperCase(char)

toTitleCase

public static int toTitleCase(int codePoint)
Преобразует символ (кодовую точку Unicode) в титульный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа не задано явное преобразование в титульный регистр и, согласно UnicodeData, он сам не является символом титульного регистра, в качестве эквивалентного преобразования в титульный регистр возвращается преобразование в верхний регистр. Если аргумент-символ уже является символом титульного регистра, будет возвращено то же значение символа.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.

Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо преобразовать.
Возвращает:
эквивалент символа в титульном регистре, если он существует; в противном случае — сам символ.
Начиная с версии:
1.5
См. также:
  • isTitleCase(int)
  • toLowerCase(int)
  • toUpperCase(int)

digit

public static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанной системе счисления.

Если основание системы счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если истинно хотя бы одно из следующих условий:

  • Метод isDigit является true символа, а значение десятичной цифры этого символа в Unicode (или его односимвольного разложения) меньше указанного основания системы счисления. В этом случае возвращается значение десятичной цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', а его код меньше radix + 'A' - 10. В этом случае возвращается ch - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', а его код меньше radix + 'a' - 10. В этом случае возвращается ch - 'a' + 10.
  • Символ является одной из полноширинных заглавных латинских букв от A ('\uFF21') до Z ('\uFF3A'), а его код меньше radix + '\uFF21' - 10. В этом случае возвращается ch - '\uFF21' + 10.
  • Символ является одной из полноширинных строчных латинских букв от a ('\uFF41') до z ('\uFF5A'), а его код меньше radix + '\uFF41' - 10. В этом случае возвращается ch - '\uFF41' + 10.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).

Параметры:
ch — символ, который нужно преобразовать.
radix — основание системы счисления.
Возвращает:
числовое значение, представленное символом в указанной системе счисления.
См. также:
  • forDigit(int, int)
  • isDigit(char)

digit

public static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кодовой точки Unicode) в указанной системе счисления.

Если основание системы счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если истинно хотя бы одно из следующих условий:

  • Метод isDigit(codePoint) является true символа, а значение десятичной цифры этого символа в Unicode (или его односимвольного разложения) меньше указанного основания системы счисления. В этом случае возвращается значение десятичной цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', а его код меньше radix + 'A' - 10. В этом случае возвращается codePoint - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', а его код меньше radix + 'a' - 10. В этом случае возвращается codePoint - 'a' + 10.
  • Символ является одной из полноширинных заглавных латинских букв от A ('\uFF21') до Z ('\uFF3A'), а его код меньше radix + '\uFF21' - 10. В этом случае возвращается codePoint - '\uFF21' + 10.
  • Символ является одной из полноширинных строчных латинских букв от a ('\uFF41') до z ('\uFF5A'), а его код меньше radix + '\uFF41'- 10. В этом случае возвращается codePoint - '\uFF41' + 10.
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно преобразовать.
radix — основание системы счисления.
Возвращает:
числовое значение, представленное символом в указанной системе счисления.
Начиная с версии:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

getNumericValue

public static int getNumericValue(char ch)
Возвращает int значение, которое представляет указанный символ Unicode. Например, символ '\u216C' (римская цифра пятьдесят) вернёт значение int, равное 50.

Заглавные латинские буквы A–Z (от '\u0041' до '\u005A'), строчные латинские буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовых значений этим значениям char.

Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).

Параметры:
ch — символ, который нужно преобразовать.
Возвращает:
числовое значение символа в виде неотрицательного значения int; -2, если символ имеет числовое значение, которое нельзя представить в виде неотрицательного значения int; -1, если символ не имеет числового значения.
Начиная с версии:
1.1
См. также:
  • forDigit(int, int)
  • isDigit(char)

getNumericValue

public static int getNumericValue(int codePoint)
Возвращает int значение, которое представляет указанный символ (кодовая точка Unicode). Например, символ '\u216C' (римская цифра пятьдесят) вернёт значение int, равное 50.

Заглавные латинские буквы A–Z (от '\u0041' до '\u005A'), строчные латинские буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовых значений этим значениям char.

Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.

Параметры:
codePoint — символ (кодовая точка Unicode), который нужно преобразовать.
Возвращает:
числовое значение символа в виде неотрицательного значения int; -2, если символ имеет числовое значение, которое нельзя представить в виде неотрицательного значения int; -1, если символ не имеет числового значения.
Начиная с версии:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

isSpace

@Deprecated(since="1.1") public static boolean isSpace(char ch)
Устарел.
Заменён методом isWhitespace(char).
Определяет, является ли указанный символ пробельным символом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
truechars
Символ Код Название
'\t' U+0009 HORIZONTAL TABULATION
'\n' U+000A NEW LINE
'\f' U+000C FORM FEED
'\r' U+000D CARRIAGE RETURN
' ' U+0020 SPACE
Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является пробельным символом ISO-LATIN-1; в противном случае — false.
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ пробельным символом Unicode. Символ считается пробельным тогда и только тогда, когда он определён как пробельный символ в стандарте Unicode. Этот метод возвращает true, если общая категория символа соответствует одному из следующих значений:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является пробельным; в противном случае — false.
Начиная с версии:
1.1
См. также:
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом Unicode. Символ считается пробельным тогда и только тогда, когда он определён как пробельный символ в стандарте Unicode. Этот метод возвращает true, если общая категория символа соответствует одному из следующих значений:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ является пробельным; в противном случае — false.
Начиная с версии:
1.5
См. также:
  • isWhitespace(int)

isWhitespace

public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробельным символом согласно Java. Символ является пробельным символом Java тогда и только тогда, когда он соответствует одному из следующих критериев:
  • Это пробельный символ Unicode (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), который при этом не является неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Это '\t', U+0009 горизонтальная табуляция.
  • Это '\n', U+000A перевод строки.
  • Это '\u000B', U+000B вертикальная табуляция.
  • Это '\f', U+000C перевод страницы.
  • Это '\r', U+000D возврат каретки.
  • Это '\u001C', U+001C разделитель файлов.
  • Это '\u001D', U+001D разделитель групп.
  • Это '\u001E', U+001E разделитель записей.
  • Это '\u001F', U+001F разделитель единиц.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isWhitespace(int).

Параметры:
ch — символ, который нужно проверить.
Возвращает:
true, если символ является пробельным символом Java; в противном случае — false.
Начиная с версии:
1.1
См. также:
  • isSpaceChar(char)

isWhitespace

public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java. Символ является пробельным символом Java тогда и только тогда, когда он соответствует одному из следующих критериев:
  • Он является символом-разделителем Unicode (SPACE_SEPARATOR, LINE_SEPARATOR или PARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0', '\u2007', '\u202F').
  • Это '\t', U+0009 HORIZONTAL TABULATION.
  • Это '\n', U+000A LINE FEED.
  • Это '\u000B', U+000B VERTICAL TABULATION.
  • Это '\f', U+000C FORM FEED.
  • Это '\r', U+000D CARRIAGE RETURN.
  • Это '\u001C', U+001C FILE SEPARATOR.
  • Это '\u001D', U+001D GROUP SEPARATOR.
  • Это '\u001E', U+001E RECORD SEPARATOR.
  • Это '\u001F', U+001F UNIT SEPARATOR.
Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является пробельным символом Java; в противном случае — false.
Начиная с версии:
1.5
См. также:
  • isSpaceChar(int)

isISOControl

public static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне от '\u0000' до '\u001F' или в диапазоне от '\u007F' до '\u009F'.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).

Параметры:
ch — символ, который необходимо проверить.
Возвращает:
true, если символ является управляющим символом ISO; в противном случае — false.
Начиная с версии:
1.1
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isISOControl

public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне от '\u0000' до '\u001F' или в диапазоне от '\u007F' до '\u009F'.
Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
true, если символ является управляющим символом ISO; в противном случае — false.
Начиная с версии:
1.5
См. также:
  • isSpaceChar(int)
  • isWhitespace(int)

getType

public static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).

Параметры:
ch — символ, который необходимо проверить.
Возвращает:
значение типа int, представляющее общую категорию символа.
Начиная с версии:
1.1
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

getType

public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
Параметры:
codePoint — символ (кодовая точка Unicode), который необходимо проверить.
Возвращает:
значение типа int, представляющее общую категорию символа.
Начиная с версии:
1.5
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

forDigit

public static char forDigit(int digit, int radix)
Определяет символьное представление заданной цифры в указанной системе счисления. Если значение radix не является допустимым основанием системы счисления или значение digit не является допустимой цифрой в указанной системе счисления, возвращается нулевой символ ('\u0000').

Аргумент radix является допустимым, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit является допустимым, если 0 <= digit < radix.

Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.

Параметры:
digit — число, которое требуется преобразовать в символ.
radix — основание системы счисления.
Возвращает:
символьное представление char указанной цифры в заданной системе счисления.
См. также:
  • MIN_RADIX
  • MAX_RADIX
  • digit(char, int)

getDirectionality

public static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для заданного символа. Направленность символов используется для вычисления визуального порядка текста. Значение направленности неопределённых значений char равно DIRECTIONALITY_UNDEFINED.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).

Параметры:
ch — char, для которого запрашивается свойство направленности.
Возвращает:
свойство направленности значения char.
Начиная с версии:
1.4
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

getDirectionality

public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Unicode для указанного символа (кодовой точки Unicode). Направленность символов используется для вычисления визуального порядка текста. Значение направленности неопределённого символа — DIRECTIONALITY_UNDEFINED.
Параметры:
codePoint — символ (кодовая точка Unicode), для которого запрашивается свойство направленности.
Возвращает:
свойство направленности символа.
С версии:
1.5
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

isMirrored

public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным согласно спецификации Unicode. Зеркальные символы должны отображаться в зеркальном виде по горизонтали, когда они используются в тексте с направлением справа налево. Например, '\u0028' LEFT PARENTHESIS семантически определяется как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».

Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isMirrored(int).

Параметры:
ch — char, для которого запрашивается свойство зеркальности
Возвращает:
true, если символ зеркальный, false, если char не является зеркальным или не определён.
С версии:
1.4

isMirrored

public static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode. Зеркальные символы должны отображаться в зеркальном виде по горизонтали, когда они используются в тексте с направлением справа налево. Например, '\u0028' LEFT PARENTHESIS семантически определяется как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».
Параметры:
codePoint — символ (кодовая точка Unicode), который нужно проверить.
Возвращает:
true, если символ зеркальный, false, если символ не является зеркальным или не определён.
С версии:
1.5

compareTo

public int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
Определено в:
compareTo в интерфейсе Comparable<Character>
Параметры:
anotherCharacter — Character для сравнения.
Возвращает:
значение 0, если аргумент Character равен этому Character; значение меньше 0, если это Character численно меньше аргумента Character; и значение больше 0, если это Character численно больше аргумента Character (беззнаковое сравнение). Обратите внимание, что это исключительно числовое сравнение, не зависящее от локали.
С версии:
1.2

compare

public static int compare(char x, char y)
Сравнивает два значения char численно. Возвращаемое значение совпадает со значением, которое было бы возвращено следующим выражением:
   Character.valueOf(x).compareTo(Character.valueOf(y))
Параметры:
x — первый char для сравнения
y — второй char для сравнения
Возвращает:
значение 0, если x == y; значение меньше 0, если x < y; и значение больше 0, если x > y
С версии:
1.7

reverseBytes

public static char reverseBytes(char ch)
Возвращает значение, полученное обращением порядка байтов в указанном значении char.
Параметры:
ch — char, порядок байтов которого нужно обратить.
Возвращает:
значение, полученное обращением (или, что эквивалентно, перестановкой) байтов в указанном значении char.
С версии:
1.5

getName

public static String getName(int codePoint)
Возвращает имя указанного символа codePoint или null, если кодовая точка является unassigned.

Если указанному символу не назначено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Unicode Consortium), возвращаемое имя совпадает с результатом выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для codePointов в файле UnicodeData имя, возвращаемое этим методом, соответствует схеме именования из раздела «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, например хангыльских символов и идеограмм, приведённое выше правило генерации имени отличается от правила, определённого в стандарте Unicode.
Параметры:
codePoint — символ (кодовая точка Unicode)
Возвращает:
имя указанного символа или null, если кодовая точка не назначена.
Выбрасывает:
IllegalArgumentException — если указанная codePoint не является допустимой кодовой точкой Unicode.
С версии:
1.7

codePointOf

public static int codePointOf(String name)
Возвращает значение кодовой точки символа Unicode, заданного указанным именем символа.

Если символу не назначено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Unicode Consortium), его имя определяется как результат выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);

Сопоставление name не учитывает регистр; начальные и конечные пробельные символы удаляются. Для кодовых точек из файла UnicodeData этот метод распознаёт имя, соответствующее имени, определённому в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек этот метод распознаёт имя, сгенерированное методом getName(int).

Параметры:
name — имя символа
Возвращает:
значение кодовой точки символа, указанного его именем.
Выбрасывает:
IllegalArgumentException — если указанное name не является допустимым именем символа.
NullPointerException — если name равно null
С версии:
9

Сообщить об ошибке или предложить улучшение
Дополнительную справочную информацию по API и документацию для разработчиков см. в разделе Документация Java SE, содержащем более подробные описания для разработчиков, общие сведения, определения терминов, обходные решения и рабочие примеры кода. Другие версии.
Java является товарным знаком или зарегистрированным товарным знаком Oracle и/или её дочерних компаний в США и других странах.
Авторское право © 1993, 2026, Oracle и/или её дочерние компании, 500 Oracle Parkway, Redwood Shores, CA 94065 USA.
Все права защищены. Использование регулируется условиями лицензии и политикой распространения документации.

© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API