Spec-Zone.ru › OpenJDK 17

Класс Character

java.lang.Object
java.lang.Character
Все реализованные интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Класс Character оборачивает значение примитивного типа char в объект. Объект класса Character содержит единственное поле типа char.

Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.) и для преобразования символов из верхнего регистра в нижний и наоборот.

Соответствие Unicode

Поля и методы класса Character определяются на основе информации о символах из стандарта Unicode, конкретно файла UnicodeData, который входит в базу данных символов Unicode. Этот файл определяет свойства, включая имя и категорию для каждого присвоенного кодового значения Unicode или диапазона символов. Файл доступен в Консорциуме Unicode по адресу http://www.unicode.org.

Информация о символах основана на стандарте Unicode версии 13.0.

Java-платформа поддерживала различные версии стандарта Unicode на протяжении времени. Обновления до более новых версий стандарта Unicode произошли в следующих выпусках Java, каждый из которых указывает новую версию:

Показывает выпуски Java и поддерживаемые версии Unicode
Выпуск Java Версия Unicode
Java SE 15 Unicode 13.0
Java SE 13 Unicode 12.1
Java SE 12 Unicode 11.0
Java SE 11 Unicode 10.0
Java SE 9 Unicode 8.0
Java SE 8 Unicode 6.2
Java SE 7 Unicode 6.0
Java SE 5.0 Unicode 4.0
Java SE 1.4 Unicode 3.0
JDK 1.1 Unicode 2.0
JDK 1.0.2 Unicode 1.1.5
Отклонения от этих базовых версий Unicode, такие как распознанные приложения, документированы в другом месте.

Представления символов Unicode

Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основаны на оригинальной спецификации Unicode, которая определяла символы как сущности фиксированной длины 16 бит. Стандарт Unicode с тех пор был изменен, чтобы позволить символы, чье представление требует более 16 бит. Диапазон допустимых кодовых точек теперь от U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)

Набор символов от U+0000 до U+FFFF иногда называется базовой многоязычной плоскостью (BMP). Символы с кодовыми точками, большими чем U+FFFF, называются дополнительными символами. Java-платформа использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первой из диапазона высоких суррогатов (\uD800-\uDBFF), второй из диапазона низких суррогатов (\uDC00-\uDFFF).

Значение char, следовательно, представляет кодовые точки Базовой многоязычной плоскости (BMP), включая кодовые точки суррогатов, или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Нижние (наименее значащие) 21 бит int используются для представления кодовых точек Unicode, а верхние (наиболее значащие) 11 бит должны быть нулевыми. За исключением случаев, когда указано иное, поведение относительно дополнительных символов и значений суррогатов char таково:

  • Методы, принимающие только значение char, не могут поддерживать дополнительные символы. Они рассматривают значения char из диапазонов суррогатов как неопределённые символы. Например, Character.isLetter('\uD840') возвращает false, даже если это конкретное значение, если за ним следует любое значение низкого суррогата в строке, представляло бы букву.
  • Методы, принимающие значение int, поддерживают все символы Unicode, включая дополнительные. Например, Character.isLetter(0x2F81A) возвращает true, потому что кодовое значение точки представляет букву (китайский иероглиф).

В документации Java SE API используется термин кодовая точка Unicode для значений символов в диапазоне от U+0000 до U+10FFFF, и единица кода Unicode используется для 16-битных значений char , которые являются единицами кода кодировки UTF-16. Для получения дополнительной информации по терминологии Unicode см. Словарь Unicode.

Это класс с основой на значении; программисты должны рассматривать экземпляры, которые равны, как взаимозаменяемые и не должны использовать экземпляры для синхронизации, иначе может возникнуть непредсказуемое поведение. Например, в будущей версии синхронизация может быть нерабочей.

С тех пор:
1.0
См. также:
  • Сериализованная форма

Краткое описание вложенных классов

Модификатор и тип Класс Описание
static class  Character.Subset
Экземпляры этого класса представляют собой определённые подмножества набора символов Unicode.
static final class  Character.UnicodeBlock
Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode.
static enum  Character.UnicodeScript
Семейство подмножеств символов, представляющих наборы символов, определённых в Приложении к стандарту Unicode #24: Имена наборов символов.

Краткое описание полей

Modifier and Type Field Description
static final int BYTES
Количество байтов, используемых для представления значения char в необработанном двоичном формате.
static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип двунаправленного символа "AN" в спецификации Unicode.
static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип двунаправленного символа "BN" в спецификации Unicode.
static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип двунаправленного символа "CS" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип двунаправленного символа "EN" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип двунаправленного символа "ES" в спецификации Unicode.
static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип двунаправленного символа "ET" в спецификации Unicode.
static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый тип двунаправленного символа "FSI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип двунаправленного символа "L" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип двунаправленного символа "LRE" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый тип двунаправленного символа "LRI" в спецификации Unicode.
static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип двунаправленного символа "LRO" в спецификации Unicode.
static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип двунаправленного символа "NSM" в спецификации Unicode.
static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип двунаправленного символа "ON" в спецификации Unicode.
static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип двунаправленного символа "B" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип двунаправленного символа "PDF" в спецификации Unicode.
static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый тип двунаправленного символа "PDI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип двунаправленного символа "R" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип двунаправленного символа "AL" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип двунаправленного символа "RLE" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый тип двунаправленного символа "RLI" в спецификации Unicode.
static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип двунаправленного символа "RLO" в спецификации Unicode.
static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип двунаправленного символа "S" в спецификации Unicode.
static final byte DIRECTIONALITY_UNDEFINED
Неопределенный тип двунаправленного символа.
static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип двунаправленного символа "WS" в спецификации Unicode.
static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
static final int MAX_CODE_POINT
Максимальное значение кода символа Unicode, константа U+10FFFF.
static final char MAX_HIGH_SURROGATE
Максимальное значение высокого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDBFF'.
static final char MAX_LOW_SURROGATE
Максимальное значение низкого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDFFF'.
static final int MAX_RADIX
Максимальное основание, доступное для преобразования в строки и из них.
static final char MAX_SURROGATE
Максимальное значение суррогатного кода Unicode в кодировке UTF-16, константа '\uDFFF'.
static final char MAX_VALUE
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'.
static final int MIN_CODE_POINT
Минимальное значение кода символа Unicode, константа U+0000.
static final char MIN_HIGH_SURROGATE
Минимальное значение высокого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uD800'.
static final char MIN_LOW_SURROGATE
Минимальное значение низкого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDC00'.
static final int MIN_RADIX
Минимальное основание, доступное для преобразования в строки и из них.
static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительного кода символа Unicode, константа U+10000.
static final char MIN_SURROGATE
Минимальное значение суррогатного кода Unicode в кодировке UTF-16, константа '\uD800'.
static final char MIN_VALUE
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'.
static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
END_OF_DOCUMENT_MARKER
static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
static final int SIZE
Количество бит, используемых для представления значения char в беззнаковом двоичном формате, константа 16.
static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.

Краткое описание конструкторов

Конструктор Описание
Character(char value)
Устаревший, подлежит удалению: Этот элемент API может быть удален в будущей версии.
Использовать этот конструктор редко уместно.

Краткое описание методов

Модификатор и тип Метод Описание
static int charCount(int codePoint)
Определяет количество значений char необходимых для представления указанного символа (кода Юникода).
char charValue()
Возвращает значение объекта Character.
static int codePointAt(char[] a, int index)
Возвращает код символа в заданном индексе массива char.
static int codePointAt(char[] a, int index, int limit)
Возвращает код символа в заданном индексе массива char, где используются только элементы массива с index меньше limit.
static int codePointAt(CharSequence seq, int index)
Возвращает код символа в заданном индексе CharSequence.
static int codePointBefore(char[] a, int index)
Возвращает код символа, предшествующий заданному индексу в массиве char.
static int codePointBefore(char[] a, int index, int start)
Возвращает код символа, предшествующий заданному индексу в массиве char, где используются только элементы массива с index больше или равно start.
static int codePointBefore(CharSequence seq, int index)
Возвращает код символа, предшествующий заданному индексу в CharSequence.
static int codePointCount(char[] a, int offset, int count)
Возвращает количество кодов символов Юникода в подмассиве аргумента char.
static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество кодов символов Юникода в диапазоне текста указанной последовательности символов.
static int codePointOf(String name)
Возвращает числовое значение символа Юникода, заданного указанным именем символа Юникода.
static int compare(char x, char y)
Сравнивает два значения char численно.
int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащую номинальный дескриптор для этого экземпляра.
static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанном основании.
static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кода Юникода) в указанном основании.
boolean equals(Object obj)
Сравнивает этот объект с указанным объектом.
static char forDigit(int digit, int radix)
Определяет представление символа для определенной цифры в заданном основании.
static byte getDirectionality(char ch)
Возвращает свойство направленности Юникода для данного символа.
static byte getDirectionality(int codePoint)
Возвращает свойство направленности Юникода для данного символа (кода Юникода).
static String getName(int codePoint)
Возвращает имя символа Юникода для указанного символа codePoint, или null, если код символа unassigned.
static int getNumericValue(char ch)
Возвращает значение int, которое представляет указанный символ Юникода.
static int getNumericValue(int codePoint)
Возвращает значение int, которое представляет указанный символ (код Юникода).
static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
int hashCode()
Возвращает хеш-код для этого Character; равен результату вызова charValue().
static int hashCode(char value)
Возвращает хеш-код для значения char; совместимо с Character.hashCode().
static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (код-единица высокого суррогата) пары суррогатов, представляющей указанный дополнительный символ (код Юникода) в кодировке UTF-16.
static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (код Юникода) буквенным.
static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Юникода) в основной многоязычной плоскости (BMP).
static boolean isDefined(char ch)
Определяет, определен ли символ в Юникоде.
static boolean isDefined(int codePoint)
Определяет, определён ли символ (код Юникода) в Юникоде.
static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) цифрой.
static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char кодовой единицей высокого суррогата Юникода (также известной как ведущая кодовая единица суррогата).
static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или идентификаторе Юникода.
static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли рассматривать указанный символ (код Юникода) как игнорируемый символ в идентификаторе Java или идентификаторе Юникода.
static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ CJKV (китайский, японский, корейский и вьетнамский) идеограммой, как определено в стандарте Юникода.
static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO.
static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (код Юникода) управляющим символом ISO.
static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа.
static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (код Юникода) быть частью идентификатора Java, кроме первого символа.
static boolean isJavaIdentifierStart(char ch)
Определяет, разрешен ли указанный символ как первый символ в идентификаторе Java.
static boolean isJavaIdentifierStart(int codePoint)
Определяет, разрешён ли символ (код Юникода) как первый символ в идентификаторе Java.
static boolean isJavaLetter(char ch)
Устарело.
Заменено на isJavaIdentifierStart(char).
static boolean isJavaLetterOrDigit(char ch)
Устарело.
Заменено на isJavaIdentifierPart(char).
static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (код Юникода) буквой.
static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) буквой или цифрой.
static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчной буквой.
static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) строчной буквой.
static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char символом низкого суррогата Юникода (также известен как символ-суррогат-прицепной).
static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода.
static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) зеркальным в соответствии со спецификацией Юникода.
static boolean isSpace(char ch)
Устарело.
Заменено на isWhitespace(char).
static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом пробела Юникода.
static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом пробела Юникода.
static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (код точки Юникода) в диапазоне дополнительных символов.
static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char суррогатным символом Юникода.
static boolean isSurrogatePair(char high, char low)
Определяет, является ли указанная пара значений char валидной парой суррогатов Юникода.
static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом заглавной буквы.
static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом заглавной буквы.
static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа.
static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (код точки Юникода) быть частью идентификатора Юникода, кроме первого символа.
static boolean isUnicodeIdentifierStart(char ch)
Определяет, разрешён ли указанный символ в качестве первого символа в идентификаторе Юникода.
static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, разрешён ли указанный символ (код точки Юникода) в качестве первого символа в идентификаторе Юникода.
static boolean isUpperCase(char ch)
Определяет, является ли указанный символ прописной буквой.
static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) прописной буквой.
static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный код точки действительным значением кода точки Юникода.
static boolean isWhitespace(char ch)
Определяет, является ли указанный символ символом пробела согласно Java.
static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом пробела согласно Java.
static char lowSurrogate(int codePoint)
Возвращает символ-суррогат-прицепной (низкий суррогат код-единица) пары суррогатов ( surrogate pair) представляющий указанный дополнительный символ (код точки Юникода) в кодировке UTF-16.
static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в заданном char подмассиве, смещенный от заданного index на codePointOffset точек кода.
static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в заданной последовательности символов, смещенный от заданного index на codePointOffset точек кода.
static char reverseBytes(char ch)
Возвращает значение, полученное путем перестановки байтов в указанном значении char.
static char[] toChars(int codePoint)
Преобразует указанный символ (код точки Юникода) в его представление UTF-16, хранящееся в массиве char.
static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (код точки Юникода) в его представление UTF-16.
static int toCodePoint(char high, char low)
Преобразует указанную пару суррогатов в значение дополнительного кода точки.
static char toLowerCase(char ch)
Преобразует символ в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
static int toLowerCase(int codePoint)
Преобразует символ (код точки Юникода) в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
String toString()
Возвращает объект String, представляющий значение этого объекта Character.
static String toString(char c)
Возвращает объект String, представляющий указанный char.
static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (код точки Юникода).
static char toTitleCase(char ch)
Преобразует символ в заглавный регистр, используя информацию о преобразовании регистра из файла UnicodeData.
static int toTitleCase(int codePoint)
Преобразует символ (код точки Юникода) в заглавный регистр, используя информацию о преобразовании регистра из файла UnicodeData.
static char toUpperCase(char ch)
Преобразует символ в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
static int toUpperCase(int codePoint)
Преобразует символ (код точки Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char.

Методы, объявленные в классе java.lang.Object

clone, finalize, getClass, notify, notifyAll, wait, wait, wait

Подробное описание полей

MIN_RADIX

public static final int MIN_RADIX
Минимальный радикс, доступный для преобразования в строки и из строк. Значение константы этого поля — это наименьшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MAX_RADIX

public static final int MAX_RADIX
Максимальный радикс, доступный для преобразования в строки и из строк. Значение константы этого поля — это наибольшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • Integer.toString(int, int)
  • Integer.valueOf(String)
  • Значения константных полей

MIN_VALUE

public static final char MIN_VALUE
Значение константы этого поля — это наименьшее значение типа char, '\u0000'.
С:
1.0.2
См. также:
  • Значения константных полей

MAX_VALUE

public static final char MAX_VALUE
Значение константы этого поля — это наибольшее значение типа char, '\uFFFF'.
С:
1.0.2
См. также:
  • Значения константных полей

TYPE

public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
С:
1.1

НЕНАЗНАЧЕННОЕ

public static final byte UNASSIGNED
Общекатегория "Cn" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ПРОПИСНАЯ_БУКВА

public static final byte UPPERCASE_LETTER
Общекатегория "Lu" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

МАЛЕНЬКАЯ_БУКВА

public static final byte LOWERCASE_LETTER
Общекатегория "Ll" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

БУКВА_ЗАГЛАВНАЯ

public static final byte TITLECASE_LETTER
Общекатегория "Lt" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

МОДИФИКАТОРНАЯ_БУКВА

public static final byte MODIFIER_LETTER
Общекатегория "Lm" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ДРУГАЯ_БУКВА

public static final byte OTHER_LETTER
Общекатегория "Lo" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

НЕРАЗРЫВНЫЙ_СИМВОЛ

public static final byte NON_SPACING_MARK
Общекатегория "Mn" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ВКЛЮЧАЮЩИЙ_СИМВОЛ

public static final byte ENCLOSING_MARK
Общекатегория "Me" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

СОЧЕТАЕМЫЙ_РАЗРЫВНОЙ_СИМВОЛ

public static final byte COMBINING_SPACING_MARK
Общекатегория "Mc" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ЦИФРА_ДЕСЯТИЧНОГО_ЧИСЛА

public static final byte DECIMAL_DIGIT_NUMBER
Общекатегория "Nd" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

БУКВА_ЧИСЛО

public static final byte LETTER_NUMBER
Общекатегория "Nl" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ДРУГОЕ_ЧИСЛО

public static final byte OTHER_NUMBER
Общекатегория "No" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

РАЗДЕЛИТЕЛЬ_ПРОБЕЛА

public static final byte SPACE_SEPARATOR
Общекатегория "Zs" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

РАЗДЕЛИТЕЛЬ_СТРОК

public static final byte LINE_SEPARATOR
Общекатегория "Zl" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

РАЗДЕЛИТЕЛЬ_АБЗАЦОВ

public static final byte PARAGRAPH_SEPARATOR
Общекатегория "Zp" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

УПРАВЛЯЮЩИЙ

public static final byte CONTROL
Общекатегория "Cc" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ФОРМАТ

public static final byte FORMAT
Общекатегория "Cf" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

ЛИЧНОЕ_ИСПОЛЬЗОВАНИЕ

public static final byte PRIVATE_USE
Общекатегория "Co" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

СУРРОГАТ

public static final byte SURROGATE
Общекатегория "Cs" в спецификации Unicode.
С:
1.1
См. также:
  • Значения константных полей

Пунктуация тире

public static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Пунктуация начала

public static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Пунктуация конца

public static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Пунктуация соединения

public static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Другая пунктуация

public static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Символ математики

public static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Символ валюты

public static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Символ модификатора

public static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Прочие символы

public static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Юникод.
С:
1.1
См. также:
  • Значения постоянных полей

Пунктуация кавычек (начало)

public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

Пунктуация кавычек (конец)

public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

Направление_неопределённо

public static final byte DIRECTIONALITY_UNDEFINED
Тип бинарочного символа с неопределённым направлением. Значения char в спецификации Юникод имеют неопределённое направление.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_СЛЕВА_НАПРАВО

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип бинарочного символа "L" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_СПРАВА_НАЛЕВО

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип бинарочного символа "R" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_СПРАВА_НАЛЕВО_АРАБСКИЙ

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип бинарочного символа "AL" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_ЕВРОПЕЙСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип бинарочного символа "EN" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_ЕВРОПЕЙСКОГО_ЧИСЛА

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип бинарочного символа "ES" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_ЗАВЕРШИТЕЛЬ_ЕВРОПЕЙСКОГО_ЧИСЛА

public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип бинарочного символа "ET" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_АРАБСКОЕ_ЧИСЛО

public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип бинарочного символа "AN" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_ОБЩИЙ_РАЗДЕЛИТЕЛЬ_ЧИСЕЛ

public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип бинарочного символа "CS" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_НЕРАЗРЫВНЫЙ_СИМВОЛ

public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип бинарочного символа "NSM" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_НЕЙТРАЛЬНАЯ_ГРАНИЦА

public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип бинарочного символа "BN" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_АБЗАЦА

public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип бинарочного символа "B" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_РАЗДЕЛА

public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип бинарочного символа "S" в спецификации Юникод.
С:
1.4
См. также:
  • Значения постоянных полей

DIRECTIONALITY_WHITESPACE

public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный двунаправленный тип символа "WS" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_OTHER_NEUTRALS

public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный двунаправленный тип символа "ON" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный двунаправленный тип символа "LRE" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный двунаправленный тип символа "LRO" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный двунаправленный тип символа "RLE" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный двунаправленный тип символа "RLO" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_FORMAT

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый двунаправленный тип символа "PDF" в спецификации Unicode.
С момента:
1.4
См. также:
  • Значения константных полей

DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE

public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый двунаправленный тип символа "LRI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE

public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый двунаправленный тип символа "RLI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_FIRST_STRONG_ISOLATE

public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый двунаправленный тип символа "FSI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения константных полей

DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый двунаправленный тип символа "PDI" в спецификации Unicode.
С момента:
9
См. также:
  • Значения константных полей

MIN_HIGH_SURROGATE

public static final char MIN_HIGH_SURROGATE
Минимальное значение кода символа-заместителя высшего уровня в кодировке UTF-16, константа '\uD800'. Символ-заместитель высшего уровня также известен как символ-заместитель ведущий.
С момента:
1.5
См. также:
  • Значения константных полей

MAX_HIGH_SURROGATE

public static final char MAX_HIGH_SURROGATE
Максимальное значение кода символа-заместителя высшего уровня в кодировке UTF-16, константа '\uDBFF'. Символ-заместитель высшего уровня также известен как символ-заместитель ведущий.
С момента:
1.5
См. также:
  • Значения константных полей

MIN_LOW_SURROGATE

public static final char MIN_LOW_SURROGATE
Минимальное значение кода символа-заместителя низшего уровня в кодировке UTF-16, константа '\uDC00'. Символ-заместитель низшего уровня также известен как символ-заместитель ведомый.
С момента:
1.5
См. также:
  • Значения константных полей

MAX_LOW_SURROGATE

public static final char MAX_LOW_SURROGATE
Максимальное значение кода символа-заместителя низшего уровня в кодировке UTF-16, константа '\uDFFF'. Символ-заместитель низшего уровня также известен как символ-заместитель ведомый.
С момента:
1.5
См. также:
  • Значения константных полей

MIN_SURROGATE

public static final char MIN_SURROGATE
Минимальное значение кода символа-заместителя Unicode в кодировке UTF-16, константа '\uD800'.
С момента:
1.5
См. также:
  • Значения константных полей

MAX_SURROGATE

public static final char MAX_SURROGATE
Максимальное значение кода символа-заместителя Unicode в кодировке UTF-16, константа '\uDFFF'.
С момента:
1.5
См. также:
  • Значения константных полей

MIN_SUPPLEMENTARY_CODE_POINT

public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительного кода символа Unicode, константа U+10000.
С момента:
1.5
См. также:
  • Значения константных полей

MIN_CODE_POINT

public static final int MIN_CODE_POINT
Минимальное значение кода символа Unicode, константа U+0000.
С момента:
1.5
См. также:
  • Значения константных полей

MAX_CODE_POINT

public static final int MAX_CODE_POINT
Максимальное значение кода символа Unicode, константа U+10FFFF.
С момента:
1.5
См. также:
  • Значения константных полей

SIZE

public static final int SIZE
Количество бит, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
С момента:
1.5
См. также:
  • Значения константных полей

BYTES

public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковом двоичном формате.
Since:
1.8
См. также:
  • Значения константных полей

Подробное описание конструкторов

Character

@Deprecated(since="9", forRemoval=true) public Character(char value)
Устаревший, подлежит удалению: Элемент API может быть удален в будущей версии.
Использование этого конструктора редко оправдано. Статический фабричный метод valueOf(char) обычно является лучшим выбором, поскольку он, вероятно, обеспечит существенно лучшую производительность по памяти и времени.
Создаёт новый объект Character, представляющий указанное значение char.
Параметры:
value - значение, которое должен представлять объект Character.

Подробное описание методов

describeConstable

public Optional<DynamicConstantDesc<Character>> describeConstable()
Возвращает Optional, содержащую номинальный дескриптор для данного экземпляра.
Определено в:
describeConstable в интерфейсе Constable
Возвращает:
объект Optional, описывающий экземпляр Character
Since:
15

valueOf

public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char. Если новый экземпляр Character не требуется, этот метод обычно предпочтительнее конструктора Character(char), так как он, вероятно, обеспечит существенно лучшую производительность по памяти и времени за счёт кеширования часто запрашиваемых значений. Этот метод всегда будет кешировать значения в диапазоне '\u0000' до '\u007F', включительно, и может кешировать другие значения за пределами этого диапазона.
Параметры:
c - значение типа char.
Возвращает:
экземпляр Character, представляющий c.
Since:
1.5

charValue

public char charValue()
Возвращает значение этого объекта Character.
Возвращает:
примитивное значение char, представленное этим объектом.

hashCode

public int hashCode()
Возвращает код хэша для этого объекта Character; равен результату вызова charValue().
Переопределяет:
hashCode в классе Object
Возвращает:
значение хэша для данного объекта Character
См. также:
  • Object.equals(java.lang.Object)
  • System.identityHashCode(java.lang.Object)

hashCode

public static int hashCode(char value)
Возвращает код хэша для значения char; совместимо с Character.hashCode().
Параметры:
value - Значение char, для которого требуется код хэша.
Возвращает:
значение хэша для данного значения char.
Since:
1.8

equals

public boolean equals(Object obj)
Сравнивает этот объект с заданным объектом. Результат true тогда и только тогда, когда аргумент не null и является объектом Character, представляющим то же значение char, что и этот объект.
Переопределяет:
equals в классе Object
Параметры:
obj - объект для сравнения.
Возвращает:
true если объекты одинаковы; false в противном случае.
См. также:
  • Object.hashCode()
  • HashMap

toString

public String toString()
Возвращает объект String, представляющий значение данного объекта Character. Результат — строка длиной 1, содержащая только примитивное значение char, представленное данным объектом Character.
Переопределяет:
toString в классе Object
Возвращает:
строковое представление этого объекта.

toString

public static String toString(char c)
Возвращает объект String, представляющий указанный символ char. Результат — строка длиной 1, состоящая только из указанного символа char.
Примечание API:
Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toString(int).
Параметры:
c - символ char, который нужно преобразовать
Возвращает:
строковое представление указанного символа char
Since:
1.4

toString

public static String toString(int codePoint)
Возвращает объект String, представляющий указанный символ (код Unicode). Результат — строка длиной 1 или 2, содержащая только указанный символ.
Параметры:
codePoint - код Unicode для преобразования
Возвращает:
строковое представление указанного символа
Исключения:
IllegalArgumentException - если указанное значение кода Unicode не является допустимым кодом Unicode.
Since:
11

isValidCodePoint

public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный код символа допустимым значением кода символа Unicode.
Параметры:
codePoint - код символа Unicode для проверки
Возвращает:
true если указанное значение кода символа находится в диапазоне от MIN_CODE_POINT до MAX_CODE_POINT включительно; false в противном случае.
Since:
1.5

isBmpCodePoint

public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Unicode) в основной многоязычной плоскости (BMP). Такие коды символов могут быть представлены с помощью одного char.
Параметры:
codePoint - символ (код Unicode) для проверки
Возвращает:
true если указанный код символа находится в диапазоне от MIN_VALUE до MAX_VALUE включительно; false в противном случае.
Since:
1.7

isSupplementaryCodePoint

public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Unicode) в диапазоне дополнительных символов.
Параметры:
codePoint - символ (код Unicode) для проверки
Возвращает:
true если указанный код символа находится в диапазоне от MIN_SUPPLEMENTARY_CODE_POINT до MAX_CODE_POINT включительно; false в противном случае.
Since:
1.5

isHighSurrogate

public static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char старшим суррогатным кодовым элементом (также известным как ведущий суррогатный кодовый элемент).

Такие значения сами по себе не представляют символов, а используются в представлении дополнительных символов в кодировке UTF-16.

Параметры:
ch - значение char для проверки.
Возвращает:
true если значение char находится в диапазоне от MIN_HIGH_SURROGATE до MAX_HIGH_SURROGATE включительно; false в противном случае.
Since:
1.5
См. также:
  • isLowSurrogate(char)
  • Character.UnicodeBlock.of(int)

isLowSurrogate

public static boolean isLowSurrogate(char ch)
Определяет, является ли заданное char значение кодовым элементом Unicode в нижнем диапазоне суррогатов (также известным как кодовый элемент в последовательности суррогатов).

Такие значения не представляют собой символы сами по себе, но используются для представления дополнительных символов в кодировке UTF-16.

Parameters:
ch - тестируемое char значение.
Returns:
true если char значение находится в диапазоне от MIN_LOW_SURROGATE до MAX_LOW_SURROGATE включительно; false в противном случае.
Since:
1.5
See Also:
  • isHighSurrogate(char)

isSurrogate

public static boolean isSurrogate(char ch)
Определяет, является ли заданное char значение кодовым элементом Unicode в диапазоне суррогатов.

Такие значения не представляют собой символы сами по себе, но используются для представления дополнительных символов в кодировке UTF-16.

Значение char является кодовым элементом суррогата тогда и только тогда, когда оно является либо кодовым элементом в нижнем диапазоне суррогатов, либо кодовым элементом в верхнем диапазоне суррогатов.

Parameters:
ch - тестируемое char значение.
Returns:
true если char значение находится в диапазоне от MIN_SURROGATE до MAX_SURROGATE включительно; false в противном случае.
Since:
1.7

isSurrogatePair

public static boolean isSurrogatePair(char high, char low)
Определяет, является ли заданная пара char значений допустимой парой суррогатов Unicode.

Этот метод эквивалентен выражению:


 isHighSurrogate(high) && isLowSurrogate(low)
 
Parameters:
high - значение кодового элемента в верхнем диапазоне суррогатов для проверки
low - значение кодового элемента в нижнем диапазоне суррогатов для проверки
Returns:
true если указанные значения кодовых элементов в верхнем и нижнем диапазонах суррогатов представляют собой допустимую пару суррогатов; false в противном случае.
Since:
1.5

charCount

public static int charCount(int codePoint)
Определяет количество char значений, необходимых для представления указанного символа (кодовой точки Unicode). Если указанный символ равен или больше 0x10000, то метод возвращает 2. В противном случае метод возвращает 1.

Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. Вызывающая сторона должна проверить значение символа с помощью isValidCodePoint, если это необходимо.

Parameters:
codePoint - символ (кодовая точка Unicode) для проверки.
Returns:
2, если символ является допустимым дополнительным символом; 1 в противном случае.
Since:
1.5
See Also:
  • isSupplementaryCodePoint(int)

toCodePoint

public static int toCodePoint(char high, char low)
Преобразует указанную пару суррогатов в значение дополнительной кодовой точки. Этот метод не проверяет указанную пару суррогатов. Вызывающая сторона должна проверить её с помощью isSurrogatePair, если это необходимо.
Parameters:
high - кодовый элемент в верхнем диапазоне суррогатов
low - кодовый элемент в нижнем диапазоне суррогатов
Returns:
дополнительная кодовая точка, составленная из указанной пары суррогатов.
Since:
1.5

codePointAt

public static int codePointAt(CharSequence seq, int index)
Возвращает кодовую точку по заданному индексу CharSequence. Если char значение по заданному индексу в CharSequence находится в диапазоне верхних суррогатов, следующий индекс меньше длины CharSequence, а char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.
Parameters:
seq - последовательность char значений (единиц кода Unicode)
index - индекс char значений (единиц кода Unicode) в seq для преобразования
Returns:
кодовая точка Unicode по заданному индексу
Throws:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если значение index отрицательно или не меньше seq.length().
Since:
1.5

codePointAt

public static int codePointAt(char[] a, int index)
Возвращает кодовую точку по заданному индексу массива char. Если char значение по заданному индексу в массиве char находится в диапазоне верхних суррогатов, следующий индекс меньше длины массива char, и char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.
Parameters:
a - массив char
index - индекс char значений (единиц кода Unicode) в массиве char для преобразования
Returns:
кодовая точка Unicode по заданному индексу
Throws:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если значение index отрицательно или не меньше длины массива char
Since:
1.5

codePointAt

public static int codePointAt(char[] a, int index, int limit)
Возвращает кодовую точку по заданному индексу массива char, где используются только элементы массива с index меньше limit. Если char значение по заданному индексу в массиве char находится в диапазоне верхних суррогатов, следующий индекс меньше limit, и char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.
Parameters:
a - массив char
index - индекс char значений (единиц кода Unicode) в массиве char для преобразования
limit - индекс после последнего элемента массива, который можно использовать в массиве char
Returns:
кодовая точка Unicode по заданному индексу
Throws:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index отрицательный или не меньше аргумента limit, или если аргумент limit отрицательный или больше длины массива char
Since:
1.5

codePointBefore

public static int codePointBefore(CharSequence seq, int index)
Возвращает кодовую точку, предшествующую заданному индексу CharSequence. Если char значение по (index - 1) в CharSequence находится в диапазоне нижних суррогатов, (index - 2) не отрицательное, и char значение по (index - 2) в CharSequence находится в диапазоне верхних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по (index - 1)
Parameters:
seq - экземпляр CharSequence
index - индекс, следующий за кодовой точкой, которая должна быть возвращена
Returns:
значение кодовой точки Unicode, предшествующее данному индексу.
Throws:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если аргумент index меньше 1 или больше seq.length().
Since:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index)
Возвращает кодовую точку, предшествующую заданному индексу массива char. Если char значение по (index - 1) в массиве char находится в диапазоне нижних суррогатов, (index - 2) не отрицательное, и char значение по (index - 2) в массиве char находится в диапазоне верхних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по (index - 1)
Parameters:
a - массив char
index - индекс, следующий за кодовой точкой, которая должна быть возвращена
Returns:
значение кодовой точки Unicode, предшествующее данному индексу.
Throws:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index меньше 1 или больше длины массива char
Since:
1.5

codePointBefore

public static int codePointBefore(char[] a, int index, int start)
Возвращает код символа, предшествующий заданному индексу в массиве char, где используются только элементы массива с индексом, не меньшим start. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатных символов, (index - 2) не меньше start, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатных символов, то возвращается дополнительный код символа, соответствующий этой паре суррогатных символов. В противном случае возвращается значение char по индексу (index - 1).
Параметры:
a - массив char
index - индекс, следующий за кодом символа, который должен быть возвращён
start - индекс первого элемента массива char
Возвращает:
значение кода Юникода символа, предшествующего заданному индексу.
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если аргумент index не больше аргумента start или больше длины массива char, или если аргумент start отрицательный или не меньше длины массива char.
С тех пор:
1.5

highSurrogate

public static char highSurrogate(int codePoint)
Возвращает ведущий суррогатный символ (единицу кода высокого суррогата) пары суррогатных символов, представляющих указанный дополнительный символ (код Юникода) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение.

Если isSupplementaryCodePoint(x) равно true, тогда isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда равны true.

Параметры:
codePoint - дополнительный символ (код Юникода)
Возвращает:
ведущая единица кода суррогатного символа, используемая для представления символа в кодировке UTF-16
С тех пор:
1.7

lowSurrogate

public static char lowSurrogate(int codePoint)
Возвращает заключительный суррогатный символ (единицу кода низкого суррогата) пары суррогатных символов, представляющих указанный дополнительный символ (код Юникода) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение.

Если isSupplementaryCodePoint(x) равно true, тогда isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда равны true.

Параметры:
codePoint - дополнительный символ (код Юникода)
Возвращает:
заключительная единица кода суррогатного символа, используемая для представления символа в кодировке UTF-16
С тех пор:
1.7

toChars

public static int toChars(int codePoint, char[] dst, int dstIndex)
Преобразует указанный символ (код Юникода) в его представление UTF-16. Если указанный код символа является значением BMP (основной многоязычной плоскости или плоскости 0), то это же значение хранится в dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогатных символов хранятся в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.
Параметры:
codePoint - символ (код Юникода), который необходимо преобразовать.
dst - массив символов, в который сохраняется значение UTF-16 символа.
dstIndex - начальный индекс в массиве dst, где хранится преобразованное значение.
Возвращает:
1, если код символа является кодом символа BMP, 2, если код символа является дополнительным кодом символа.
Исключения:
IllegalArgumentException - если указанный codePoint не является допустимым кодом Юникода.
NullPointerException - если указанный dst равен null.
IndexOutOfBoundsException - если dstIndex отрицательный или не меньше dst.length, или если в массиве dst по индексу dstIndex недостаточно места для хранения полученного значения char. (Если dstIndex равно dst.length-1, а указанный codePoint является дополнительным символом, значение высокого суррогата не хранится в dst[dstIndex].)
С тех пор:
1.5

toChars

public static char[] toChars(int codePoint)
Преобразует указанный символ (код Юникода) в его представление UTF-16, хранящееся в массиве char. Если указанный код символа является значением BMP (основной многоязычной плоскости или плоскости 0), то результирующий массив char имеет то же значение, что и codePoint. Если указанный код символа является дополнительным кодом символа, результирующий массив char содержит соответствующую пару суррогатных символов.
Параметры:
codePoint - код Юникода символа
Возвращает:
массив char, содержащий представление codePoint в UTF-16.
Исключения:
IllegalArgumentException - если указанный codePoint не является допустимым кодом Юникода.
С тех пор:
1.5

codePointCount

public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
Возвращает количество символов Юникода в заданном диапазоне текста указанной последовательности символов. Диапазон текста начинается с указанного beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина (в символах) диапазона текста равна endIndex-beginIndex. Непарные суррогатные символы в диапазоне текста учитываются как по одному символу каждый.
Параметры:
seq - последовательность символов
beginIndex - индекс первого символа диапазона текста.
endIndex - индекс после последнего символа диапазона текста.
Возвращает:
количество символов Юникода в заданном диапазоне текста
Исключения:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если beginIndex отрицательный, или endIndex больше длины заданной последовательности, или beginIndex больше endIndex.
С тех пор:
1.5

codePointCount

public static int codePointCount(char[] a, int offset, int count)
Возвращает количество символов Юникода в подмассиве аргумента массива char. Аргумент offset — индекс первого символа подмассива, а аргумент count задаёт длину подмассива в символах. Непарные суррогатные символы в подмассиве учитываются как по одному символу каждый.
Параметры:
a - массив char
offset - индекс первого символа в заданном массиве char
count - длина подмассива в символах
Возвращает:
количество символов Юникода в заданном подмассиве
Исключения:
NullPointerException - если a равно null.
IndexOutOfBoundsException - если offset или count отрицательны, или если offset + count больше длины заданного массива.
С тех пор:
1.5

offsetByCodePoints

public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
Возвращает индекс в заданной последовательности символов, который смещён от заданного index на codePointOffset символов. Непарные суррогатные символы в диапазоне текста, заданном index и codePointOffset, учитываются как по одному символу каждый.
Параметры:
seq - последовательность символов
index - индекс, который необходимо сместить
codePointOffset - смещение в символах
Возвращает:
индекс в последовательности символов
Исключения:
NullPointerException - если seq равно null.
IndexOutOfBoundsException - если index отрицательный или больше длины последовательности символов, или если codePointOffset положительный и подпоследовательность, начинающаяся с index, содержит меньше чем codePointOffset символов, или если codePointOffset отрицательный и подпоследовательность перед index содержит меньше, чем абсолютное значение codePointOffset символов.
С тех пор:
1.5

offsetByCodePoints

public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
Возвращает индекс в заданном char подмассиве, смещённый от заданного index на codePointOffset кодовые точки. Аргументы start и count определяют подмассив массива char. Неспаренные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются по одной кодовой точке каждый.
Parameters:
a - массив char
start - индекс первой char подмассива
count - длина подмассива в char
index - индекс, который необходимо сместить
codePointOffset - смещение в кодовых точках
Returns:
индекс в подмассиве
Throws:
NullPointerException - если a null.
IndexOutOfBoundsException - если start или count отрицательны, или если start + count больше длины заданного массива, или если index меньше start или больше start + count, или если codePointOffset положительно, и диапазон текста, начинающийся с index и заканчивающийся start + count - 1, содержит меньше codePointOffset кодовых точек, или если codePointOffset отрицательно, и диапазон текста, начинающийся с start и заканчивающийся index - 1, содержит меньше абсолютного значения codePointOffset кодовых точек.
Since:
1.5

isLowerCase

public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчной буквой.

Символ является строчным, если его тип общей категории, предоставляемый Character.getType(ch), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.

Вот примеры строчных символов:

 a b c d e f g h i j k l m n o p q r s t u v w x y z
 '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
 '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
 '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
 '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
 

Многие другие символы Unicode также являются строчными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).

Parameters:
ch - символ, который необходимо проверить.
Returns:
true , если символ является строчной буквой; false в противном случае.
See Also:
  • isLowerCase(char)
  • isTitleCase(char)
  • toLowerCase(char)
  • getType(char)

isLowerCase

public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) строчной буквой.

Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.

Вот примеры строчных символов:

 a b c d e f g h i j k l m n o p q r s t u v w x y z
 '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6'
 '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE'
 '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6'
 '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
 

Многие другие символы Unicode также являются строчными.

Parameters:
codePoint - символ (кодовая точка Unicode) для проверки.
Returns:
true если символ является строчной буквой; false в противном случае.
Since:
1.5
See Also:
  • isLowerCase(int)
  • isTitleCase(int)
  • toLowerCase(int)
  • getType(int)

isUpperCase

public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ заглавной буквой.

Символ является заглавным, если его тип общей категории, предоставляемый Character.getType(ch), равен UPPERCASE_LETTER. или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.

Вот примеры заглавных символов:

 A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
 '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
 '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
 '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
 '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
 

Многие другие символы Unicode также являются заглавными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isUpperCase(int).

Parameters:
ch - символ для проверки.
Returns:
true если символ является заглавной буквой; false в противном случае.
Since:
1.0
See Also:
  • isLowerCase(char)
  • isTitleCase(char)
  • toUpperCase(char)
  • getType(char)

isUpperCase

public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) заглавной буквой.

Символ является заглавным, если его тип общей категории, предоставляемый getType(codePoint), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.

Вот примеры заглавных символов:

 A B C D E F G H I J K L M N O P Q R S T U V W X Y Z
 '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7'
 '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF'
 '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8'
 '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
 

Многие другие символы Unicode также являются заглавными.

Parameters:
codePoint - символ (кодовая точка Unicode) для проверки.
Returns:
true если символ является заглавной буквой; false в противном случае.
Since:
1.5
See Also:
  • isLowerCase(int)
  • isTitleCase(int)
  • toUpperCase(int)
  • getType(int)

isTitleCase

public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ буквой в стиле заголовка.

Символ является буквой в стиле заголовка, если его тип общей категории, предоставляемый Character.getType(ch), равен TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с прописными начальными буквами, как в названии книги.

Вот некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются буквами в стиле заголовка.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isTitleCase(int).

Parameters:
ch - символ для проверки.
Returns:
true если символ является буквой в стиле заголовка; false в противном случае.
Since:
1.0.2
See Also:
  • isLowerCase(char)
  • isUpperCase(char)
  • toTitleCase(char)
  • getType(char)

isTitleCase

public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) буквой в стиле заголовка.

Символ является буквой в стиле заголовка, если его тип общей категории, предоставляемый getType(codePoint), равен TITLECASE_LETTER.

Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с прописными начальными буквами, как в названии книги.

Вот некоторые символы Unicode, для которых этот метод возвращает true:

  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON
  • LATIN CAPITAL LETTER L WITH SMALL LETTER J
  • LATIN CAPITAL LETTER N WITH SMALL LETTER J
  • LATIN CAPITAL LETTER D WITH SMALL LETTER Z

Многие другие символы Unicode также являются буквами в стиле заголовка.

Parameters:
codePoint - символ (кодовая точка Unicode) для проверки.
Returns:
true если символ является буквой в стиле заголовка; false в противном случае.
Since:
1.5
See Also:
  • isLowerCase(int)
  • isUpperCase(int)
  • toTitleCase(int)
  • getType(int)

isDigit

public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.

Символ является цифрой, если его тип общей категории, предоставленный Character.getType(ch), равен DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Юникода, содержащие цифры:

  • '\u0030' по '\u0039', цифры ISO-LATIN-1 ('0' по '9')
  • '\u0660' по '\u0669', арабско-индийские цифры
  • '\u06F0' по '\u06F9', расширенные арабско-индийские цифры
  • '\u0966' по '\u096F', цифры деванагари
  • '\uFF10' по '\uFF19', цифры с полным шириной
Многие другие диапазоны символов также содержат цифры.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDigit(int).

Параметры:
ch - символ, который необходимо проверить.
Возвращает:
true если символ является цифрой; false в противном случае.
См. также:
  • digit(char, int)
  • forDigit(int, int)
  • getType(char)

isDigit

public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) цифрой.

Символ является цифрой, если его тип общей категории, предоставленный getType(codePoint), равен DECIMAL_DIGIT_NUMBER.

Некоторые диапазоны символов Юникода, содержащие цифры:

  • '\u0030' по '\u0039', цифры ISO-LATIN-1 ('0' по '9')
  • '\u0660' по '\u0669', арабско-индийские цифры
  • '\u06F0' по '\u06F9', расширенные арабско-индийские цифры
  • '\u0966' по '\u096F', цифры деванагари
  • '\uFF10' по '\uFF19', цифры с полным шириной
Многие другие диапазоны символов также содержат цифры.
Параметры:
codePoint - символ (код Юникода) для проверки.
Возвращает:
true если символ является цифрой; false в противном случае.
С:
1.5
См. также:
  • forDigit(int, int)
  • getType(int)

isDefined

public static boolean isDefined(char ch)
Определяет, определен ли символ в Юникоде.

Символ определен, если хотя бы одно из следующих условий истинно:

  • У него есть запись в файле UnicodeData.
  • У него есть значение в диапазоне, определенном файлом UnicodeData.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDefined(int).

Параметры:
ch - символ, который нужно проверить
Возвращает:
true если символ имеет определенное значение в Юникоде; false в противном случае.
С:
1.0.2
См. также:
  • isDigit(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUpperCase(char)

isDefined

public static boolean isDefined(int codePoint)
Определяет, определен ли символ (код Юникода) в Юникоде.

Символ определен, если хотя бы одно из следующих условий истинно:

  • У него есть запись в файле UnicodeData.
  • У него есть значение в диапазоне, определенном файлом UnicodeData.
Параметры:
codePoint - символ (код Юникода) для проверки.
Возвращает:
true если символ имеет определенное значение в Юникоде; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isLetter(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUpperCase(int)

isLetter

public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.

Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), равен одному из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не являются заглавными, строчными или прописными.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetter(int).

Параметры:
ch - символ для проверки.
Возвращает:
true если символ является буквой; false в противном случае.
См. также:
  • isDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetterOrDigit(char)
  • isLowerCase(char)
  • isTitleCase(char)
  • isUnicodeIdentifierStart(char)
  • isUpperCase(char)

isLetter

public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (код Юникода) буквой.

Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), равен одному из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
Не все буквы имеют регистр. Многие символы являются буквами, но не являются заглавными, строчными или прописными.
Параметры:
codePoint - символ (код Юникода) для проверки.
Возвращает:
true если символ является буквой; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isLowerCase(int)
  • isTitleCase(int)
  • isUnicodeIdentifierStart(int)
  • isUpperCase(int)

isLetterOrDigit

public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.

Символ считается буквой или цифрой, если либо Character.isLetter(char ch) или Character.isDigit(char ch) возвращают true для символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetterOrDigit(int).

Параметры:
ch - символ для проверки.
Возвращает:
true если символ является буквой или цифрой; false в противном случае.
С:
1.0.2
См. также:
  • isDigit(char)
  • isJavaIdentifierPart(char)
  • isJavaLetter(char)
  • isJavaLetterOrDigit(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isLetterOrDigit

public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) буквой или цифрой.

Символ считается буквой или цифрой, если либо isLetter(codePoint) или isDigit(codePoint) возвращает true для символа.

Параметры:
codePoint - символ (код Юникода) для проверки.
Возвращает:
true если символ является буквой или цифрой; false в противном случае.
С:
1.5
См. также:
  • isDigit(int)
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isJavaLetter

@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Устаревшее.
Заменено на isJavaIdentifierStart(char).
Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Java.

Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является символом соединительной пунктуации (например, '_').
Parameters:
ch - символ, подлежащий проверке.
Returns:
true , если символ может начинать идентификатор Java; false в противном случае.
Since:
1.0.2
See Also:
  • isJavaLetterOrDigit(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isJavaLetterOrDigit

@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Устаревшее.
Заменено на isJavaIdentifierPart(char).
Определяет, может ли указанный символ быть частью идентификатора Java, не являясь первым символом.

Символ может быть частью идентификатора Java, если выполняется одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный знак
  • isIdentifierIgnorable возвращает true для символа.
Parameters:
ch - символ, подлежащий проверке.
Returns:
true , если символ может быть частью идентификатора Java; false в противном случае.
Since:
1.0.2
See Also:
  • isJavaLetter(char)
  • isJavaIdentifierStart(char)
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • isIdentifierIgnorable(char)

isAlphabetic

public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквенным.

Символ считается буквенным, если его тип общей категории, предоставляемый getType(codePoint), является любым из следующих:

  • UPPERCASE_LETTER
  • LOWERCASE_LETTER
  • TITLECASE_LETTER
  • MODIFIER_LETTER
  • OTHER_LETTER
  • LETTER_NUMBER
или же он имеет вспомогательное свойство Other_Alphabetic, как определено в стандарте Юникод.
Parameters:
codePoint - символ (кодовый пункт Юникода), подлежащий проверке.
Returns:
true , если символ является символом алфавита Юникода, false в противном случае.
Since:
1.7

isIdeographic

public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) идеограммой CJKV (китайской, японской, корейской и вьетнамской), как определено в стандарте Юникод.
Parameters:
codePoint - символ (кодовый пункт Юникода), подлежащий проверке.
Returns:
true , если символ является символом идеограммы Юникода, false в противном случае.
Since:
1.7

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(char ch)
Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Java.

Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER
  • ch является символом валюты (например, '$')
  • ch является символом соединительной пунктуации (например, '_')

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).

Parameters:
ch - символ, подлежащий проверке.
Returns:
true , если символ может начинать идентификатор Java; false в противном случае.
Since:
1.1
See Also:
  • isJavaIdentifierPart(char)
  • isLetter(char)
  • isUnicodeIdentifierStart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierStart

public static boolean isJavaIdentifierStart(int codePoint)
Определяет, может ли символ (кодовый пункт Юникода) быть первым символом в идентификаторе Java.

Символ может начинать идентификатор Java, если выполняется одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER
  • ссылка на символ — это символ валюты (например, '$')
  • ссылка на символ — это символ соединительной пунктуации (например, '_')
Parameters:
codePoint - символ (кодовый пункт Юникода), подлежащий проверке.
Returns:
true , если символ может начинать идентификатор Java; false в противном случае.
Since:
1.5
See Also:
  • isJavaIdentifierPart(int)
  • isLetter(int)
  • isUnicodeIdentifierStart(int)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, не являясь первым символом.

Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ соединительной пунктуации (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это диакритический знак
  • это неразрывный знак
  • isIdentifierIgnorable возвращает true для символа

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).

Parameters:
ch - символ, подлежащий проверке.
Returns:
true , если символ может быть частью идентификатора Java; false в противном случае.
Since:
1.1
See Also:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierStart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierPart(char)
  • SourceVersion.isIdentifier(CharSequence)

isJavaIdentifierPart

public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (кодовое значение Юникода) быть частью идентификатора Java, кроме первого символа.

Символ может быть частью идентификатора Java, если выполняется хотя бы одно из следующих условий:

  • это буква
  • это символ валюты (например, '$')
  • это символ пунктуации соединения (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это комбинированный знак
  • это знак без пробела
  • isIdentifierIgnorable(codePoint) возвращает true для кодового значения.
Parameters:
codePoint - тестируемый символ (кодовое значение Юникода).
Returns:
true если символ может быть частью идентификатора Java; false в противном случае.
Since:
1.5
See Also:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierStart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierPart(int)
  • SourceVersion.isIdentifier(CharSequence)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(char ch)
Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Юникода.

Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:

  • isLetter(ch) возвращает true
  • getType(ch) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:

 Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
 
'VERTICAL TILDE' добавлен к Start для обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).

Parameters:
ch - символ для проверки.
Returns:
true если символ может начинать идентификатор Юникода; false в противном случае.
Since:
1.1
See Also:
  • isJavaIdentifierStart(char)
  • isLetter(char)
  • isUnicodeIdentifierPart(char)

isUnicodeIdentifierStart

public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, разрешен ли указанный символ (кодовое значение Юникода) в качестве первого символа в идентификаторе Юникода.

Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:

  • isLetter(codePoint) возвращает true
  • getType(codePoint) возвращает LETTER_NUMBER.
  • это символ Other_ID_Start.

Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:

 Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
 
'VERTICAL TILDE' добавлен к Start для обратной совместимости.
Parameters:
codePoint - символ (кодовое значение Юникода) для проверки.
Returns:
true если символ может начинать идентификатор Юникода; false в противном случае.
Since:
1.5
See Also:
  • isJavaIdentifierStart(int)
  • isLetter(int)
  • isUnicodeIdentifierPart(int)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа.

Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:

  • это буква
  • это символ пунктуации соединения (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это комбинированный знак
  • это знак без пробела
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:

 Continue := Start + ID_Continue + ignorable
 Medial := empty
 ignorable := isIdentifierIgnorable(char) returns true for the character
 
ignorable добавлен к Continue для обратной совместимости.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).

Parameters:
ch - символ для проверки.
Returns:
true если символ может быть частью идентификатора Юникода; false в противном случае.
Since:
1.1
See Also:
  • isIdentifierIgnorable(char)
  • isJavaIdentifierPart(char)
  • isLetterOrDigit(char)
  • isUnicodeIdentifierStart(char)

isUnicodeIdentifierPart

public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (кодовое значение Юникода) быть частью идентификатора Юникода, кроме первого символа.

Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:

  • это буква
  • это символ пунктуации соединения (например, '_')
  • это цифра
  • это цифровая буква (например, символ римской цифры)
  • это комбинированный знак
  • это знак без пробела
  • isIdentifierIgnorable возвращает true для этого символа.
  • это символ Other_ID_Start.
  • это символ Other_ID_Continue.

Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:

 Continue := Start + ID_Continue + ignorable
 Medial := empty
 ignorable := isIdentifierIgnorable(int) returns true for the character
 
ignorable добавлен к Continue для обратной совместимости.
Parameters:
codePoint - символ (кодовое значение Юникода) для проверки.
Returns:
true если символ может быть частью идентификатора Юникода; false в противном случае.
Since:
1.5
See Also:
  • isIdentifierIgnorable(int)
  • isJavaIdentifierPart(int)
  • isLetterOrDigit(int)
  • isUnicodeIdentifierStart(int)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(char ch)
Определяет, должен ли указанный символ рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Юникода.

Следующие символы Юникода игнорируются в идентификаторе Java или идентификаторе Юникода:

  • Управляющие символы ISO, которые не являются пробелами
    • '\u0000' по '\u0008'
    • '\u000E' по '\u001B'
    • '\u007F' по '\u009F'
  • все символы, имеющие значение FORMAT общей категории

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).

Parameters:
ch - символ для проверки.
Returns:
true если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Юникода; false в противном случае.
Since:
1.1
See Also:
  • isJavaIdentifierPart(char)
  • isUnicodeIdentifierPart(char)

isIdentifierIgnorable

public static boolean isIdentifierIgnorable(int codePoint)
Определяет, следует ли рассматривать указанный символ (код Юникода) как игнорируемый символ в идентификаторе Java или Юникода.

Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:

  • Символы управления ISO, которые не являются пробелами
    • '\u0000' по '\u0008'
    • '\u000E' по '\u001B'
    • '\u007F' по '\u009F'
  • Все символы, имеющие значение общей категории FORMAT
Parameters:
codePoint - символ (код Юникода) для проверки.
Returns:
true , если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Юникода; false в противном случае.
Since:
1.5
See Also:
  • isJavaIdentifierPart(int)
  • isUnicodeIdentifierPart(int)

toLowerCase

public static char toLowerCase(char ch)
Преобразует символ-аргумент в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toLowerCase(int).

Parameters:
ch - символ для преобразования.
Returns:
эквивалент символа в нижнем регистре, если он есть; в противном случае сам символ.
See Also:
  • isLowerCase(char)
  • String.toLowerCase()

toLowerCase

public static int toLowerCase(int codePoint)
Преобразует символ (код Юникода)-аргумент в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.

Parameters:
codePoint - символ (код Юникода) для преобразования.
Returns:
эквивалент символа (код Юникода) в нижнем регистре, если он есть; в противном случае сам символ.
Since:
1.5
See Also:
  • isLowerCase(int)
  • String.toLowerCase()

toUpperCase

public static char toUpperCase(char ch)
Преобразует символ-аргумент в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).

Parameters:
ch - символ для преобразования.
Returns:
эквивалент символа в верхнем регистре, если он есть; в противном случае сам символ.
See Also:
  • isUpperCase(char)
  • String.toUpperCase()

toUpperCase

public static int toUpperCase(int codePoint)
Преобразует символ (код Юникода)-аргумент в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData.

Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.

В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.

Parameters:
codePoint - символ (код Юникода) для преобразования.
Returns:
эквивалент символа в верхнем регистре, если он есть; в противном случае сам символ.
Since:
1.5
See Also:
  • isUpperCase(int)
  • String.toUpperCase()

toTitleCase

public static char toTitleCase(char ch)
Преобразует символ-аргумент в заглавный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа нет явного сопоставления в заглавном регистре и сам символ не является символом заглавного регистра согласно UnicodeData, то возвращается сопоставление в верхнем регистре в качестве эквивалентного сопоставления в заглавном регистре. Если символ-аргумент char уже является заглавным регистром char, возвращается то же самое значение char.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).

Parameters:
ch - символ для преобразования.
Returns:
эквивалент символа в заглавном регистре, если он есть; в противном случае сам символ.
Since:
1.0.2
See Also:
  • isTitleCase(char)
  • toLowerCase(char)
  • toUpperCase(char)

toTitleCase

public static int toTitleCase(int codePoint)
Преобразует символ (код Юникода)-аргумент в заглавный регистр, используя сведения о преобразовании регистра из файла UnicodeData. Если для символа нет явного сопоставления в заглавном регистре и сам символ не является символом заглавного регистра согласно UnicodeData, то возвращается сопоставление в верхнем регистре в качестве эквивалентного сопоставления в заглавном регистре. Если символ-аргумент уже является символом заглавного регистра, то возвращается то же значение.

Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.

Parameters:
codePoint - символ (код Юникода) для преобразования.
Returns:
эквивалент символа в заглавном регистре, если он есть; в противном случае сам символ.
Since:
1.5
See Also:
  • isTitleCase(int)
  • toLowerCase(int)
  • toUpperCase(int)

digit

public static int digit(char ch, int radix)
Возвращает числовое значение символа ch в указанном радиксе.

Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:

  • Метод isDigit возвращает true для символа, и десятичное значение символа Unicode (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', и его код меньше radix + 'A' - 10. В этом случае возвращается ch - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', и его код меньше radix + 'a' - 10. В этом случае возвращается ch - 'a' + 10.
  • Символ является одной из заглавных латинских букв в полном формате от A ('\uFF21') до Z ('\uFF3A'), и его код меньше radix + '\uFF21' - 10. В этом случае возвращается ch - '\uFF21' + 10.
  • Символ является одной из строчных латинских букв в полном формате от a ('\uFF41') до z ('\uFF5A'), и его код меньше radix + '\uFF41' - 10. В этом случае возвращается ch - '\uFF41' + 10.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).

Параметры:
ch - символ, который нужно преобразовать.
radix - радикс.
Возвращает:
числовое значение, представленное символом в указанном радиксе.
См. также:
  • forDigit(int, int)
  • isDigit(char)

digit

public static int digit(int codePoint, int radix)
Возвращает числовое значение указанного символа (кода Unicode) в указанном радиксе.

Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:

  • Метод isDigit(codePoint) возвращает true для символа, и десятичное значение символа Unicode (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры.
  • Символ является одной из заглавных латинских букв от 'A' до 'Z', и его код меньше radix + 'A' - 10. В этом случае возвращается codePoint - 'A' + 10.
  • Символ является одной из строчных латинских букв от 'a' до 'z', и его код меньше radix + 'a' - 10. В этом случае возвращается codePoint - 'a' + 10.
  • Символ является одной из заглавных латинских букв в полном формате от A ('\uFF21') до Z ('\uFF3A'), и его код меньше radix + '\uFF21' - 10. В этом случае возвращается codePoint - '\uFF21' + 10.
  • Символ является одной из строчных латинских букв в полном формате от a ('\uFF41') до z ('\uFF5A'), и его код меньше radix + '\uFF41'- 10. В этом случае возвращается codePoint - '\uFF41' + 10.
Параметры:
codePoint - символ (код Unicode) для преобразования.
radix - радикс.
Возвращает:
числовое значение, представленное символом в указанном радиксе.
С:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

getNumericValue

public static int getNumericValue(char ch)
Возвращает числовое значение, представленное указанным символом Unicode. Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.

Буквы A-Z в их заглавном ('\u0041' через '\u005A'), строчном ('\u0061' через '\u007A') и полном формате ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим char значениям.

Если у символа нет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).

Параметры:
ch - символ для преобразования.
Возвращает:
числовое значение символа, как неотрицательное int значение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательное int значение; -1, если у символа нет числового значения.
С:
1.1
См. также:
  • forDigit(int, int)
  • isDigit(char)

getNumericValue

public static int getNumericValue(int codePoint)
Возвращает числовое значение, представленное указанным символом (кодом Unicode). Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.

Буквы A-Z в их заглавном ('\u0041' через '\u005A'), строчном ('\u0061' через '\u007A') и полном формате ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим char значениям.

Если у символа нет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.

Параметры:
codePoint - символ (код Unicode) для преобразования.
Возвращает:
числовое значение символа, как неотрицательное int значение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательное int значение; -1, если у символа нет числового значения.
С:
1.5
См. также:
  • forDigit(int, int)
  • isDigit(int)

isSpace

@Deprecated(since="1.1") public static boolean isSpace(char ch)
Устарело.
Заменено на isWhitespace(char).
Определяет, является ли указанный символ пробелом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
truechars
Символ Код Название
'\t' U+0009 HORIZONTAL TABULATION
'\n' U+000A NEW LINE
'\f' U+000C FORM FEED
'\r' U+000D CARRIAGE RETURN
' ' U+0020 SPACE
Параметры:
ch - символ для проверки.
Возвращает:
true , если символ является пробелом ISO-LATIN-1; false в противном случае.
См. также:
  • isSpaceChar(char)
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом-пробелом Unicode. Символ считается символом-пробелом, если и только если это указано в стандарте Unicode. Этот метод возвращает true, если тип общей категории символа — любой из следующих:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).

Параметры:
ch - символ для проверки.
Возвращает:
true , если символ является символом-пробелом; false в противном случае.
С:
1.1
См. также:
  • isWhitespace(char)

isSpaceChar

public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом пробела Юникода. Символ считается символом пробела только в том случае, если он указан как символ пробела в стандарте Юникод. Этот метод возвращает true, если тип общей категории символа — любой из следующих:
  • SPACE_SEPARATOR
  • LINE_SEPARATOR
  • PARAGRAPH_SEPARATOR
Parameters:
codePoint - символ (код точки Юникода), который нужно проверить.
Returns:
true если символ является символом пробела; false в противном случае.
Since:
1.5
See Also:
  • isWhitespace(int)

isWhitespace

public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ символом пробела согласно Java. Символ является символом пробела Java только в том случае, если он удовлетворяет одному из следующих критериев:
  • Он является символом пробела Юникода (SPACE_SEPARATOR, LINE_SEPARATOR, или PARAGRAPH_SEPARATOR) но не является также символом неразрывного пробела ('\u00A0', '\u2007', '\u202F').
  • Он равен '\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\n', U+000A ПЕРЕВОД СТРОКИ.
  • Он равен '\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\f', U+000C ПЕРЕВОД СТРАНИЦЫ.
  • Он равен '\r', U+000D ВОЗВРАТ КАРЕТКИ.
  • Он равен '\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ.
  • Он равен '\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП.
  • Он равен '\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ.
  • Он равен '\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isWhitespace(int).

Parameters:
ch - символ, который нужно проверить.
Returns:
true если символ является символом пробела Java; false в противном случае.
Since:
1.1
See Also:
  • isSpaceChar(char)

isWhitespace

public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом пробела согласно Java. Символ является символом пробела Java только в том случае, если он удовлетворяет одному из следующих критериев:
  • Он является символом пробела Юникода (SPACE_SEPARATOR, LINE_SEPARATOR, или PARAGRAPH_SEPARATOR) но не является также символом неразрывного пробела ('\u00A0', '\u2007', '\u202F').
  • Он равен '\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\n', U+000A ПЕРЕВОД СТРОКИ.
  • Он равен '\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ.
  • Он равен '\f', U+000C ПЕРЕВОД СТРАНИЦЫ.
  • Он равен '\r', U+000D ВОЗВРАТ КАРЕТКИ.
  • Он равен '\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ.
  • Он равен '\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП.
  • Он равен '\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ.
  • Он равен '\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Parameters:
codePoint - символ (код точки Юникода), который нужно проверить.
Returns:
true если символ является символом пробела Java; false в противном случае.
Since:
1.5
See Also:
  • isSpaceChar(int)

isISOControl

public static boolean isISOControl(char ch)
Определяет, является ли указанный символ символом управления ISO. Символ считается символом управления ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isISOControl(int).

Parameters:
ch - символ, который нужно проверить.
Returns:
true если символ является символом управления ISO; false в противном случае.
Since:
1.1
See Also:
  • isSpaceChar(char)
  • isWhitespace(char)

isISOControl

public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) символом управления ISO. Символ считается символом управления ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.
Parameters:
codePoint - символ (код точки Юникода), который нужно проверить.
Returns:
true если символ является символом управления ISO; false в противном случае.
Since:
1.5
See Also:
  • isSpaceChar(int)
  • isWhitespace(int)

getType

public static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getType(int).

Parameters:
ch - символ, который нужно проверить.
Returns:
значение типа int , представляющее общую категорию символа.
Since:
1.1
See Also:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

getType

public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
Параметры:
codePoint - символ (кодовый пункт Юникода) для проверки.
Возвращает:
значение типа int , представляющее общую категорию символа.
С момента:
1.5
См. также:
  • COMBINING_SPACING_MARK
  • CONNECTOR_PUNCTUATION
  • CONTROL
  • CURRENCY_SYMBOL
  • DASH_PUNCTUATION
  • DECIMAL_DIGIT_NUMBER
  • ENCLOSING_MARK
  • END_PUNCTUATION
  • FINAL_QUOTE_PUNCTUATION
  • FORMAT
  • INITIAL_QUOTE_PUNCTUATION
  • LETTER_NUMBER
  • LINE_SEPARATOR
  • LOWERCASE_LETTER
  • MATH_SYMBOL
  • MODIFIER_LETTER
  • MODIFIER_SYMBOL
  • NON_SPACING_MARK
  • OTHER_LETTER
  • OTHER_NUMBER
  • OTHER_PUNCTUATION
  • OTHER_SYMBOL
  • PARAGRAPH_SEPARATOR
  • PRIVATE_USE
  • SPACE_SEPARATOR
  • START_PUNCTUATION
  • SURROGATE
  • TITLECASE_LETTER
  • UNASSIGNED
  • UPPERCASE_LETTER

forDigit

public static char forDigit(int digit, int radix)
Определяет представление символа для конкретной цифры в заданном радиксе. Если значение radix не является допустимым радиксом, или значение digit не является допустимой цифрой в заданном радиксе, возвращается нулевой символ ('\u0000').

Аргумент radix является допустимым, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit является допустимым, если 0 <= digit < radix.

Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.

Параметры:
digit - число для преобразования в символ.
radix - радикс.
Возвращает:
представление символа заданной цифры в заданном радиксе.
См. также:
  • MIN_RADIX
  • MAX_RADIX
  • digit(char, int)

getDirectionality

public static byte getDirectionality(char ch)
Возвращает свойство направленности Юникода для данного символа. Направленность символа используется для вычисления визуального порядка текста. Значение направленности для неопределенных char значений равно DIRECTIONALITY_UNDEFINED.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getDirectionality(int).

Параметры:
ch - char, для которого запрашивается свойство направленности.
Возвращает:
свойство направленности значения char.
С момента:
1.4
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

getDirectionality

public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Юникода для данного символа (кодовый пункт Юникода). Направленность символа используется для вычисления визуального порядка текста. Значение направленности для неопределенного символа равно DIRECTIONALITY_UNDEFINED.
Параметры:
codePoint - символ (кодовый пункт Юникода) для которого запрашивается свойство направленности.
Возвращает:
свойство направленности символа.
С момента:
1.5
См. также:
  • DIRECTIONALITY_UNDEFINED
  • DIRECTIONALITY_LEFT_TO_RIGHT
  • DIRECTIONALITY_RIGHT_TO_LEFT
  • DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
  • DIRECTIONALITY_EUROPEAN_NUMBER
  • DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
  • DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
  • DIRECTIONALITY_ARABIC_NUMBER
  • DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
  • DIRECTIONALITY_NONSPACING_MARK
  • DIRECTIONALITY_BOUNDARY_NEUTRAL
  • DIRECTIONALITY_PARAGRAPH_SEPARATOR
  • DIRECTIONALITY_SEGMENT_SEPARATOR
  • DIRECTIONALITY_WHITESPACE
  • DIRECTIONALITY_OTHER_NEUTRALS
  • DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
  • DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
  • DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
  • DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
  • DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
  • DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
  • DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
  • DIRECTIONALITY_FIRST_STRONG_ISOLATE
  • DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE

isMirrored

public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. Зеркальные символы должны иметь свои глифы, отраженные по горизонтали, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА семантически определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.

Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).

Параметры:
ch - char, для которого запрашивается свойство зеркальности.
Возвращает:
true если символ зеркальный, false если символ не зеркальный или не определен.
С момента:
1.4

isMirrored

public static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) зеркальным в соответствии со спецификацией Юникода. Зеркальные символы должны иметь свои глифы, отраженные по горизонтали, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА семантически определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.
Параметры:
codePoint - символ (кодовый пункт Юникода) для проверки.
Возвращает:
true если символ зеркальный, false если символ не зеркальный или не определен.
С момента:
1.5

compareTo

public int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
Определено в:
compareTo в интерфейсе Comparable<Character>
Параметры:
anotherCharacter - объект Character для сравнения.
Возвращает:
значение 0, если переданный аргумент равен этому объекту; значение меньше 0, если этот объект численно меньше, чем переданный аргумент; и значение больше 0, если этот объект численно больше, чем переданный аргумент (без учёта знака). Обратите внимание, что это строго численное сравнение; оно не зависит от языка.
С:
1.2

compare

public static int compare(char x, char y)
Сравнивает два значения char численно. Возвращаемое значение идентично тому, что вернётся от:
    Character.valueOf(x).compareTo(Character.valueOf(y))
 
Параметры:
x - первое значение char для сравнения
y - второе значение char для сравнения
Возвращает:
значение 0, если значения равны; значение меньше 0, если первое значение меньше второго; и значение больше 0, если первое значение больше второго
С:
1.7

reverseBytes

public static char reverseBytes(char ch)
Возвращает значение, полученное путём изменения порядка байтов в указанном значении char.
Параметры:
ch - Значение char, для которого необходимо изменить порядок байтов.
Возвращает:
значение, полученное путём изменения (или, эквивалентно, перестановки) байтов в указанном значении char.
С:
1.5

getName

public static String getName(int codePoint)
Возвращает имя Unicode указанного символа char, или null, если код символа unassigned.

Примечание: если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), возвращаемое имя такое же, как результат выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Параметры:
codePoint - символ (код символа Unicode)
Возвращает:
имя Unicode указанного символа, или null, если коду символа не присвоено имя.
Исключения:
IllegalArgumentException - если указанный код символа не является допустимым кодом Unicode.
С:
1.7

codePointOf

public static int codePointOf(String name)
Возвращает значение кода символа Unicode, задаваемое заданным именем символа Unicode.

Примечание: если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), его имя определяется как результат выражения:

Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);

Сопоставление имен выполняется без учёта регистра, при этом любые начальные и конечные пробелы удаляются.

Параметры:
name - имя символа Unicode
Возвращает:
значение кода символа, заданного его именем.
Исключения:
IllegalArgumentException - если указанное имя символа не является допустимым именем символа Unicode.
NullPointerException - если name не null
С:
9

© 1993, 2021, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/17/docs/api/java.base/java/lang/Character.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API