Класс Character
- Все реализованные интерфейсы:
-
Serializable,Comparable<Character>,Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Character оборачивает значение примитивного типа char в объект. Объект класса Character содержит единственное поле типа char. Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.) и для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие Unicode
Поля и методы класса Character определяются на основе информации о символах из стандарта Unicode, конкретно файла UnicodeData, который входит в базу данных символов Unicode. Этот файл определяет свойства, включая имя и категорию для каждого присвоенного кодового значения Unicode или диапазона символов. Файл доступен в Консорциуме Unicode по адресу http://www.unicode.org.
Информация о символах основана на стандарте Unicode версии 13.0.
Java-платформа поддерживала различные версии стандарта Unicode на протяжении времени. Обновления до более новых версий стандарта Unicode произошли в следующих выпусках Java, каждый из которых указывает новую версию:
| Выпуск Java | Версия Unicode |
|---|---|
| Java SE 15 | Unicode 13.0 |
| Java SE 13 | Unicode 12.1 |
| Java SE 12 | Unicode 11.0 |
| Java SE 11 | Unicode 10.0 |
| Java SE 9 | Unicode 8.0 |
| Java SE 8 | Unicode 6.2 |
| Java SE 7 | Unicode 6.0 |
| Java SE 5.0 | Unicode 4.0 |
| Java SE 1.4 | Unicode 3.0 |
| JDK 1.1 | Unicode 2.0 |
| JDK 1.0.2 | Unicode 1.1.5 |
Представления символов Unicode
Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основаны на оригинальной спецификации Unicode, которая определяла символы как сущности фиксированной длины 16 бит. Стандарт Unicode с тех пор был изменен, чтобы позволить символы, чье представление требует более 16 бит. Диапазон допустимых кодовых точек теперь от U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда называется базовой многоязычной плоскостью (BMP). Символы с кодовыми точками, большими чем U+FFFF, называются дополнительными символами. Java-платформа использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первой из диапазона высоких суррогатов (\uD800-\uDBFF), второй из диапазона низких суррогатов (\uDC00-\uDFFF).
Значение char, следовательно, представляет кодовые точки Базовой многоязычной плоскости (BMP), включая кодовые точки суррогатов, или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Нижние (наименее значащие) 21 бит int используются для представления кодовых точек Unicode, а верхние (наиболее значащие) 11 бит должны быть нулевыми. За исключением случаев, когда указано иное, поведение относительно дополнительных символов и значений суррогатов char таково:
- Методы, принимающие только значение
char, не могут поддерживать дополнительные символы. Они рассматривают значенияcharиз диапазонов суррогатов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, даже если это конкретное значение, если за ним следует любое значение низкого суррогата в строке, представляло бы букву. - Методы, принимающие значение
int, поддерживают все символы Unicode, включая дополнительные. Например,Character.isLetter(0x2F81A)возвращаетtrue, потому что кодовое значение точки представляет букву (китайский иероглиф).
В документации Java SE API используется термин кодовая точка Unicode для значений символов в диапазоне от U+0000 до U+10FFFF, и единица кода Unicode используется для 16-битных значений char , которые являются единицами кода кодировки UTF-16. Для получения дополнительной информации по терминологии Unicode см. Словарь Unicode.
Это класс с основой на значении; программисты должны рассматривать экземпляры, которые равны, как взаимозаменяемые и не должны использовать экземпляры для синхронизации, иначе может возникнуть непредсказуемое поведение. Например, в будущей версии синхронизация может быть нерабочей.
- С тех пор:
- 1.0
- См. также:
Краткое описание вложенных классов
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class |
Character.Subset |
Экземпляры этого класса представляют собой определённые подмножества набора символов Unicode. |
static final class |
Character.UnicodeBlock |
Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode. |
static enum |
Character.UnicodeScript |
Семейство подмножеств символов, представляющих наборы символов, определённых в Приложении к стандарту Unicode #24: Имена наборов символов. |
Краткое описание полей
| Modifier and Type | Field | Description |
|---|---|---|
static final int |
BYTES |
Количество байтов, используемых для представления значения char в необработанном двоичном формате. |
static final byte |
COMBINING_SPACING_MARK |
Общая категория "Mc" в спецификации Unicode. |
static final byte |
CONNECTOR_PUNCTUATION |
Общая категория "Pc" в спецификации Unicode. |
static final byte |
CONTROL |
Общая категория "Cc" в спецификации Unicode. |
static final byte |
CURRENCY_SYMBOL |
Общая категория "Sc" в спецификации Unicode. |
static final byte |
DASH_PUNCTUATION |
Общая категория "Pd" в спецификации Unicode. |
static final byte |
DECIMAL_DIGIT_NUMBER |
Общая категория "Nd" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_ARABIC_NUMBER |
Слабый тип двунаправленного символа "AN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL |
Слабый тип двунаправленного символа "BN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR |
Слабый тип двунаправленного символа "CS" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER |
Слабый тип двунаправленного символа "EN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR |
Слабый тип двунаправленного символа "ES" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR |
Слабый тип двунаправленного символа "ET" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_FIRST_STRONG_ISOLATE |
Слабый тип двунаправленного символа "FSI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT |
Сильный тип двунаправленного символа "L" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING |
Сильный тип двунаправленного символа "LRE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE |
Слабый тип двунаправленного символа "LRI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE |
Сильный тип двунаправленного символа "LRO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_NONSPACING_MARK |
Слабый тип двунаправленного символа "NSM" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_OTHER_NEUTRALS |
Нейтральный тип двунаправленного символа "ON" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR |
Нейтральный тип двунаправленного символа "B" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT |
Слабый тип двунаправленного символа "PDF" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE |
Слабый тип двунаправленного символа "PDI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT |
Сильный тип двунаправленного символа "R" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC |
Сильный тип двунаправленного символа "AL" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING |
Сильный тип двунаправленного символа "RLE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE |
Слабый тип двунаправленного символа "RLI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE |
Сильный тип двунаправленного символа "RLO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_SEGMENT_SEPARATOR |
Нейтральный тип двунаправленного символа "S" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_UNDEFINED |
Неопределенный тип двунаправленного символа. |
static final byte |
DIRECTIONALITY_WHITESPACE |
Нейтральный тип двунаправленного символа "WS" в спецификации Unicode. |
static final byte |
ENCLOSING_MARK |
Общая категория "Me" в спецификации Unicode. |
static final byte |
END_PUNCTUATION |
Общая категория "Pe" в спецификации Unicode. |
static final byte |
FINAL_QUOTE_PUNCTUATION |
Общая категория "Pf" в спецификации Unicode. |
static final byte |
FORMAT |
Общая категория "Cf" в спецификации Unicode. |
static final byte |
INITIAL_QUOTE_PUNCTUATION |
Общая категория "Pi" в спецификации Unicode. |
static final byte |
LETTER_NUMBER |
Общая категория "Nl" в спецификации Unicode. |
static final byte |
LINE_SEPARATOR |
Общая категория "Zl" в спецификации Unicode. |
static final byte |
LOWERCASE_LETTER |
Общая категория "Ll" в спецификации Unicode. |
static final byte |
MATH_SYMBOL |
Общая категория "Sm" в спецификации Unicode. |
static final int |
MAX_CODE_POINT |
Максимальное значение кода символа Unicode, константа U+10FFFF. |
static final char |
MAX_HIGH_SURROGATE |
Максимальное значение высокого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDBFF'. |
static final char |
MAX_LOW_SURROGATE |
Максимальное значение низкого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final int |
MAX_RADIX |
Максимальное основание, доступное для преобразования в строки и из них. |
static final char |
MAX_SURROGATE |
Максимальное значение суррогатного кода Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final char |
MAX_VALUE |
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'. |
static final int |
MIN_CODE_POINT |
Минимальное значение кода символа Unicode, константа U+0000. |
static final char |
MIN_HIGH_SURROGATE |
Минимальное значение высокого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_LOW_SURROGATE |
Минимальное значение низкого суррогатного кода символа Unicode в кодировке UTF-16, константа '\uDC00'. |
static final int |
MIN_RADIX |
Минимальное основание, доступное для преобразования в строки и из них. |
static final int |
MIN_SUPPLEMENTARY_CODE_POINT |
Минимальное значение дополнительного кода символа Unicode, константа U+10000. |
static final char |
MIN_SURROGATE |
Минимальное значение суррогатного кода Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_VALUE |
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'. |
static final byte |
MODIFIER_LETTER |
Общая категория "Lm" в спецификации Unicode. |
static final byte |
MODIFIER_SYMBOL |
Общая категория "Sk" в спецификации Unicode. |
static final byte |
NON_SPACING_MARK |
Общая категория "Mn" в спецификации Unicode. |
static final byte |
OTHER_LETTER |
Общая категория "Lo" в спецификации Unicode. |
static final byte |
OTHER_NUMBER |
Общая категория "No" в спецификации Unicode. |
static final byte |
OTHER_PUNCTUATION |
Общая категория "Po" в спецификации Unicode. |
static final byte |
OTHER_SYMBOL |
Общая категория "So" в спецификации Unicode. |
static final byte |
PARAGRAPH_SEPARATOR |
Общая категория "Zp" в спецификации Unicode. |
static final byte |
PRIVATE_USE |
Общая категория "Co" в спецификации Unicode. |
static final int |
SIZE |
Количество бит, используемых для представления значения char в беззнаковом двоичном формате, константа 16. |
static final byte |
SPACE_SEPARATOR |
Общая категория "Zs" в спецификации Unicode. |
static final byte |
START_PUNCTUATION |
Общая категория "Ps" в спецификации Unicode. |
static final byte |
SURROGATE |
Общая категория "Cs" в спецификации Unicode. |
static final byte |
TITLECASE_LETTER |
Общая категория "Lt" в спецификации Unicode. |
static final Class<Character> |
TYPE |
Экземпляр Class, представляющий примитивный тип char. |
static final byte |
UNASSIGNED |
Общая категория "Cn" в спецификации Unicode. |
static final byte |
UPPERCASE_LETTER |
Общая категория "Lu" в спецификации Unicode. |
Краткое описание конструкторов
| Конструктор | Описание |
|---|---|
Character |
Устаревший, подлежит удалению: Этот элемент API может быть удален в будущей версии. Использовать этот конструктор редко уместно. |
Краткое описание методов
| Модификатор и тип | Метод | Описание |
|---|---|---|
static int |
charCount |
Определяет количество значений char необходимых для представления указанного символа (кода Юникода). |
char |
charValue() |
Возвращает значение объекта Character. |
static int |
codePointAt |
Возвращает код символа в заданном индексе массива char. |
static int |
codePointAt |
Возвращает код символа в заданном индексе массива char, где используются только элементы массива с index меньше limit. |
static int |
codePointAt |
Возвращает код символа в заданном индексе CharSequence. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу в массиве char. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу в массиве char, где используются только элементы массива с index больше или равно start. |
static int |
codePointBefore |
Возвращает код символа, предшествующий заданному индексу в CharSequence. |
static int |
codePointCount |
Возвращает количество кодов символов Юникода в подмассиве аргумента char. |
static int |
codePointCount |
Возвращает количество кодов символов Юникода в диапазоне текста указанной последовательности символов. |
static int |
codePointOf |
Возвращает числовое значение символа Юникода, заданного указанным именем символа Юникода. |
static int |
compare |
Сравнивает два значения char численно. |
int |
compareTo |
Сравнивает два объекта Character численно. |
Optional<DynamicConstantDesc<Character>> |
describeConstable() |
Возвращает Optional, содержащую номинальный дескриптор для этого экземпляра. |
static int |
digit |
Возвращает числовое значение символа ch в указанном основании. |
static int |
digit |
Возвращает числовое значение указанного символа (кода Юникода) в указанном основании. |
boolean |
equals |
Сравнивает этот объект с указанным объектом. |
static char |
forDigit |
Определяет представление символа для определенной цифры в заданном основании. |
static byte |
getDirectionality |
Возвращает свойство направленности Юникода для данного символа. |
static byte |
getDirectionality |
Возвращает свойство направленности Юникода для данного символа (кода Юникода). |
static String |
getName |
Возвращает имя символа Юникода для указанного символа codePoint, или null, если код символа unassigned. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ Юникода. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ (код Юникода). |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
int |
hashCode() |
Возвращает хеш-код для этого Character; равен результату вызова charValue(). |
static int |
hashCode |
Возвращает хеш-код для значения char; совместимо с Character.hashCode(). |
static char |
highSurrogate |
Возвращает ведущий суррогат (код-единица высокого суррогата) пары суррогатов, представляющей указанный дополнительный символ (код Юникода) в кодировке UTF-16. |
static boolean |
isAlphabetic |
Определяет, является ли указанный символ (код Юникода) буквенным. |
static boolean |
isBmpCodePoint |
Определяет, находится ли указанный символ (код Юникода) в основной многоязычной плоскости (BMP). |
static boolean |
isDefined |
Определяет, определен ли символ в Юникоде. |
static boolean |
isDefined |
Определяет, определён ли символ (код Юникода) в Юникоде. |
static boolean |
isDigit |
Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit |
Определяет, является ли указанный символ (код Юникода) цифрой. |
static boolean |
isHighSurrogate |
Определяет, является ли заданное значение char кодовой единицей высокого суррогата Юникода (также известной как ведущая кодовая единица суррогата). |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли рассматривать указанный символ (код Юникода) как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdeographic |
Определяет, является ли указанный символ CJKV (китайский, японский, корейский и вьетнамский) идеограммой, как определено в стандарте Юникода. |
static boolean |
isISOControl |
Определяет, является ли указанный символ управляющим символом ISO. |
static boolean |
isISOControl |
Определяет, является ли указанный символ (код Юникода) управляющим символом ISO. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли символ (код Юникода) быть частью идентификатора Java, кроме первого символа. |
static boolean |
isJavaIdentifierStart |
Определяет, разрешен ли указанный символ как первый символ в идентификаторе Java. |
static boolean |
isJavaIdentifierStart |
Определяет, разрешён ли символ (код Юникода) как первый символ в идентификаторе Java. |
static boolean |
isJavaLetter |
Устарело. Заменено на isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit |
Устарело. Заменено на isJavaIdentifierPart(char). |
static boolean |
isLetter |
Определяет, является ли указанный символ буквой. |
static boolean |
isLetter |
Определяет, является ли указанный символ (код Юникода) буквой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ (код Юникода) буквой или цифрой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ строчной буквой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ (код Юникода) строчной буквой. |
static boolean |
isLowSurrogate |
Определяет, является ли заданное значение char символом низкого суррогата Юникода (также известен как символ-суррогат-прицепной). |
static boolean |
isMirrored |
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isMirrored |
Определяет, является ли указанный символ (код точки Юникода) зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isSpace |
Устарело. Заменено на isWhitespace(char). |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ символом пробела Юникода. |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ (код точки Юникода) символом пробела Юникода. |
static boolean |
isSupplementaryCodePoint |
Определяет, находится ли указанный символ (код точки Юникода) в диапазоне дополнительных символов. |
static boolean |
isSurrogate |
Определяет, является ли заданное значение char суррогатным символом Юникода. |
static boolean |
isSurrogatePair |
Определяет, является ли указанная пара значений char валидной парой суррогатов Юникода. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ символом заглавной буквы. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ (код точки Юникода) символом заглавной буквы. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ (код точки Юникода) быть частью идентификатора Юникода, кроме первого символа. |
static boolean |
isUnicodeIdentifierStart |
Определяет, разрешён ли указанный символ в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUnicodeIdentifierStart |
Определяет, разрешён ли указанный символ (код точки Юникода) в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ прописной буквой. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ (код точки Юникода) прописной буквой. |
static boolean |
isValidCodePoint |
Определяет, является ли указанный код точки действительным значением кода точки Юникода. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ символом пробела согласно Java. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ (код точки Юникода) символом пробела согласно Java. |
static char |
lowSurrogate |
Возвращает символ-суррогат-прицепной (низкий суррогат код-единица) пары суррогатов ( surrogate pair) представляющий указанный дополнительный символ (код точки Юникода) в кодировке UTF-16. |
static int |
offsetByCodePoints |
Возвращает индекс в заданном char подмассиве, смещенный от заданного index на codePointOffset точек кода. |
static int |
offsetByCodePoints |
Возвращает индекс в заданной последовательности символов, смещенный от заданного index на codePointOffset точек кода. |
static char |
reverseBytes |
Возвращает значение, полученное путем перестановки байтов в указанном значении char. |
static char[] |
toChars |
Преобразует указанный символ (код точки Юникода) в его представление UTF-16, хранящееся в массиве char. |
static int |
toChars |
Преобразует указанный символ (код точки Юникода) в его представление UTF-16. |
static int |
toCodePoint |
Преобразует указанную пару суррогатов в значение дополнительного кода точки. |
static char |
toLowerCase |
Преобразует символ в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toLowerCase |
Преобразует символ (код точки Юникода) в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
String |
toString() |
Возвращает объект String, представляющий значение этого объекта Character. |
static String |
toString |
Возвращает объект String, представляющий указанный char. |
static String |
toString |
Возвращает объект String, представляющий указанный символ (код точки Юникода). |
static char |
toTitleCase |
Преобразует символ в заглавный регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toTitleCase |
Преобразует символ (код точки Юникода) в заглавный регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static char |
toUpperCase |
Преобразует символ в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toUpperCase |
Преобразует символ (код точки Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static Character |
valueOf |
Возвращает экземпляр Character, представляющий указанное значение char. |
Подробное описание полей
MIN_RADIX
public static final int MIN_RADIX
digit, метод forDigit и метод toString класса Integer. MAX_RADIX
public static final int MAX_RADIX
digit, метод forDigit и метод toString класса Integer. MIN_VALUE
public static final char MIN_VALUE
char, '\u0000'. - С:
- 1.0.2
- См. также:
MAX_VALUE
public static final char MAX_VALUE
char, '\uFFFF'. - С:
- 1.0.2
- См. также:
TYPE
public static final Class<Character> TYPE
Class, представляющий примитивный тип char. - С:
- 1.1
НЕНАЗНАЧЕННОЕ
public static final byte UNASSIGNED
- С:
- 1.1
- См. также:
ПРОПИСНАЯ_БУКВА
public static final byte UPPERCASE_LETTER
- С:
- 1.1
- См. также:
МАЛЕНЬКАЯ_БУКВА
public static final byte LOWERCASE_LETTER
- С:
- 1.1
- См. также:
БУКВА_ЗАГЛАВНАЯ
public static final byte TITLECASE_LETTER
- С:
- 1.1
- См. также:
МОДИФИКАТОРНАЯ_БУКВА
public static final byte MODIFIER_LETTER
- С:
- 1.1
- См. также:
ДРУГАЯ_БУКВА
public static final byte OTHER_LETTER
- С:
- 1.1
- См. также:
НЕРАЗРЫВНЫЙ_СИМВОЛ
public static final byte NON_SPACING_MARK
- С:
- 1.1
- См. также:
ВКЛЮЧАЮЩИЙ_СИМВОЛ
public static final byte ENCLOSING_MARK
- С:
- 1.1
- См. также:
СОЧЕТАЕМЫЙ_РАЗРЫВНОЙ_СИМВОЛ
public static final byte COMBINING_SPACING_MARK
- С:
- 1.1
- См. также:
ЦИФРА_ДЕСЯТИЧНОГО_ЧИСЛА
public static final byte DECIMAL_DIGIT_NUMBER
- С:
- 1.1
- См. также:
БУКВА_ЧИСЛО
public static final byte LETTER_NUMBER
- С:
- 1.1
- См. также:
ДРУГОЕ_ЧИСЛО
public static final byte OTHER_NUMBER
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_ПРОБЕЛА
public static final byte SPACE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_СТРОК
public static final byte LINE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_АБЗАЦОВ
public static final byte PARAGRAPH_SEPARATOR
- С:
- 1.1
- См. также:
УПРАВЛЯЮЩИЙ
public static final byte CONTROL
- С:
- 1.1
- См. также:
ФОРМАТ
public static final byte FORMAT
- С:
- 1.1
- См. также:
ЛИЧНОЕ_ИСПОЛЬЗОВАНИЕ
public static final byte PRIVATE_USE
- С:
- 1.1
- См. также:
СУРРОГАТ
public static final byte SURROGATE
- С:
- 1.1
- См. также:
Пунктуация тире
public static final byte DASH_PUNCTUATION
- С:
- 1.1
- См. также:
Пунктуация начала
public static final byte START_PUNCTUATION
- С:
- 1.1
- См. также:
Пунктуация конца
public static final byte END_PUNCTUATION
- С:
- 1.1
- См. также:
Пунктуация соединения
public static final byte CONNECTOR_PUNCTUATION
- С:
- 1.1
- См. также:
Другая пунктуация
public static final byte OTHER_PUNCTUATION
- С:
- 1.1
- См. также:
Символ математики
public static final byte MATH_SYMBOL
- С:
- 1.1
- См. также:
Символ валюты
public static final byte CURRENCY_SYMBOL
- С:
- 1.1
- См. также:
Символ модификатора
public static final byte MODIFIER_SYMBOL
- С:
- 1.1
- См. также:
Прочие символы
public static final byte OTHER_SYMBOL
- С:
- 1.1
- См. также:
Пунктуация кавычек (начало)
public static final byte INITIAL_QUOTE_PUNCTUATION
- С:
- 1.4
- См. также:
Пунктуация кавычек (конец)
public static final byte FINAL_QUOTE_PUNCTUATION
- С:
- 1.4
- См. также:
Направление_неопределённо
public static final byte DIRECTIONALITY_UNDEFINED
char в спецификации Юникод имеют неопределённое направление.- С:
- 1.4
- См. также:
DIRECTIONALITY_СЛЕВА_НАПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
- С:
- 1.4
- См. также:
DIRECTIONALITY_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
- С:
- 1.4
- См. также:
DIRECTIONALITY_СПРАВА_НАЛЕВО_АРАБСКИЙ
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
- С:
- 1.4
- См. также:
DIRECTIONALITY_ЕВРОПЕЙСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
- С:
- 1.4
- См. также:
DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_ЕВРОПЕЙСКОГО_ЧИСЛА
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_ЗАВЕРШИТЕЛЬ_ЕВРОПЕЙСКОГО_ЧИСЛА
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_АРАБСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_ARABIC_NUMBER
- С:
- 1.4
- См. также:
DIRECTIONALITY_ОБЩИЙ_РАЗДЕЛИТЕЛЬ_ЧИСЕЛ
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_НЕРАЗРЫВНЫЙ_СИМВОЛ
public static final byte DIRECTIONALITY_NONSPACING_MARK
- С:
- 1.4
- См. также:
DIRECTIONALITY_НЕЙТРАЛЬНАЯ_ГРАНИЦА
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
- С:
- 1.4
- См. также:
DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_АБЗАЦА
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_РАЗДЕЛИТЕЛЬ_РАЗДЕЛА
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
- С момента:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
- С момента:
- 9
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
- С момента:
- 9
- См. также:
DIRECTIONALITY_FIRST_STRONG_ISOLATE
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
- С момента:
- 9
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
- С момента:
- 9
- См. также:
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
'\uD800'. Символ-заместитель высшего уровня также известен как символ-заместитель ведущий.- С момента:
- 1.5
- См. также:
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
'\uDBFF'. Символ-заместитель высшего уровня также известен как символ-заместитель ведущий.- С момента:
- 1.5
- См. также:
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
'\uDC00'. Символ-заместитель низшего уровня также известен как символ-заместитель ведомый.- С момента:
- 1.5
- См. также:
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
'\uDFFF'. Символ-заместитель низшего уровня также известен как символ-заместитель ведомый.- С момента:
- 1.5
- См. также:
MIN_SURROGATE
public static final char MIN_SURROGATE
'\uD800'. - С момента:
- 1.5
- См. также:
MAX_SURROGATE
public static final char MAX_SURROGATE
'\uDFFF'. - С момента:
- 1.5
- См. также:
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
U+10000. - С момента:
- 1.5
- См. также:
MIN_CODE_POINT
public static final int MIN_CODE_POINT
U+0000. - С момента:
- 1.5
- См. также:
MAX_CODE_POINT
public static final int MAX_CODE_POINT
U+10FFFF. - С момента:
- 1.5
- См. также:
SIZE
public static final int SIZE
char в беззнаковой двоичной форме, константа 16. - С момента:
- 1.5
- См. также:
BYTES
public static final int BYTES
char в беззнаковом двоичном формате.- Since:
- 1.8
- См. также:
Подробное описание конструкторов
Character
@Deprecated(since="9", forRemoval=true) public Character(char value)
valueOf(char) обычно является лучшим выбором, поскольку он, вероятно, обеспечит существенно лучшую производительность по памяти и времени.char. - Параметры:
-
value- значение, которое должен представлять объект Character.
Подробное описание методов
describeConstable
public Optional<DynamicConstantDesc<Character>> describeConstable()
Optional, содержащую номинальный дескриптор для данного экземпляра.- Определено в:
-
describeConstableв интерфейсеConstable - Возвращает:
- объект
Optional, описывающий экземпляр Character - Since:
- 15
valueOf
public static Character valueOf(char c)
char. Если новый экземпляр Character не требуется, этот метод обычно предпочтительнее конструктора Character(char), так как он, вероятно, обеспечит существенно лучшую производительность по памяти и времени за счёт кеширования часто запрашиваемых значений. Этот метод всегда будет кешировать значения в диапазоне
'\u0000' до '\u007F', включительно, и может кешировать другие значения за пределами этого диапазона.- Параметры:
-
c- значение типа char. - Возвращает:
- экземпляр Character, представляющий
c. - Since:
- 1.5
charValue
public char charValue()
- Возвращает:
- примитивное значение char, представленное этим объектом.
hashCode
public int hashCode()
charValue().- Переопределяет:
-
hashCodeв классеObject - Возвращает:
- значение хэша для данного объекта Character
- См. также:
hashCode
public static int hashCode(char value)
Character.hashCode().- Параметры:
-
value- Значение char, для которого требуется код хэша. - Возвращает:
- значение хэша для данного значения char.
- Since:
- 1.8
equals
public boolean equals(Object obj)
true тогда и только тогда, когда аргумент не null и является объектом Character, представляющим то же значение char, что и этот объект.- Переопределяет:
-
equalsв классеObject - Параметры:
-
obj- объект для сравнения. - Возвращает:
-
trueесли объекты одинаковы;falseв противном случае. - См. также:
toString
public String toString()
- Переопределяет:
-
toStringв классеObject - Возвращает:
- строковое представление этого объекта.
toString
public static String toString(char c)
- Примечание API:
- Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод
toString(int). - Параметры:
-
c- символ char, который нужно преобразовать - Возвращает:
- строковое представление указанного символа char
- Since:
- 1.4
toString
public static String toString(int codePoint)
- Параметры:
-
codePoint- код Unicode для преобразования - Возвращает:
- строковое представление указанного символа
- Исключения:
-
IllegalArgumentException- если указанное значение кода Unicode не является допустимым кодом Unicode. - Since:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
- Параметры:
-
codePoint- код символа Unicode для проверки - Возвращает:
-
trueесли указанное значение кода символа находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - Since:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
char.- Параметры:
-
codePoint- символ (код Unicode) для проверки - Возвращает:
-
trueесли указанный код символа находится в диапазоне отMIN_VALUEдоMAX_VALUEвключительно;falseв противном случае. - Since:
- 1.7
isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
- Параметры:
-
codePoint- символ (код Unicode) для проверки - Возвращает:
-
trueесли указанный код символа находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - Since:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
Такие значения сами по себе не представляют символов, а используются в представлении дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- значение char для проверки. - Возвращает:
-
trueесли значение char находится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно;falseв противном случае. - Since:
- 1.5
- См. также:
isLowSurrogate
public static boolean isLowSurrogate(char ch)
char значение кодовым элементом Unicode в нижнем диапазоне суррогатов (также известным как кодовый элемент в последовательности суррогатов). Такие значения не представляют собой символы сами по себе, но используются для представления дополнительных символов в кодировке UTF-16.
- Parameters:
-
ch- тестируемоеcharзначение. - Returns:
-
trueеслиcharзначение находится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно;falseв противном случае. - Since:
- 1.5
- See Also:
isSurrogate
public static boolean isSurrogate(char ch)
char значение кодовым элементом Unicode в диапазоне суррогатов. Такие значения не представляют собой символы сами по себе, но используются для представления дополнительных символов в кодировке UTF-16.
Значение char является кодовым элементом суррогата тогда и только тогда, когда оно является либо кодовым элементом в нижнем диапазоне суррогатов, либо кодовым элементом в верхнем диапазоне суррогатов.
- Parameters:
-
ch- тестируемоеcharзначение. - Returns:
-
trueеслиcharзначение находится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно;falseв противном случае. - Since:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high, char low)
char значений допустимой парой суррогатов Unicode. Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Parameters:
-
high- значение кодового элемента в верхнем диапазоне суррогатов для проверки -
low- значение кодового элемента в нижнем диапазоне суррогатов для проверки - Returns:
-
trueесли указанные значения кодовых элементов в верхнем и нижнем диапазонах суррогатов представляют собой допустимую пару суррогатов;falseв противном случае. - Since:
- 1.5
charCount
public static int charCount(int codePoint)
char значений, необходимых для представления указанного символа (кодовой точки Unicode). Если указанный символ равен или больше 0x10000, то метод возвращает 2. В противном случае метод возвращает 1. Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. Вызывающая сторона должна проверить значение символа с помощью isValidCodePoint, если это необходимо.
- Parameters:
-
codePoint- символ (кодовая точка Unicode) для проверки. - Returns:
- 2, если символ является допустимым дополнительным символом; 1 в противном случае.
- Since:
- 1.5
- See Also:
toCodePoint
public static int toCodePoint(char high, char low)
isSurrogatePair, если это необходимо.- Parameters:
-
high- кодовый элемент в верхнем диапазоне суррогатов -
low- кодовый элемент в нижнем диапазоне суррогатов - Returns:
- дополнительная кодовая точка, составленная из указанной пары суррогатов.
- Since:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq, int index)
CharSequence. Если char значение по заданному индексу в CharSequence находится в диапазоне верхних суррогатов, следующий индекс меньше длины CharSequence, а char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.- Parameters:
-
seq- последовательностьcharзначений (единиц кода Unicode) -
index- индексcharзначений (единиц кода Unicode) вseqдля преобразования - Returns:
- кодовая точка Unicode по заданному индексу
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньшеseq.length(). - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index)
char. Если char значение по заданному индексу в массиве char находится в диапазоне верхних суррогатов, следующий индекс меньше длины массива char, и char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.- Parameters:
-
a- массивchar -
index- индексcharзначений (единиц кода Unicode) в массивеcharдля преобразования - Returns:
- кодовая точка Unicode по заданному индексу
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньше длины массиваchar - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index, int limit)
char, где используются только элементы массива с index меньше limit. Если char значение по заданному индексу в массиве char находится в диапазоне верхних суррогатов, следующий индекс меньше limit, и char значение следующего индекса находится в диапазоне нижних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по заданному индексу.- Parameters:
-
a- массивchar -
index- индексcharзначений (единиц кода Unicode) в массивеcharдля преобразования -
limit- индекс после последнего элемента массива, который можно использовать в массивеchar - Returns:
- кодовая точка Unicode по заданному индексу
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexотрицательный или не меньше аргументаlimit, или если аргументlimitотрицательный или больше длины массиваchar - Since:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq, int index)
CharSequence. Если char значение по (index - 1) в CharSequence находится в диапазоне нижних суррогатов, (index - 2) не отрицательное, и char значение по (index - 2) в CharSequence находится в диапазоне верхних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по (index - 1)- Parameters:
-
seq- экземплярCharSequence -
index- индекс, следующий за кодовой точкой, которая должна быть возвращена - Returns:
- значение кодовой точки Unicode, предшествующее данному индексу.
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или большеseq.length(). - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index)
char. Если char значение по (index - 1) в массиве char находится в диапазоне нижних суррогатов, (index - 2) не отрицательное, и char значение по (index - 2) в массиве char находится в диапазоне верхних суррогатов, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается char значение по (index - 1)- Parameters:
-
a- массивchar -
index- индекс, следующий за кодовой точкой, которая должна быть возвращена - Returns:
- значение кодовой точки Unicode, предшествующее данному индексу.
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или больше длины массиваchar - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index, int start)
char, где используются только элементы массива с индексом, не меньшим start. Если значение char по индексу (index - 1) в массиве char находится в диапазоне низких суррогатных символов, (index - 2) не меньше start, и значение char по индексу (index - 2) в массиве char находится в диапазоне высоких суррогатных символов, то возвращается дополнительный код символа, соответствующий этой паре суррогатных символов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
a- массивchar -
index- индекс, следующий за кодом символа, который должен быть возвращён -
start- индекс первого элемента массиваchar - Возвращает:
- значение кода Юникода символа, предшествующего заданному индексу.
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexне больше аргументаstartили больше длины массиваchar, или если аргументstartотрицательный или не меньше длины массиваchar. - С тех пор:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
Если isSupplementaryCodePoint(x) равно true, тогда isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда равны true.
- Параметры:
-
codePoint- дополнительный символ (код Юникода) - Возвращает:
- ведущая единица кода суррогатного символа, используемая для представления символа в кодировке UTF-16
- С тех пор:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
Если isSupplementaryCodePoint(x) равно true, тогда isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда равны true.
- Параметры:
-
codePoint- дополнительный символ (код Юникода) - Возвращает:
- заключительная единица кода суррогатного символа, используемая для представления символа в кодировке UTF-16
- С тех пор:
- 1.7
toChars
public static int toChars(int codePoint, char[] dst, int dstIndex)
dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогатных символов хранятся в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.- Параметры:
-
codePoint- символ (код Юникода), который необходимо преобразовать. -
dst- массив символов, в который сохраняется значение UTF-16 символа. -
dstIndex- начальный индекс в массивеdst, где хранится преобразованное значение. - Возвращает:
- 1, если код символа является кодом символа BMP, 2, если код символа является дополнительным кодом символа.
- Исключения:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Юникода. -
NullPointerException- если указанныйdstравен null. -
IndexOutOfBoundsException- еслиdstIndexотрицательный или не меньшеdst.length, или если в массивеdstпо индексуdstIndexнедостаточно места для хранения полученного значенияchar. (ЕслиdstIndexравноdst.length-1, а указанныйcodePointявляется дополнительным символом, значение высокого суррогата не хранится вdst[dstIndex].) - С тех пор:
- 1.5
toChars
public static char[] toChars(int codePoint)
char. Если указанный код символа является значением BMP (основной многоязычной плоскости или плоскости 0), то результирующий массив char имеет то же значение, что и codePoint. Если указанный код символа является дополнительным кодом символа, результирующий массив char содержит соответствующую пару суррогатных символов.- Параметры:
-
codePoint- код Юникода символа - Возвращает:
- массив
char, содержащий представлениеcodePointв UTF-16. - Исключения:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Юникода. - С тех пор:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина (в символах) диапазона текста равна endIndex-beginIndex. Непарные суррогатные символы в диапазоне текста учитываются как по одному символу каждый.- Параметры:
-
seq- последовательность символов -
beginIndex- индекс первого символа диапазона текста. -
endIndex- индекс после последнего символа диапазона текста. - Возвращает:
- количество символов Юникода в заданном диапазоне текста
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиbeginIndexотрицательный, илиendIndexбольше длины заданной последовательности, илиbeginIndexбольшеendIndex. - С тех пор:
- 1.5
codePointCount
public static int codePointCount(char[] a, int offset, int count)
char. Аргумент offset — индекс первого символа подмассива, а аргумент count задаёт длину подмассива в символах. Непарные суррогатные символы в подмассиве учитываются как по одному символу каждый.- Параметры:
-
a- массивchar -
offset- индекс первого символа в заданном массивеchar -
count- длина подмассива в символах - Возвращает:
- количество символов Юникода в заданном подмассиве
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиoffsetилиcountотрицательны, или еслиoffset + countбольше длины заданного массива. - С тех пор:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
index на codePointOffset символов. Непарные суррогатные символы в диапазоне текста, заданном index и codePointOffset, учитываются как по одному символу каждый.- Параметры:
-
seq- последовательность символов -
index- индекс, который необходимо сместить -
codePointOffset- смещение в символах - Возвращает:
- индекс в последовательности символов
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиindexотрицательный или больше длины последовательности символов, или еслиcodePointOffsetположительный и подпоследовательность, начинающаяся сindex, содержит меньше чемcodePointOffsetсимволов, или еслиcodePointOffsetотрицательный и подпоследовательность передindexсодержит меньше, чем абсолютное значениеcodePointOffsetсимволов. - С тех пор:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
char подмассиве, смещённый от заданного index на codePointOffset кодовые точки. Аргументы start и count определяют подмассив массива char. Неспаренные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются по одной кодовой точке каждый.- Parameters:
-
a- массивchar -
start- индекс первойcharподмассива -
count- длина подмассива вchar -
index- индекс, который необходимо сместить -
codePointOffset- смещение в кодовых точках - Returns:
- индекс в подмассиве
- Throws:
-
NullPointerException- еслиanull. -
IndexOutOfBoundsException- еслиstartилиcountотрицательны, или еслиstart + countбольше длины заданного массива, или еслиindexменьшеstartили большеstart + count, или еслиcodePointOffsetположительно, и диапазон текста, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньшеcodePointOffsetкодовых точек, или еслиcodePointOffsetотрицательно, и диапазон текста, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше абсолютного значенияcodePointOffsetкодовых точек. - Since:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Символ является строчным, если его тип общей категории, предоставляемый Character.getType(ch), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.
Вот примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).
- Parameters:
-
ch- символ, который необходимо проверить. - Returns:
-
true, если символ является строчной буквой;falseв противном случае. - See Also:
isLowerCase
public static boolean isLowerCase(int codePoint)
Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.
Вот примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
- Parameters:
-
codePoint- символ (кодовая точка Unicode) для проверки. - Returns:
-
trueесли символ является строчной буквой;falseв противном случае. - Since:
- 1.5
- See Also:
isUpperCase
public static boolean isUpperCase(char ch)
Символ является заглавным, если его тип общей категории, предоставляемый Character.getType(ch), равен UPPERCASE_LETTER. или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Вот примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isUpperCase(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является заглавной буквой;falseв противном случае. - Since:
- 1.0
- See Also:
isUpperCase
public static boolean isUpperCase(int codePoint)
Символ является заглавным, если его тип общей категории, предоставляемый getType(codePoint), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Вот примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
- Parameters:
-
codePoint- символ (кодовая точка Unicode) для проверки. - Returns:
-
trueесли символ является заглавной буквой;falseв противном случае. - Since:
- 1.5
- See Also:
isTitleCase
public static boolean isTitleCase(char ch)
Символ является буквой в стиле заголовка, если его тип общей категории, предоставляемый Character.getType(ch), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с прописными начальными буквами, как в названии книги.
Вот некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются буквами в стиле заголовка.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isTitleCase(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является буквой в стиле заголовка;falseв противном случае. - Since:
- 1.0.2
- See Also:
isTitleCase
public static boolean isTitleCase(int codePoint)
Символ является буквой в стиле заголовка, если его тип общей категории, предоставляемый getType(codePoint), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с прописными начальными буквами, как в названии книги.
Вот некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются буквами в стиле заголовка.
- Parameters:
-
codePoint- символ (кодовая точка Unicode) для проверки. - Returns:
-
trueесли символ является буквой в стиле заголовка;falseв противном случае. - Since:
- 1.5
- See Also:
isDigit
public static boolean isDigit(char ch)
Символ является цифрой, если его тип общей категории, предоставленный Character.getType(ch), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабско-индийские цифры -
'\u06F0'по'\u06F9', расширенные арабско-индийские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', цифры с полным шириной
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDigit(int).
- Параметры:
-
ch- символ, который необходимо проверить. - Возвращает:
-
trueесли символ является цифрой;falseв противном случае. - См. также:
isDigit
public static boolean isDigit(int codePoint)
Символ является цифрой, если его тип общей категории, предоставленный getType(codePoint), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабско-индийские цифры -
'\u06F0'по'\u06F9', расширенные арабско-индийские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', цифры с полным шириной
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ является цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isDefined
public static boolean isDefined(char ch)
Символ определен, если хотя бы одно из следующих условий истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDefined(int).
- Параметры:
-
ch- символ, который нужно проверить - Возвращает:
-
trueесли символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.0.2
- См. также:
isDefined
public static boolean isDefined(int codePoint)
Символ определен, если хотя бы одно из следующих условий истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.5
- См. также:
isLetter
public static boolean isLetter(char ch)
Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), равен одному из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetter(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - См. также:
isLetter
public static boolean isLetter(int codePoint)
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), равен одному из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - С:
- 1.5
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Символ считается буквой или цифрой, если либо Character.isLetter(char ch) или Character.isDigit(char ch) возвращают true для символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.0.2
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Символ считается буквой или цифрой, если либо isLetter(codePoint) или isDigit(codePoint) возвращает true для символа.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительной пунктуации (например,'_').
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.0.2
- See Also:
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Символ может быть частью идентификатора Java, если выполняется одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительной пунктуации (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа.
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.0.2
- See Also:
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Символ считается буквенным, если его тип общей категории, предоставляемый getType(codePoint), является любым из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Parameters:
-
codePoint- символ (кодовый пункт Юникода), подлежащий проверке. - Returns:
-
true, если символ является символом алфавита Юникода,falseв противном случае. - Since:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
- Parameters:
-
codePoint- символ (кодовый пункт Юникода), подлежащий проверке. - Returns:
-
true, если символ является символом идеограммы Юникода,falseв противном случае. - Since:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительной пунктуации (например,'_')
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Символ может начинать идентификатор Java, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - ссылка на символ — это символ валюты (например,
'$') - ссылка на символ — это символ соединительной пунктуации (например,
'_')
- Parameters:
-
codePoint- символ (кодовый пункт Юникода), подлежащий проверке. - Returns:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.5
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительной пунктуации (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Символ может быть частью идентификатора Java, если выполняется хотя бы одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ пунктуации соединения (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это комбинированный знак
- это знак без пробела
isIdentifierIgnorable(codePoint)возвращаетtrueдля кодового значения.
- Parameters:
-
codePoint- тестируемый символ (кодовое значение Юникода). - Returns:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.5
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
isLetter(ch)возвращаетtruegetType(ch)возвращаетLETTER_NUMBER.- это символ
Other_ID_Start.
Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавлен к Start для обратной совместимости.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ может начинать идентификатор Юникода;falseв противном случае. - Since:
- 1.1
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
isLetter(codePoint)возвращаетtruegetType(codePoint)возвращаетLETTER_NUMBER.- это символ
Other_ID_Start.
Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавлен к Start для обратной совместимости.- Parameters:
-
codePoint- символ (кодовое значение Юникода) для проверки. - Returns:
-
trueесли символ может начинать идентификатор Юникода;falseв противном случае. - Since:
- 1.5
- See Also:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:
- это буква
- это символ пунктуации соединения (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это комбинированный знак
- это знак без пробела
isIdentifierIgnorableвозвращаетtrueдля этого символа.- это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавлен к Continue для обратной совместимости.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ может быть частью идентификатора Юникода;falseв противном случае. - Since:
- 1.1
- See Also:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Символ может быть частью идентификатора Юникода только в том случае, если выполняется одно из следующих утверждений:
- это буква
- это символ пунктуации соединения (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это комбинированный знак
- это знак без пробела
isIdentifierIgnorableвозвращаетtrueдля этого символа.- это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованиям UAX31-R1: Идентификаторы по умолчанию стандарта Юникод, с приведенным профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавлен к Continue для обратной совместимости.- Parameters:
-
codePoint- символ (кодовое значение Юникода) для проверки. - Returns:
-
trueесли символ может быть частью идентификатора Юникода;falseв противном случае. - Since:
- 1.5
- See Also:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Следующие символы Юникода игнорируются в идентификаторе Java или идентификаторе Юникода:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение
FORMATобщей категории
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Юникода;falseв противном случае. - Since:
- 1.1
- See Also:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Следующие символы Юникода игнорируются в идентификаторе Java или Юникода:
- Символы управления ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- Все символы, имеющие значение общей категории
FORMAT
- Parameters:
-
codePoint- символ (код Юникода) для проверки. - Returns:
-
true, если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Юникода;falseв противном случае. - Since:
- 1.5
- See Also:
toLowerCase
public static char toLowerCase(char ch)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toLowerCase(int).
- Parameters:
-
ch- символ для преобразования. - Returns:
- эквивалент символа в нижнем регистре, если он есть; в противном случае сам символ.
- See Also:
toLowerCase
public static int toLowerCase(int codePoint)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. - Returns:
- эквивалент символа (код Юникода) в нижнем регистре, если он есть; в противном случае сам символ.
- Since:
- 1.5
- See Also:
toUpperCase
public static char toUpperCase(char ch)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).
- Parameters:
-
ch- символ для преобразования. - Returns:
- эквивалент символа в верхнем регистре, если он есть; в противном случае сам символ.
- See Also:
toUpperCase
public static int toUpperCase(int codePoint)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления 1:М символов, в то время как Character методы преобразования регистра этого не могут.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. - Returns:
- эквивалент символа в верхнем регистре, если он есть; в противном случае сам символ.
- Since:
- 1.5
- See Also:
toTitleCase
public static char toTitleCase(char ch)
char уже является заглавным регистром char, возвращается то же самое значение char. Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).
- Parameters:
-
ch- символ для преобразования. - Returns:
- эквивалент символа в заглавном регистре, если он есть; в противном случае сам символ.
- Since:
- 1.0.2
- See Also:
toTitleCase
public static int toTitleCase(int codePoint)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. - Returns:
- эквивалент символа в заглавном регистре, если он есть; в противном случае сам символ.
- Since:
- 1.5
- See Also:
digit
public static int digit(char ch, int radix)
ch в указанном радиксе. Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:
- Метод
isDigitвозвращаетtrueдля символа, и десятичное значение символа Unicode (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате от A (
'\uFF21') до Z ('\uFF3A'), и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате от a (
'\uFF41') до z ('\uFF5A'), и его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch- символ, который нужно преобразовать. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- См. также:
digit
public static int digit(int codePoint, int radix)
Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:
- Метод
isDigit(codePoint)возвращаетtrueдля символа, и десятичное значение символа Unicode (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате от A (
'\uFF21') до Z ('\uFF3A'), и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате от a (
'\uFF41') до z ('\uFF5A'), и его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint- символ (код Unicode) для преобразования. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- С:
- 1.5
- См. также:
getNumericValue
public static int getNumericValue(char ch)
'\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50. Буквы A-Z в их заглавном ('\u0041' через '\u005A'), строчном ('\u0061' через '\u007A') и полном формате ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное
intзначение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если у символа нет числового значения. - С:
- 1.1
- См. также:
getNumericValue
public static int getNumericValue(int codePoint)
'\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50. Буквы A-Z в их заглавном ('\u0041' через '\u005A'), строчном ('\u0061' через '\u007A') и полном формате ('\uFF21' через '\uFF3A' и '\uFF41' через '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить как неотрицательное целое число (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint- символ (код Unicode) для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное
intзначение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если у символа нет числового значения. - С:
- 1.5
- См. также:
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
true только для следующих пяти символов: | Символ | Код | Название |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является пробелом ISO-LATIN-1;falseв противном случае. - См. также:
isSpaceChar
public static boolean isSpaceChar(char ch)
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является символом-пробелом;falseв противном случае. - С:
- 1.1
- См. также:
isSpaceChar
public static boolean isSpaceChar(int codePoint)
- Parameters:
-
codePoint- символ (код точки Юникода), который нужно проверить. - Returns:
-
trueесли символ является символом пробела;falseв противном случае. - Since:
- 1.5
- See Also:
isWhitespace
public static boolean isWhitespace(char ch)
- Он является символом пробела Юникода (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также символом неразрывного пробела ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isWhitespace(int).
- Parameters:
-
ch- символ, который нужно проверить. - Returns:
-
trueесли символ является символом пробела Java;falseв противном случае. - Since:
- 1.1
- See Also:
isWhitespace
public static boolean isWhitespace(int codePoint)
- Он является символом пробела Юникода (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также символом неразрывного пробела ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
- Parameters:
-
codePoint- символ (код точки Юникода), который нужно проверить. - Returns:
-
trueесли символ является символом пробела Java;falseв противном случае. - Since:
- 1.5
- See Also:
isISOControl
public static boolean isISOControl(char ch)
'\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isISOControl(int).
- Parameters:
-
ch- символ, который нужно проверить. - Returns:
-
trueесли символ является символом управления ISO;falseв противном случае. - Since:
- 1.1
- See Also:
isISOControl
public static boolean isISOControl(int codePoint)
'\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'. - Parameters:
-
codePoint- символ (код точки Юникода), который нужно проверить. - Returns:
-
trueесли символ является символом управления ISO;falseв противном случае. - Since:
- 1.5
- See Also:
getType
public static int getType(char ch)
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getType(int).
- Parameters:
-
ch- символ, который нужно проверить. - Returns:
- значение типа
int, представляющее общую категорию символа. - Since:
- 1.1
- See Also:
-
COMBINING_SPACING_MARKCONNECTOR_PUNCTUATIONCONTROLCURRENCY_SYMBOLDASH_PUNCTUATIONDECIMAL_DIGIT_NUMBERENCLOSING_MARKEND_PUNCTUATIONFINAL_QUOTE_PUNCTUATIONFORMATINITIAL_QUOTE_PUNCTUATIONLETTER_NUMBERLINE_SEPARATORLOWERCASE_LETTERMATH_SYMBOLMODIFIER_LETTERMODIFIER_SYMBOLNON_SPACING_MARKOTHER_LETTEROTHER_NUMBEROTHER_PUNCTUATIONOTHER_SYMBOLPARAGRAPH_SEPARATORPRIVATE_USESPACE_SEPARATORSTART_PUNCTUATIONSURROGATETITLECASE_LETTERUNASSIGNEDUPPERCASE_LETTER
getType
public static int getType(int codePoint)
- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для проверки. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С момента:
- 1.5
- См. также:
-
COMBINING_SPACING_MARKCONNECTOR_PUNCTUATIONCONTROLCURRENCY_SYMBOLDASH_PUNCTUATIONDECIMAL_DIGIT_NUMBERENCLOSING_MARKEND_PUNCTUATIONFINAL_QUOTE_PUNCTUATIONFORMATINITIAL_QUOTE_PUNCTUATIONLETTER_NUMBERLINE_SEPARATORLOWERCASE_LETTERMATH_SYMBOLMODIFIER_LETTERMODIFIER_SYMBOLNON_SPACING_MARKOTHER_LETTEROTHER_NUMBEROTHER_PUNCTUATIONOTHER_SYMBOLPARAGRAPH_SEPARATORPRIVATE_USESPACE_SEPARATORSTART_PUNCTUATIONSURROGATETITLECASE_LETTERUNASSIGNEDUPPERCASE_LETTER
forDigit
public static char forDigit(int digit, int radix)
radix не является допустимым радиксом, или значение digit не является допустимой цифрой в заданном радиксе, возвращается нулевой символ ('\u0000'). Аргумент radix является допустимым, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit является допустимым, если 0 <= digit < radix.
Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit- число для преобразования в символ. -
radix- радикс. - Возвращает:
- представление символа заданной цифры в заданном радиксе.
- См. также:
getDirectionality
public static byte getDirectionality(char ch)
char значений равно DIRECTIONALITY_UNDEFINED. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch-char, для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - С момента:
- 1.4
- См. также:
-
DIRECTIONALITY_UNDEFINEDDIRECTIONALITY_LEFT_TO_RIGHTDIRECTIONALITY_RIGHT_TO_LEFTDIRECTIONALITY_RIGHT_TO_LEFT_ARABICDIRECTIONALITY_EUROPEAN_NUMBERDIRECTIONALITY_EUROPEAN_NUMBER_SEPARATORDIRECTIONALITY_EUROPEAN_NUMBER_TERMINATORDIRECTIONALITY_ARABIC_NUMBERDIRECTIONALITY_COMMON_NUMBER_SEPARATORDIRECTIONALITY_NONSPACING_MARKDIRECTIONALITY_BOUNDARY_NEUTRALDIRECTIONALITY_PARAGRAPH_SEPARATORDIRECTIONALITY_SEGMENT_SEPARATORDIRECTIONALITY_WHITESPACEDIRECTIONALITY_OTHER_NEUTRALSDIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDINGDIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDEDIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDINGDIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDEDIRECTIONALITY_POP_DIRECTIONAL_FORMATDIRECTIONALITY_LEFT_TO_RIGHT_ISOLATEDIRECTIONALITY_RIGHT_TO_LEFT_ISOLATEDIRECTIONALITY_FIRST_STRONG_ISOLATEDIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
getDirectionality
public static byte getDirectionality(int codePoint)
DIRECTIONALITY_UNDEFINED.- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- С момента:
- 1.5
- См. также:
-
DIRECTIONALITY_UNDEFINEDDIRECTIONALITY_LEFT_TO_RIGHTDIRECTIONALITY_RIGHT_TO_LEFTDIRECTIONALITY_RIGHT_TO_LEFT_ARABICDIRECTIONALITY_EUROPEAN_NUMBERDIRECTIONALITY_EUROPEAN_NUMBER_SEPARATORDIRECTIONALITY_EUROPEAN_NUMBER_TERMINATORDIRECTIONALITY_ARABIC_NUMBERDIRECTIONALITY_COMMON_NUMBER_SEPARATORDIRECTIONALITY_NONSPACING_MARKDIRECTIONALITY_BOUNDARY_NEUTRALDIRECTIONALITY_PARAGRAPH_SEPARATORDIRECTIONALITY_SEGMENT_SEPARATORDIRECTIONALITY_WHITESPACEDIRECTIONALITY_OTHER_NEUTRALSDIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDINGDIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDEDIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDINGDIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDEDIRECTIONALITY_POP_DIRECTIONAL_FORMATDIRECTIONALITY_LEFT_TO_RIGHT_ISOLATEDIRECTIONALITY_RIGHT_TO_LEFT_ISOLATEDIRECTIONALITY_FIRST_STRONG_ISOLATEDIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
isMirrored
public static boolean isMirrored(char ch)
'\u0028' ЛЕВАЯ СКОБКА семантически определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch-char, для которого запрашивается свойство зеркальности. - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определен. - С момента:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
'\u0028' ЛЕВАЯ СКОБКА семантически определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.- Параметры:
-
codePoint- символ (кодовый пункт Юникода) для проверки. - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определен. - С момента:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter- объект Character для сравнения. - Возвращает:
- значение 0, если переданный аргумент равен этому объекту; значение меньше 0, если этот объект численно меньше, чем переданный аргумент; и значение больше 0, если этот объект численно больше, чем переданный аргумент (без учёта знака). Обратите внимание, что это строго численное сравнение; оно не зависит от языка.
- С:
- 1.2
compare
public static int compare(char x, char y)
Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x- первое значение char для сравнения -
y- второе значение char для сравнения - Возвращает:
- значение 0, если значения равны; значение меньше 0, если первое значение меньше второго; и значение больше 0, если первое значение больше второго
- С:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
- Параметры:
-
ch- Значение char, для которого необходимо изменить порядок байтов. - Возвращает:
- значение, полученное путём изменения (или, эквивалентно, перестановки) байтов в указанном значении char.
- С:
- 1.5
getName
public static String getName(int codePoint)
unassigned. Примечание: если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), возвращаемое имя такое же, как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
- Параметры:
-
codePoint- символ (код символа Unicode) - Возвращает:
- имя Unicode указанного символа, или null, если коду символа не присвоено имя.
- Исключения:
-
IllegalArgumentException- если указанный код символа не является допустимым кодом Unicode. - С:
- 1.7
codePointOf
public static int codePointOf(String name)
Примечание: если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), его имя определяется как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Сопоставление имен выполняется без учёта регистра, при этом любые начальные и конечные пробелы удаляются.
- Параметры:
-
name- имя символа Unicode - Возвращает:
- значение кода символа, заданного его именем.
- Исключения:
-
IllegalArgumentException- если указанное имя символа не является допустимым именем символа Unicode. -
NullPointerException- еслиnameнеnull - С:
- 9
© 1993, 2021, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/17/docs/api/java.base/java/lang/Character.html