Класс Character
- Все реализуемые интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Character является классом-обёрткой для значений примитивного типа char. Объект типа Character содержит одно поле типа char. Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.), а также для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие Unicode
Поля и методы класса Character определяются на основе сведений о символах из стандарта Unicode, в частности файла UnicodeData, входящего в базу данных символов Unicode. Этот файл задаёт свойства, включая имя и категорию, для каждой назначенной кодовой точки Unicode или диапазона символов. Файл доступен на сайте консорциума Unicode: http://www.unicode.org.
Сведения о символах основаны на версии 16.0 стандарта Unicode.
Платформа Java со временем поддерживала различные версии стандарта Unicode. Переходы на новые версии стандарта Unicode происходили в следующих выпусках Java; в каждом указан номер новой версии:
| Выпуск Java | Версия Unicode |
|---|---|
| Java SE 24 | Unicode 16.0 |
| Java SE 22 | Unicode 15.1 |
| Java SE 20 | Unicode 15.0 |
| Java SE 19 | Unicode 14.0 |
| Java SE 15 | Unicode 13.0 |
| Java SE 13 | Unicode 12.1 |
| Java SE 12 | Unicode 11.0 |
| Java SE 11 | Unicode 10.0 |
| Java SE 9 | Unicode 8.0 |
| Java SE 8 | Unicode 6.2 |
| Java SE 7 | Unicode 6.0 |
| Java SE 5.0 | Unicode 4.0 |
| Java SE 1.4 | Unicode 3.0 |
| JDK 1.1 | Unicode 2.0 |
| JDK 1.0.2 | Unicode 1.1.5 |
Представление символов Unicode
Тип данных char (а значит, и значение, инкапсулированное объектом Character) основан на исходной спецификации Unicode, в которой символы определялись как сущности фиксированной ширины 16 бит. Впоследствии стандарт Unicode был изменён, чтобы допустить символы, представление которых требует более 16 бит. Диапазон допустимых кодовых точек теперь составляет от U+0000 до U+10FFFF; они называются скалярными значениями Unicode. (См. определение обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда называют основной многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char: первое берётся из диапазона старших суррогатов (\uD800-\uDBFF), второе — из диапазона младших суррогатов (\uDC00-\uDFFF).
Таким образом, значение char представляет кодовые точки основной многоязычной плоскости (BMP), включая суррогатные кодовые точки, или кодовые единицы кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Младшие (наименее значащие) 21 бит int используются для представления кодовых точек Unicode, а старшие (наиболее значащие) 11 бит должны быть равны нулю. Если не указано иное, поведение методов в отношении дополнительных символов и суррогатных значений char следующее:
- Методы, принимающие только значение
char, не поддерживают дополнительные символы. Они рассматривают значенияcharиз суррогатных диапазонов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, хотя это конкретное значение, за которым в строке следует любое значение младшего суррогата, представляло бы букву. - Методы, принимающие значение
int, поддерживают все символы Unicode, включая дополнительные символы. Например,Character.isLetter(0x2F81A)возвращаетtrue, поскольку значение кодовой точки соответствует букве (иероглифу CJK).
В документации API Java SE термин кодовая точка Unicode используется для значений символов в диапазоне от U+0000 до U+10FFFF, а термин кодовая единица Unicode — для 16-разрядных значений char, являющихся кодовыми единицами кодировки UTF-16. Дополнительные сведения о терминологии Unicode см. в глоссарии Unicode.
Это класс, основанный на значениях; программистам следует считать экземпляры, которые равны, взаимозаменяемыми и не использовать экземпляры для синхронизации, иначе поведение может быть непредсказуемым. Например, в одном из будущих выпусков синхронизация может завершиться неудачно.
- Начиная с:
- 1.0
- Внешние спецификации
- См. также:
Краткое описание вложенных классов
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class |
Character.Subset |
Экземпляры этого класса представляют определённые подмножества набора символов Unicode. |
static final class |
Character.UnicodeBlock |
Семейство подмножеств символов, представляющих блоки символов, определённые в спецификации Unicode. |
static enum |
Character.UnicodeScript |
Семейство подмножеств символов, представляющих письменности, определённые в приложении № 24 к стандарту Unicode: названия письменностей. |
Краткое описание полей
| Модификатор и тип | Поле | Описание |
|---|---|---|
static final int |
BYTES |
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме. |
static final byte |
COMBINING_SPACING_MARK |
Общая категория "Mc" в спецификации Unicode. |
static final byte |
CONNECTOR_PUNCTUATION |
Общая категория "Pc" в спецификации Unicode. |
static final byte |
CONTROL |
Общая категория "Cc" в спецификации Unicode. |
static final byte |
CURRENCY_SYMBOL |
Общая категория "Sc" в спецификации Unicode. |
static final byte |
DASH_PUNCTUATION |
Общая категория "Pd" в спецификации Unicode. |
static final byte |
DECIMAL_DIGIT_NUMBER |
Общая категория "Nd" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_ARABIC_NUMBER |
Слабый двунаправленный тип символа "AN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL |
Слабый двунаправленный тип символа "BN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR |
Слабый двунаправленный тип символа "CS" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER |
Слабый двунаправленный тип символа "EN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR |
Слабый двунаправленный тип символа "ES" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR |
Слабый двунаправленный тип символа "ET" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_FIRST_STRONG_ISOLATE |
Слабый двунаправленный тип символа "FSI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT |
Сильный двунаправленный тип символа "L" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING |
Сильный двунаправленный тип символа "LRE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE |
Слабый двунаправленный тип символа "LRI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE |
Сильный двунаправленный тип символа "LRO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_NONSPACING_MARK |
Слабый двунаправленный тип символа "NSM" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_OTHER_NEUTRALS |
Нейтральный двунаправленный тип символа "ON" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR |
Нейтральный двунаправленный тип символа "B" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT |
Слабый двунаправленный тип символа "PDF" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE |
Слабый двунаправленный тип символа "PDI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT |
Сильный двунаправленный тип символа "R" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC |
Сильный двунаправленный тип символа "AL" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING |
Сильный двунаправленный тип символа "RLE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE |
Слабый двунаправленный тип символа "RLI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE |
Сильный двунаправленный тип символа "RLO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_SEGMENT_SEPARATOR |
Нейтральный двунаправленный тип символа "S" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_UNDEFINED |
Неопределённый двунаправленный тип символа. |
static final byte |
DIRECTIONALITY_WHITESPACE |
Нейтральный двунаправленный тип символа "WS" в спецификации Unicode. |
static final byte |
ENCLOSING_MARK |
Общая категория "Me" в спецификации Unicode. |
static final byte |
END_PUNCTUATION |
Общая категория "Pe" в спецификации Unicode. |
static final byte |
FINAL_QUOTE_PUNCTUATION |
Общая категория "Pf" в спецификации Unicode. |
static final byte |
FORMAT |
Общая категория "Cf" в спецификации Unicode. |
static final byte |
INITIAL_QUOTE_PUNCTUATION |
Общая категория "Pi" в спецификации Unicode. |
static final byte |
LETTER_NUMBER |
Общая категория "Nl" в спецификации Unicode. |
static final byte |
LINE_SEPARATOR |
Общая категория "Zl" в спецификации Unicode. |
static final byte |
LOWERCASE_LETTER |
Общая категория "Ll" в спецификации Unicode. |
static final byte |
MATH_SYMBOL |
Общая категория "Sm" в спецификации Unicode. |
static final int |
MAX_CODE_POINT |
Максимальное значение кодовой точки Unicode, константа U+10FFFF. |
static final char |
MAX_HIGH_SURROGATE |
Максимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uDBFF'. |
static final char |
MAX_LOW_SURROGATE |
Максимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final int |
MAX_RADIX |
Максимальное основание системы счисления, доступное для преобразования в строки и из строк. |
static final char |
MAX_SURROGATE |
Максимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final char |
MAX_VALUE |
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'. |
static final int |
MIN_CODE_POINT |
Минимальное значение кодовой точки Unicode, константа U+0000. |
static final char |
MIN_HIGH_SURROGATE |
Минимальное значение кодовой единицы старшего суррогата Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_LOW_SURROGATE |
Минимальное значение кодовой единицы младшего суррогата Unicode в кодировке UTF-16, константа '\uDC00'. |
static final int |
MIN_RADIX |
Минимальное основание системы счисления, доступное для преобразования в строки и из строк. |
static final int |
MIN_SUPPLEMENTARY_CODE_POINT |
Минимальное значение дополнительной кодовой точки Unicode, константа U+10000. |
static final char |
MIN_SURROGATE |
Минимальное значение кодовой единицы суррогата Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_VALUE |
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'. |
static final byte |
MODIFIER_LETTER |
Общая категория "Lm" в спецификации Unicode. |
static final byte |
MODIFIER_SYMBOL |
Общая категория "Sk" в спецификации Unicode. |
static final byte |
NON_SPACING_MARK |
Общая категория "Mn" в спецификации Unicode. |
static final byte |
OTHER_LETTER |
Общая категория "Lo" в спецификации Unicode. |
static final byte |
OTHER_NUMBER |
Общая категория "No" в спецификации Unicode. |
static final byte |
OTHER_PUNCTUATION |
Общая категория "Po" в спецификации Unicode. |
static final byte |
OTHER_SYMBOL |
Общая категория "So" в спецификации Unicode. |
static final byte |
PARAGRAPH_SEPARATOR |
Общая категория "Zp" в спецификации Unicode. |
static final byte |
PRIVATE_USE |
Общая категория "Co" в спецификации Unicode. |
static final int |
SIZE |
Количество битов, используемых для представления значения char в беззнаковой двоичной форме, константа 16. |
static final byte |
SPACE_SEPARATOR |
Общая категория "Zs" в спецификации Unicode. |
static final byte |
START_PUNCTUATION |
Общая категория "Ps" в спецификации Unicode. |
static final byte |
SURROGATE |
Общая категория "Cs" в спецификации Unicode. |
static final byte |
TITLECASE_LETTER |
Общая категория "Lt" в спецификации Unicode. |
static final Class |
TYPE |
Экземпляр Class, представляющий примитивный тип char. |
static final byte |
UNASSIGNED |
Общая категория "Cn" в спецификации Unicode. |
static final byte |
UPPERCASE_LETTER |
Общая категория "Lu" в спецификации Unicode. |
Краткое описание конструкторов
| Конструктор | Описание |
|---|---|
Character |
Устарел. Использование этого конструктора редко бывает целесообразным. |
Краткое описание методов
| Модификатор и тип | Метод | Описание |
|---|---|---|
static int |
charCount |
Определяет количество значений char, необходимых для представления указанного символа (кодовой точки Unicode). |
char |
charValue() |
Возвращает значение этого объекта Character. |
static int |
codePointAt |
Возвращает кодовую точку по заданному индексу массива char. |
static int |
codePointAt |
Возвращает кодовую точку по заданному индексу массива char, используя только элементы массива с index меньше limit. |
static int |
codePointAt |
Возвращает кодовую точку по заданному индексу CharSequence. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу массива char. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу массива char, используя только элементы массива с index больше или равным start. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу CharSequence. |
static int |
codePointCount |
Возвращает количество кодовых точек Unicode в подмассиве аргумента массива char. |
static int |
codePointCount |
Возвращает количество кодовых точек Unicode в диапазоне текста указанной последовательности символов. |
static int |
codePointOf |
Возвращает значение кодовой точки символа Unicode, указанного заданным именем символа. |
static int |
compare |
Сравнивает два значения char численно. |
int |
compareTo |
Сравнивает два объекта Character численно. |
Optional |
describeConstable() |
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра. |
static int |
digit |
Возвращает числовое значение символа ch в указанной системе счисления. |
static int |
digit |
Возвращает числовое значение указанного символа (кодовой точки Unicode) в заданной системе счисления. |
boolean |
equals |
Сравнивает этот объект с указанным объектом. |
static char |
forDigit |
Определяет представление символа для заданной цифры в указанной системе счисления. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для заданного символа. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для заданного символа (кодовой точки Unicode). |
static String |
getName |
Возвращает имя указанного символа codePoint или null, если кодовая точка unassigned. |
static int |
getNumericValue |
Возвращает значение int, представляемое указанным символом Unicode. |
static int |
getNumericValue |
Возвращает значение int, представляемое указанным символом (кодовой точкой Unicode). |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
int |
hashCode() |
Возвращает хеш-код этого объекта Character; он равен результату вызова charValue(). |
static int |
hashCode |
Возвращает хеш-код значения char; совместим с Character.hashCode(). |
static char |
highSurrogate |
Возвращает старший суррогат ( кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. |
static boolean |
isAlphabetic |
Определяет, является ли указанный символ (кодовая точка Unicode) буквенным. |
static boolean |
isBmpCodePoint |
Определяет, находится ли указанный символ (кодовая точка Unicode) в основной многоязычной плоскости (BMP). |
static boolean |
isDefined |
Определяет, определен ли символ в Unicode. |
static boolean |
isDefined |
Определяет, определен ли символ (кодовая точка Unicode) в Unicode. |
static boolean |
isDigit |
Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit |
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой. |
static boolean |
isEmoji |
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи. |
static boolean |
isEmojiComponent |
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом эмодзи. |
static boolean |
isEmojiModifier |
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором эмодзи. |
static boolean |
isEmojiModifierBase |
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом-модификатором эмодзи. |
static boolean |
isEmojiPresentation |
Определяет, обладает ли указанный символ (кодовая точка Unicode) по умолчанию свойством представления эмодзи. |
static boolean |
isExtendedPictographic |
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом. |
static boolean |
isHighSurrogate |
Определяет, является ли заданное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица ведущего суррогата). |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или идентификаторе Unicode. |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или идентификаторе Unicode. |
static boolean |
isIdeographic |
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайской, японской, корейской и вьетнамской), как определено стандартом Unicode. |
static boolean |
isISOControl |
Определяет, является ли указанный символ управляющим символом ISO. |
static boolean |
isISOControl |
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли указанный символ входить в идентификатор Java в позиции, отличной от первой. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли символ (кодовая точка Unicode) входить в идентификатор Java в позиции, отличной от первой. |
static boolean |
isJavaIdentifierStart |
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java. |
static boolean |
isJavaIdentifierStart |
Определяет, допустим ли символ (кодовая точка Unicode) в качестве первого символа идентификатора Java. |
static boolean |
isJavaLetter |
Устарел. Заменен методом isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit |
Устарел. Заменен методом isJavaIdentifierPart(char). |
static boolean |
isLetter |
Определяет, является ли указанный символ буквой. |
static boolean |
isLetter |
Определяет, является ли указанный символ (кодовая точка Unicode) буквой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ строчным. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ (кодовая точка Unicode) строчным. |
static boolean |
isLowSurrogate |
Определяет, является ли заданное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица завершающего суррогата). |
static boolean |
isMirrored |
Определяет, является ли символ зеркальным согласно спецификации Unicode. |
static boolean |
isMirrored |
Определяет, является ли указанный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode. |
static boolean |
isSpace |
Устарел. Заменен методом isWhitespace(char). |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ символом-пробелом Unicode. |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ (кодовая точка Unicode) символом-пробелом Unicode. |
static boolean |
isSupplementaryCodePoint |
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов. |
static boolean |
isSurrogate |
Определяет, является ли заданное значение char суррогатной кодовой единицей Unicode. |
static boolean |
isSurrogatePair |
Определяет, является ли указанная пара значений char допустимой суррогатной парой Unicode. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ прописным символом с заглавной формой. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ (кодовая точка Unicode) прописным символом с заглавной формой. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ входить в идентификатор Unicode в позиции, отличной от первой. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ (кодовая точка Unicode) входить в идентификатор Unicode в позиции, отличной от первой. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ прописным. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ (кодовая точка Unicode) прописным. |
static boolean |
isValidCodePoint |
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ пробельным символом согласно Java. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java. |
static char |
lowSurrogate |
Возвращает младший суррогат ( кодовую единицу младшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. |
static int |
offsetByCodePoints |
Возвращает индекс в заданном подмассиве char, смещенный от заданного index на codePointOffset кодовых точек. |
static int |
offsetByCodePoints |
Возвращает индекс в заданной последовательности символов, смещенный от заданного index на codePointOffset кодовых точек. |
static char |
reverseBytes |
Возвращает значение, полученное путем обращения порядка байтов указанного значения char. |
static char[] |
toChars |
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16, сохраненное в массиве char. |
static int |
toChars |
Преобразует указанный символ (кодовую точку Unicode) в представление UTF-16. |
static int |
toCodePoint |
Преобразует указанную суррогатную пару в значение дополнительной кодовой точки. |
static char |
toLowerCase |
Преобразует аргумент-символ в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData. |
static int |
toLowerCase |
Преобразует аргумент-символ (кодовую точку Unicode) в нижний регистр, используя сведения о преобразовании регистра из файла UnicodeData. |
String |
toString() |
Возвращает объект String, представляющий значение этого Character. |
static String |
toString |
Возвращает объект String, представляющий указанное значение char. |
static String |
toString |
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode). |
static char |
toTitleCase |
Преобразует аргумент-символ в заглавную форму, используя сведения о преобразовании регистра из файла UnicodeData. |
static int |
toTitleCase |
Преобразует аргумент-символ (кодовую точку Unicode) в заглавную форму, используя сведения о преобразовании регистра из файла UnicodeData. |
static char |
toUpperCase |
Преобразует аргумент-символ в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData. |
static int |
toUpperCase |
Преобразует аргумент-символ (кодовую точку Unicode) в верхний регистр, используя сведения о преобразовании регистра из файла UnicodeData. |
static Character |
valueOf |
Возвращает экземпляр Character, представляющий указанное значение char. |
Подробное описание полей
MIN_RADIX
public static final int MIN_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MAX_RADIX
public static final int MAX_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MIN_VALUE
public static final char MIN_VALUE
char, '\u0000'.- С версии:
- 1.0.2
- См. также:
MAX_VALUE
public static final char MAX_VALUE
char, '\uFFFF'.- С версии:
- 1.0.2
- См. также:
TYPE
public static final Class<Character> TYPE
Class, представляющий примитивный тип char.- С версии:
- 1.1
UNASSIGNED
public static final byte UNASSIGNED
- С версии:
- 1.1
- См. также:
UPPERCASE_LETTER
public static final byte UPPERCASE_LETTER
- С версии:
- 1.1
- См. также:
LOWERCASE_LETTER
public static final byte LOWERCASE_LETTER
- С версии:
- 1.1
- См. также:
TITLECASE_LETTER
public static final byte TITLECASE_LETTER
- С версии:
- 1.1
- См. также:
MODIFIER_LETTER
public static final byte MODIFIER_LETTER
- С версии:
- 1.1
- См. также:
OTHER_LETTER
public static final byte OTHER_LETTER
- С версии:
- 1.1
- См. также:
NON_SPACING_MARK
public static final byte NON_SPACING_MARK
- С версии:
- 1.1
- См. также:
ENCLOSING_MARK
public static final byte ENCLOSING_MARK
- С версии:
- 1.1
- См. также:
COMBINING_SPACING_MARK
public static final byte COMBINING_SPACING_MARK
- С версии:
- 1.1
- См. также:
DECIMAL_DIGIT_NUMBER
public static final byte DECIMAL_DIGIT_NUMBER
- С версии:
- 1.1
- См. также:
LETTER_NUMBER
public static final byte LETTER_NUMBER
- С версии:
- 1.1
- См. также:
OTHER_NUMBER
public static final byte OTHER_NUMBER
- С версии:
- 1.1
- См. также:
SPACE_SEPARATOR
public static final byte SPACE_SEPARATOR
- С версии:
- 1.1
- См. также:
LINE_SEPARATOR
public static final byte LINE_SEPARATOR
- С версии:
- 1.1
- См. также:
PARAGRAPH_SEPARATOR
public static final byte PARAGRAPH_SEPARATOR
- С версии:
- 1.1
- См. также:
CONTROL
public static final byte CONTROL
- С версии:
- 1.1
- См. также:
FORMAT
public static final byte FORMAT
- С версии:
- 1.1
- См. также:
PRIVATE_USE
public static final byte PRIVATE_USE
- С версии:
- 1.1
- См. также:
SURROGATE
public static final byte SURROGATE
- С версии:
- 1.1
- См. также:
DASH_PUNCTUATION
public static final byte DASH_PUNCTUATION
- С версии:
- 1.1
- См. также:
START_PUNCTUATION
public static final byte START_PUNCTUATION
- С версии:
- 1.1
- См. также:
END_PUNCTUATION
public static final byte END_PUNCTUATION
- С версии:
- 1.1
- См. также:
CONNECTOR_PUNCTUATION
public static final byte CONNECTOR_PUNCTUATION
- С версии:
- 1.1
- См. также:
OTHER_PUNCTUATION
public static final byte OTHER_PUNCTUATION
- С версии:
- 1.1
- См. также:
MATH_SYMBOL
public static final byte MATH_SYMBOL
- С версии:
- 1.1
- См. также:
CURRENCY_SYMBOL
public static final byte CURRENCY_SYMBOL
- С версии:
- 1.1
- См. также:
MODIFIER_SYMBOL
public static final byte MODIFIER_SYMBOL
- С версии:
- 1.1
- См. также:
OTHER_SYMBOL
public static final byte OTHER_SYMBOL
- С версии:
- 1.1
- См. также:
INITIAL_QUOTE_PUNCTUATION
public static final byte INITIAL_QUOTE_PUNCTUATION
- С версии:
- 1.4
- См. также:
FINAL_QUOTE_PUNCTUATION
public static final byte FINAL_QUOTE_PUNCTUATION
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_UNDEFINED
public static final byte DIRECTIONALITY_UNDEFINED
char в спецификации Unicode направление не задано.- С версии:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_ARABIC_NUMBER
public static final byte DIRECTIONALITY_ARABIC_NUMBER
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_NONSPACING_MARK
public static final byte DIRECTIONALITY_NONSPACING_MARK
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_BOUNDARY_NEUTRAL
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_PARAGRAPH_SEPARATOR
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_SEGMENT_SEPARATOR
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
- С версии:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
- С версии:
- 9
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
- С версии:
- 9
- См. также:
DIRECTIONALITY_FIRST_STRONG_ISOLATE
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
- С версии:
- 9
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
- С версии:
- 9
- См. также:
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
'\uD800'. Старший суррогат также называется ведущим суррогатом.- Начиная с:
- 1.5
- См. также:
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
'\uDBFF'. Старший суррогат также называется ведущим суррогатом.- Начиная с:
- 1.5
- См. также:
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
'\uDC00'. Младший суррогат также называется замыкающим суррогатом.- Начиная с:
- 1.5
- См. также:
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
'\uDFFF'. Младший суррогат также называется замыкающим суррогатом.- Начиная с:
- 1.5
- См. также:
MIN_SURROGATE
public static final char MIN_SURROGATE
'\uD800'.- Начиная с:
- 1.5
- См. также:
MAX_SURROGATE
public static final char MAX_SURROGATE
'\uDFFF'.- Начиная с:
- 1.5
- См. также:
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
U+10000.- Начиная с:
- 1.5
- См. также:
MIN_CODE_POINT
public static final int MIN_CODE_POINT
U+0000.- Начиная с:
- 1.5
- См. также:
MAX_CODE_POINT
public static final int MAX_CODE_POINT
U+10FFFF.- Начиная с:
- 1.5
- См. также:
SIZE
public static final int SIZE
char в беззнаковой двоичной форме, константа 16.- Начиная с:
- 1.5
- См. также:
BYTES
public static final int BYTES
char в беззнаковой двоичной форме.- Начиная с:
- 1.8
- См. также:
Подробное описание конструкторов
Character
@Deprecated(since="9") public Character(char value)
valueOf(char), поскольку он, вероятно, обеспечит значительно более высокую эффективность использования памяти и производительность.Character, представляющий указанное значение char.- Параметры:
-
value— значение, которое будет представлено объектомCharacter.
Подробное описание методов
describeConstable
public Optional<DynamicConstantDesc<Character>> describeConstable()
Optional, содержащий номинальный дескриптор этого экземпляра.- Указано в:
-
describeConstableв интерфейсеConstable - Возвращает:
Optional, описывающий экземпляр Character- Начиная с:
- 15
valueOf
public static Character valueOf(char c)
Character, представляющий указанное значение char. Если создавать новый экземпляр Character не требуется, обычно следует предпочесть этот метод конструктору Character(char), поскольку этот метод, кэшируя часто запрашиваемые значения, вероятно, обеспечит значительно более высокую эффективность использования памяти и производительность. Этот метод всегда кэширует значения в диапазоне от
'\u0000' до '\u007F' включительно и может кэшировать другие значения за пределами этого диапазона.- Параметры:
-
c— значение типа char. - Возвращает:
- экземпляр
Character, представляющийc. - Начиная с:
- 1.5
charValue
public char charValue()
Character.- Возвращает:
- примитивное значение
char, представленное этим объектом.
hashCode
hashCode
public static int hashCode(char value)
char; совместим с Character.hashCode().- Параметры:
-
value— значениеchar, для которого требуется вернуть хэш-код. - Возвращает:
- значение хэш-кода значения
char. - Начиная с:
- 1.8
equals
public boolean equals(Object obj)
true тогда и только тогда, когда аргумент не равен null и является объектом Character, представляющим то же значение char, что и этот объект.toString
public String toString()
String, представляющий значение этого объекта Character. Результатом является строка длины 1, единственным компонентом которой служит примитивное значение char, представленное этим объектом Character.toString
public static String toString(char c)
String, представляющий указанный char. Результатом является строка длины 1, состоящая только из указанного char.- Примечание к API:
- Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные символы, используйте метод
toString(int). - Параметры:
-
c—charдля преобразования - Возвращает:
- строковое представление указанного
char - Начиная с:
- 1.4
toString
public static String toString(int codePoint)
String, представляющий указанный символ (кодовую точку Unicode). Результатом является строка длины 1 или 2, состоящая только из указанного codePoint.- Параметры:
-
codePoint—codePointдля преобразования - Возвращает:
- строковое представление указанного
codePoint - Выбрасывает:
-
IllegalArgumentException— если указанное значениеcodePointне является допустимой кодовой точкой Unicode. - Начиная с:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
- Параметры:
-
codePoint— кодовая точка Unicode для проверки - Возвращает:
-
true, если указанное значение кодовой точки находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно; в противном случае —false. - Начиная с:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
char.isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для проверки - Возвращает:
-
true, если указанная кодовая точка находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно; в противном случае —false. - Начиная с:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица ведущего суррогата). Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch— значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isLowSurrogate
public static boolean isLowSurrogate(char ch)
char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица замыкающего суррогата). Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch— значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isSurrogate
public static boolean isSurrogate(char ch)
char кодовой единицей суррогата Unicode. Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
Значение char является кодовой единицей суррогата тогда и только тогда, когда оно представляет собой кодовую единицу младшего суррогата или старшего суррогата.
- Параметры:
-
ch— значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно; в противном случае —false. - Начиная с:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high, char low)
char допустимой парой суррогатов Unicode. Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Параметры:
-
high— значение кодовой единицы старшего суррогата для проверки -
low— значение кодовой единицы младшего суррогата для проверки - Возвращает:
-
true, если указанные значения кодовых единиц старшего и младшего суррогатов образуют допустимую пару суррогатов; в противном случае —false. - Начиная с:
- 1.5
charCount
public static int charCount(int codePoint)
char, необходимых для представления указанного символа (кодовой точки Unicode). Если указанный символ равен 0x10000 или больше, метод возвращает 2. В противном случае метод возвращает 1. Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. При необходимости вызывающий код должен проверить значение символа с помощью isValidCodePoint.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для проверки. - Возвращает:
- 2, если символ является допустимым дополнительным символом; в противном случае — 1.
- Начиная с:
- 1.5
- См. также:
toCodePoint
public static int toCodePoint(char high, char low)
isSurrogatePair.- Параметры:
-
high— кодовая единица старшего суррогата -
low— кодовая единица младшего суррогата - Возвращает:
- дополнительную кодовую точку, образованную указанной парой суррогатов.
- Начиная с:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq, int index)
CharSequence. Если значение char по указанному индексу в CharSequence находится в диапазоне старших суррогатов, следующий индекс меньше длины CharSequence, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
seq— последовательность значенийchar(кодовых единиц Unicode) -
index— индекс значенияchar(кодовых единиц Unicode) вseq, которое требуется преобразовать - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиseqравен null. -
IndexOutOfBoundsException— если значениеindexотрицательно или не меньшеseq.length(). - Начиная с:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index)
char. Если значение char по указанному индексу в массиве char находится в диапазоне старших суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
a— массивchar -
index— индекс значенияchar(кодовых единиц Unicode) в массивеchar, которое требуется преобразовать - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиaравен null. -
IndexOutOfBoundsException— если значениеindexотрицательно или не меньше длины массиваchar. - Начиная с:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index, int limit)
char; использовать можно только элементы массива с index меньше limit. Если значение char по указанному индексу в массиве char находится в диапазоне старших суррогатов, следующий индекс меньше limit, а значение char по следующему индексу находится в диапазоне младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
a— массивchar -
index— индекс значенияchar(кодовых единиц Unicode) в массивеchar, которое требуется преобразовать -
limit— индекс после последнего элемента массива, который можно использовать в массивеchar - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиaравен null. -
IndexOutOfBoundsException— если аргументindexотрицателен или не меньше аргументаlimit, либо если аргументlimitотрицателен или больше длины массиваchar. - Начиная с:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq, int index)
CharSequence. Если значение char в позиции (index - 1) в CharSequence находится в диапазоне младших суррогатов, (index - 2) не является отрицательным, а значение char в позиции (index - 2) в CharSequence находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).- Параметры:
-
seq— экземплярCharSequence -
index— индекс после кодовой точки, которую следует вернуть - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Выбрасывает:
-
NullPointerException— еслиseqравен null. -
IndexOutOfBoundsException— если аргументindexменьше 1 или большеseq.length(). - Начиная с:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index)
char. Если значение char в позиции (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не является отрицательным, а значение char в позиции (index - 2) в массиве char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).- Параметры:
-
a— массивchar -
index— индекс после кодовой точки, которую следует вернуть - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Выбрасывает:
-
NullPointerException— еслиaравен null. -
IndexOutOfBoundsException— если аргументindexменьше 1 или больше длины массиваchar - Начиная с:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index, int start)
char; использовать можно только элементы массива с index, большим или равным start. Если значение char в позиции (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не меньше start, а значение char в позиции (index - 2) в массиве char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в позиции (index - 1).- Параметры:
-
a— массивchar -
index— индекс после кодовой точки, которую следует вернуть -
start— индекс первого элемента массива в массивеchar - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Выбрасывает:
-
NullPointerException— еслиaравен null. -
IndexOutOfBoundsException— если аргументindexне больше аргументаstartили больше длины массиваchar, либо если аргументstartотрицателен или не меньше длины массиваchar. - Начиная с:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint— дополнительный символ (кодовая точка Unicode) - Возвращает:
- кодовую единицу ведущего суррогата, используемую для представления символа в кодировке UTF-16
- С версии:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint— дополнительный символ (кодовая точка Unicode) - Возвращает:
- кодовую единицу замыкающего суррогата, используемую для представления символа в кодировке UTF-16
- С версии:
- 1.7
toChars
public static int toChars(int codePoint, char[] dst, int dstIndex)
dst[dstIndex], а возвращается 1. Если указанная кодовая точка является дополнительным символом, значения суррогатов сохраняются в dst[dstIndex] (старшего суррогата) и dst[dstIndex+1] (младшего суррогата), а возвращается 2.- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо преобразовать. -
dst— массивchar, в который сохраняется значение UTF-16 дляcodePoint. -
dstIndex— начальный индекс в массивеdst, по которому сохраняется преобразованное значение. - Возвращает:
- 1, если кодовая точка является кодовой точкой BMP; 2, если кодовая точка является дополнительной кодовой точкой.
- Исключения:
-
IllegalArgumentException— если указаннаяcodePointне является допустимой кодовой точкой Unicode. -
NullPointerException— если указаннаяdstравна null. -
IndexOutOfBoundsException— еслиdstIndexотрицателен или не меньшеdst.length, либо если вdst, начиная сdstIndex, недостаточно элементов массива для сохранения результирующих значенийchar. (ЕслиdstIndexравноdst.length-1и указаннаяcodePointявляется дополнительным символом, значение старшего суррогата не сохраняется вdst[dstIndex].) - С версии:
- 1.5
toChars
public static char[] toChars(int codePoint)
char. Если указанная кодовая точка является значением BMP (базовой многоязычной плоскости, или плоскости 0), результирующий массив char содержит то же значение, что и codePoint. Если указанная кодовая точка является дополнительной кодовой точкой, результирующий массив char содержит соответствующую суррогатную пару.- Параметры:
-
codePoint— кодовая точка Unicode - Возвращает:
- массив
char, содержащий представление UTF-16 дляcodePoint. - Исключения:
-
IllegalArgumentException— если указаннаяcodePointне является допустимой кодовой точкой Unicode. - С версии:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина диапазона текста (в charах) равна endIndex-beginIndex. Непарные суррогаты в диапазоне текста считаются отдельными кодовыми точками.- Параметры:
-
seq— последовательность символов -
beginIndex— индекс первогоcharдиапазона текста. -
endIndex— индекс после последнегоcharдиапазона текста. - Возвращает:
- количество кодовых точек Unicode в указанном диапазоне текста
- Исключения:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— еслиbeginIndexотрицателен,endIndexбольше длины указанной последовательности илиbeginIndexбольшеendIndex. - С версии:
- 1.5
codePointCount
public static int codePointCount(char[] a, int offset, int count)
char, переданного в качестве аргумента. Аргумент offset задаёт индекс первого char подмассива, а аргумент count — длину подмассива в charах. Непарные суррогаты в подмассиве считаются отдельными кодовыми точками.- Параметры:
-
a— массивchar -
offset— индекс первогоcharв указанном массивеchar -
count— длина подмассива вcharах - Возвращает:
- количество кодовых точек Unicode в указанном подмассиве
- Исключения:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— еслиoffsetилиcountотрицателен либо еслиoffset + countбольше длины указанного массива. - С версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
index на codePointOffset кодовых точек. Непарные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.- Параметры:
-
seq— последовательность символов -
index— индекс, относительно которого вычисляется смещение -
codePointOffset— смещение в кодовых точках - Возвращает:
- индекс в последовательности символов
- Исключения:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— еслиindexотрицателен или больше длины последовательности символов, либо еслиcodePointOffsetположителен и в подпоследовательности, начинающейся сindex, меньшеcodePointOffsetкодовых точек, либо еслиcodePointOffsetотрицателен и в подпоследовательности передindexменьше кодовых точек, чем абсолютное значениеcodePointOffset. - С версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
char, смещённый относительно заданного index на codePointOffset кодовых точек. Аргументы start и count задают подмассив массива char. Непарные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.- Параметры:
-
a— массивchar -
start— индекс первогоcharподмассива -
count— длина подмассива вcharах -
index— индекс, относительно которого вычисляется смещение -
codePointOffset— смещение в кодовых точках - Возвращает:
- индекс в подмассиве
- Исключения:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— еслиstartилиcountотрицателен, либо еслиstart + countбольше длины указанного массива, либо еслиindexменьшеstartили большеstart + count, либо еслиcodePointOffsetположителен и в диапазоне текста, начинающемся сindexи заканчивающемсяstart + count - 1, меньшеcodePointOffsetкодовых точек, либо еслиcodePointOffsetотрицателен и в диапазоне текста, начинающемся сstartи заканчивающемсяindex - 1, меньше кодовых точек, чем абсолютное значениеcodePointOffset. - С версии:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Символ является строчным, если его тип общей категории, предоставляемый Character.getType(ch), — LOWERCASE_LETTER, либо если он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является строчным; в противном случае —false. - См. также:
isLowerCase
public static boolean isLowerCase(int codePoint)
Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), — LOWERCASE_LETTER, либо если он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является строчным; в противном случае —false. - С версии:
- 1.5
- См. также:
isUpperCase
public static boolean isUpperCase(char ch)
Символ является прописным, если его тип общей категории, предоставляемый Character.getType(ch), — UPPERCASE_LETTER, либо если он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.
Примеры прописных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются прописными.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isUpperCase(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является прописным; в противном случае —false. - С версии:
- 1.0
- См. также:
isUpperCase
public static boolean isUpperCase(int codePoint)
Символ является прописным, если его тип общей категории, предоставляемый getType(codePoint), — UPPERCASE_LETTER, либо если он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.
Примеры прописных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются прописными.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является прописным; в противном случае —false. - С версии:
- 1.5
- См. также:
isTitleCase
public static boolean isTitleCase(char ch)
Символ является символом в верхнем регистре заголовка, если его тип общей категории, предоставляемый Character.getType(ch), — TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», которой соответствует строчная буква, похожая на «lj». Третья форма, похожая на «Lj», является подходящей для отображения слова строчными буквами с заглавной первой буквой, например в названии книги.
Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются символами в верхнем регистре заголовка.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isTitleCase(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является символом в верхнем регистре заголовка; в противном случае —false. - С версии:
- 1.0.2
- См. также:
isTitleCase
public static boolean isTitleCase(int codePoint)
Символ является символом в верхнем регистре заголовка, если его тип общей категории, предоставляемый getType(codePoint), — TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», которой соответствует строчная буква, похожая на «lj». Третья форма, похожая на «Lj», является подходящей для отображения слова строчными буквами с заглавной первой буквой, например в названии книги.
Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются символами в верхнем регистре заголовка.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является символом в верхнем регистре заголовка; в противном случае —false. - С версии:
- 1.5
- См. также:
isDigit
public static boolean isDigit(char ch)
Символ является цифрой, если его тип общей категории, предоставляемый Character.getType(ch), — DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'–'\u0039', цифры ISO-LATIN-1 ('0'–'9') -
'\u0660'–'\u0669', арабско-индийские цифры -
'\u06F0'–'\u06F9', расширенные арабско-индийские цифры -
'\u0966'–'\u096F', цифры деванагари -
'\uFF10'–'\uFF19', полноширинные цифры
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isDigit(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является цифрой; в противном случае —false. - См. также:
isDigit
public static boolean isDigit(int codePoint)
Символ является цифрой, если его тип общей категории, предоставляемый getType(codePoint), — DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'–'\u0039', цифры ISO-LATIN-1 ('0'–'9') -
'\u0660'–'\u0669', арабско-индийские цифры -
'\u06F0'–'\u06F9', расширенные арабско-индийские цифры -
'\u0966'–'\u096F', цифры деванагари -
'\uFF10'–'\uFF19', полноширинные цифры
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является цифрой; в противном случае —false. - С версии:
- 1.5
- См. также:
isDefined
public static boolean isDefined(char ch)
Символ считается заданным, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Он имеет значение в диапазоне, определённом файлом UnicodeData.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isDefined(int).
- Параметры:
-
ch— проверяемый символ - Возвращает:
-
true, если символ имеет определённое значение в Unicode; в противном случае —false. - С версии:
- 1.0.2
- См. также:
isDefined
public static boolean isDefined(int codePoint)
Символ считается заданным, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Он имеет значение в диапазоне, определённом файлом UnicodeData.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ имеет определённое значение в Unicode; в противном случае —false. - С версии:
- 1.5
- См. также:
isLetter
public static boolean isLetter(char ch)
Символ считается буквой, если его тип общей категории, предоставляемый Character.getType(ch), относится к одному из следующих типов:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLetter(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является буквой; в противном случае —false. - См. также:
isLetter
public static boolean isLetter(int codePoint)
Символ считается буквой, если его тип общей категории, предоставляемый getType(codePoint), относится к одному из следующих типов:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является буквой; в противном случае —false. - С версии:
- 1.5
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Символ считается буквой или цифрой, если для него Character.isLetter(char ch) или Character.isDigit(char ch) возвращает true.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является буквой или цифрой; в противном случае —false. - С версии:
- 1.0.2
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Символ считается буквой или цифрой, если для него isLetter(codePoint) или isDigit(codePoint) возвращает true.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является буквой или цифрой; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется соединительным знаком пунктуации (например,'_').
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Java; в противном случае —false. - Начиная с:
- 1.0.2
- См. также:
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Символ может входить в состав идентификатора Java тогда и только тогда, когда истинно одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный знак пунктуации (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это комбинируемый знак
- это невидимый знак
- для символа
isIdentifierIgnorableвозвращаетtrue.
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может входить в состав идентификатора Java; в противном случае —false. - Начиная с:
- 1.0.2
- См. также:
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Символ считается алфавитным, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является алфавитным символом Unicode; в противном случае —false. - Начиная с:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является идеографическим символом Unicode; в противном случае —false. - Начиная с:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется соединительным знаком пунктуации (например,'_').
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Java; в противном случае —false. - Начиная с:
- 1.1
- См. также:
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Символ может начинать идентификатор Java тогда и только тогда, когда истинно одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - указанный символ является символом валюты (например,
'$') - указанный символ является соединительным знаком пунктуации (например,
'_').
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может начинать идентификатор Java; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Символ может входить в состав идентификатора Java, если истинно одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный знак пунктуации (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это комбинируемый знак
- это невидимый знак
- для символа
isIdentifierIgnorableвозвращаетtrue
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может входить в состав идентификатора Java; в противном случае —false. - Начиная с:
- 1.1
- См. также:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Символ может входить в состав идентификатора Java, если истинно одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный знак пунктуации (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это комбинируемый знак
- это невидимый знак
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля этой кодовой точки
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может входить в состав идентификатора Java; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Символ может начинать идентификатор Unicode тогда и только тогда, когда истинно одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Unicode; в противном случае —false. - Начиная с:
- 1.1
- Внешние спецификации
- См. также:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Символ может начинать идентификатор Unicode тогда и только тогда, когда истинно одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обеспечения обратной совместимости.- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может начинать идентификатор Unicode; в противном случае —false. - Начиная с:
- 1.5
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Символ может входить в состав идентификатора Unicode тогда и только тогда, когда истинно одно из следующих утверждений:
- это буква
- это соединительный знак пунктуации (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это комбинируемый знак
- это невидимый знак
- для этого символа
isIdentifierIgnorableвозвращаетtrue. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавляется к Continue для обеспечения обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может входить в состав идентификатора Unicode; в противном случае —false. - Начиная с:
- 1.1
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Символ может входить в состав идентификатора Unicode тогда и только тогда, когда истинно одно из следующих утверждений:
- это буква
- это соединительный знак пунктуации (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это комбинируемый знак
- это невидимый знак
- для этого символа
isIdentifierIgnorableвозвращаетtrue. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode с следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавляется к Continue для обеспечения обратной совместимости.- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может входить в состав идентификатора Unicode; в противном случае —false. - Начиная с:
- 1.5
- Внешние спецификации
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Следующие символы Unicode являются игнорируемыми в идентификаторах Java и Unicode:
- управляющие символы ISO, не являющиеся пробельными символами
-
'\u0000'—'\u0008' -
'\u000E'—'\u001B' -
'\u007F'—'\u009F'
-
- все символы со значением общей категории
FORMAT
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является игнорируемым управляющим символом, который может входить в состав идентификатора Java или Unicode; в противном случае —false. - Начиная с:
- 1.1
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Следующие символы Unicode являются игнорируемыми в идентификаторах Java и Unicode:
- управляющие символы ISO, не являющиеся пробельными символами
-
'\u0000'—'\u0008' -
'\u000E'—'\u001B' -
'\u007F'—'\u009F'
-
- все символы со значением общей категории
FORMAT
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является игнорируемым управляющим символом, который может входить в состав идентификатора Java или Unicode; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isEmoji
public static boolean isEmoji(int codePoint)
Символ считается эмодзи тогда и только тогда, когда он имеет свойство Emoji, определённое в стандарте Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является эмодзи; в противном случае —false. - Начиная с:
- 21
- Внешние спецификации
isEmojiPresentation
public static boolean isEmojiPresentation(int codePoint)
Символ считается имеющим свойство Emoji Presentation тогда и только тогда, когда он имеет свойство Emoji_Presentation, определённое в стандарте Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ имеет свойство Emoji Presentation; в противном случае —false. - Начиная с:
- 21
- Внешние спецификации
isEmojiModifier
public static boolean isEmojiModifier(int codePoint)
Символ считается модификатором эмодзи тогда и только тогда, когда он имеет свойство Emoji_Modifier, определённое в стандарте Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является модификатором эмодзи; в противном случае —false. - Начиная с:
- 21
- Внешние спецификации
isEmojiModifierBase
public static boolean isEmojiModifierBase(int codePoint)
Символ считается базовым символом-модификатором эмодзи тогда и только тогда, когда он имеет свойство Emoji_Modifier_Base, определённое в стандарте Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является базовым символом-модификатором эмодзи; в противном случае —false. - Начиная с:
- 21
- Внешние спецификации
isEmojiComponent
public static boolean isEmojiComponent(int codePoint)
Символ считается компонентом эмодзи тогда и только тогда, когда он имеет свойство Emoji_Component, определённое в стандарте Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является компонентом эмодзи; в противном случае —false. - Начиная с:
- 21
- Внешние спецификации
isExtendedPictographic
public static boolean isExtendedPictographic(int codePoint)
Символ считается расширенным пиктографическим символом тогда и только тогда, когда у него есть свойство Extended_Pictographic, определённое в Emoji Unicode (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), подлежащий проверке. - Возвращает:
-
true, если символ является расширенным пиктографическим символом;falseв противном случае. - Начиная с:
- 21
- Внешние спецификации
toLowerCase
public static char toLowerCase(char ch)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае для преобразования символов в нижний регистр следует использовать String.toLowerCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch— символ для преобразования. - Возвращает:
- эквивалент символа в нижнем регистре, если он существует; в противном случае сам символ.
- См. также:
toLowerCase
public static int toLowerCase(int codePoint)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае для преобразования символов в нижний регистр следует использовать String.toLowerCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для преобразования. - Возвращает:
- эквивалент символа (кодовой точки Unicode) в нижнем регистре, если он существует; в противном случае сам символ.
- Начиная с:
- 1.5
- См. также:
toUpperCase
public static char toUpperCase(char ch)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае для преобразования символов в верхний регистр следует использовать String.toUpperCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toUpperCase(int).
- Параметры:
-
ch— символ для преобразования. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае сам символ.
- См. также:
toUpperCase
public static int toUpperCase(int codePoint)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае для преобразования символов в верхний регистр следует использовать String.toUpperCase(). Методы преобразования регистра String имеют ряд преимуществ перед методами преобразования регистра Character. Методы преобразования регистра String поддерживают преобразования с учётом локали, контекста и преобразования символов по схеме 1:M, тогда как методы преобразования регистра Character этого не поддерживают.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для преобразования. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае сам символ.
- Начиная с:
- 1.5
- См. также:
toTitleCase
public static char toTitleCase(char ch)
char уже является символом char в заглавном регистре, возвращается то же значение char. Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toTitleCase(int).
- Параметры:
-
ch— символ для преобразования. - Возвращает:
- эквивалент символа в заглавном регистре, если он существует; в противном случае сам символ.
- Начиная с:
- 1.0.2
- См. также:
toTitleCase
public static int toTitleCase(int codePoint)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для преобразования. - Возвращает:
- эквивалент символа в заглавном регистре, если он существует; в противном случае сам символ.
- Начиная с:
- 1.5
- См. также:
digit
public static int digit(char ch, int radix)
ch в указанной системе счисления. Если система счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:
- Метод
isDigitвозвращаетtrueдля символа, а десятичное значение цифры Unicode для этого символа (или его разложения на один символ) меньше указанной системы счисления. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', а его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', а его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из полноширинных заглавных латинских букв от A (
'\uFF21') до Z ('\uFF3A'), а его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из полноширинных строчных латинских букв от a (
'\uFF41') до z ('\uFF5A'), а его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch— символ для преобразования. -
radix— система счисления. - Возвращает:
- числовое значение, представленное символом в указанной системе счисления.
- См. также:
digit
public static int digit(int codePoint, int radix)
Если система счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:
- Метод
isDigit(codePoint)возвращаетtrueдля символа, а десятичное значение цифры Unicode для этого символа (или его разложения на один символ) меньше указанной системы счисления. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', а его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', а его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из полноширинных заглавных латинских букв от A (
'\uFF21') до Z ('\uFF3A'), а его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из полноширинных строчных латинских букв от a (
'\uFF41') до z ('\uFF5A'), а его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для преобразования. -
radix— система счисления. - Возвращает:
- числовое значение, представленное символом в указанной системе счисления.
- Начиная с:
- 1.5
- См. также:
getNumericValue
public static int getNumericValue(char ch)
int, которое представляет указанный символ Unicode. Например, символ '\u216C' (римское число пятьдесят) вернёт значение int, равное 50. Заглавные буквы A–Z (от '\u0041' до '\u005A'), строчные буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим значениям char.
Если символ не имеет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch— символ для преобразования. - Возвращает:
- числовое значение символа в виде неотрицательного значения
int; -2, если символ имеет числовое значение, но его нельзя представить в виде неотрицательного значенияint; -1, если символ не имеет числового значения. - Начиная с:
- 1.1
- См. также:
getNumericValue
public static int getNumericValue(int codePoint)
int, которое представляет указанный символ (кодовая точка Unicode). Например, символ '\u216C' (римское число пятьдесят) вернёт значение int, равное 50. Заглавные буквы A–Z (от '\u0041' до '\u005A'), строчные буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовые значения этим значениям char.
Если символ не имеет числового значения, возвращается -1. Если у символа есть числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint— символ (кодовая точка Unicode) для преобразования. - Возвращает:
- числовое значение символа в виде неотрицательного значения
int; -2, если символ имеет числовое значение, но его нельзя представить в виде неотрицательного значенияint; -1, если символ не имеет числового значения. - Начиная с:
- 1.5
- См. также:
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
true только для следующих пяти символов: | Символ | Код | Название |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch— символ, подлежащий проверке. - Возвращает:
-
true, если символ является пробельным символом ISO-LATIN-1;falseв противном случае. - См. также:
isSpaceChar
public static boolean isSpaceChar(char ch)
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).
- Параметры:
-
ch— символ, подлежащий проверке. - Возвращает:
-
true, если символ является пробельным;falseв противном случае. - Начиная с:
- 1.1
- См. также:
isSpaceChar
public static boolean isSpaceChar(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode), подлежащий проверке. - Возвращает:
-
true, если символ является пробельным;falseв противном случае. - Начиная с:
- 1.5
- См. также:
isWhitespace
public static boolean isWhitespace(char ch)
- Он является пробельным символом Unicode (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Это
'\t', U+0009 HORIZONTAL TABULATION. - Это
'\n', U+000A LINE FEED. - Это
'\u000B', U+000B VERTICAL TABULATION. - Это
'\f', U+000C FORM FEED. - Это
'\r', U+000D CARRIAGE RETURN. - Это
'\u001C', U+001C FILE SEPARATOR. - Это
'\u001D', U+001D GROUP SEPARATOR. - Это
'\u001E', U+001E RECORD SEPARATOR. - Это
'\u001F', U+001F UNIT SEPARATOR.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isWhitespace(int).
- Параметры:
-
ch— символ, подлежащий проверке. - Возвращает:
-
true, если символ является пробельным символом Java;falseв противном случае. - Начиная с:
- 1.1
- См. также:
isWhitespace
public static boolean isWhitespace(int codePoint)
- Он является пробельным символом Unicode (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Это
'\t', U+0009 HORIZONTAL TABULATION. - Это
'\n', U+000A LINE FEED. - Это
'\u000B', U+000B VERTICAL TABULATION. - Это
'\f', U+000C FORM FEED. - Это
'\r', U+000D CARRIAGE RETURN. - Это
'\u001C', U+001C FILE SEPARATOR. - Это
'\u001D', U+001D GROUP SEPARATOR. - Это
'\u001E', U+001E RECORD SEPARATOR. - Это
'\u001F', U+001F UNIT SEPARATOR.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), подлежащий проверке. - Возвращает:
-
true, если символ является пробельным символом Java;falseв противном случае. - Начиная с:
- 1.5
- См. также:
isISOControl
public static boolean isISOControl(char ch)
'\u0000' до '\u001F' или в диапазон от '\u007F' до '\u009F'. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).
- Параметры:
-
ch— символ, подлежащий проверке. - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - Начиная с:
- 1.1
- См. также:
isISOControl
public static boolean isISOControl(int codePoint)
'\u0000' до '\u001F' или в диапазон от '\u007F' до '\u009F'.- Параметры:
-
codePoint— символ (кодовая точка Unicode), подлежащий проверке. - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - Начиная с:
- 1.5
- См. также:
getType
public static int getType(char ch)
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).
- Параметры:
-
ch— символ, подлежащий проверке. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - Начиная с:
- 1.1
- См. также:
getType
public static int getType(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который требуется проверить. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - Начиная с:
- 1.5
- См. также:
forDigit
public static char forDigit(int digit, int radix)
radix не является допустимым основанием системы счисления или значение digit не является допустимой цифрой в указанной системе счисления, возвращается нулевой символ ('\u0000'). Аргумент radix допустим, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.
Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit— число, которое требуется преобразовать в символ. -
radix— основание системы счисления. - Возвращает:
- представление
charзаданной цифры в указанной системе счисления. - См. также:
getDirectionality
public static byte getDirectionality(char ch)
char равно DIRECTIONALITY_UNDEFINED. Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch—char, для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - Начиная с:
- 1.4
- См. также:
getDirectionality
public static byte getDirectionality(int codePoint)
DIRECTIONALITY_UNDEFINED.- Параметры:
-
codePoint— символ (кодовая точка Unicode), для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- Начиная с:
- 1.5
- См. также:
isMirrored
public static boolean isMirrored(char ch)
'\u0028' LEFT PARENTHESIS семантически определена как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)». Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch—char, для которого запрашивается свойство зеркальности - Возвращает:
-
true, если символ зеркальный;false, еслиcharне является зеркальным или не определен. - Начиная с:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
'\u0028' LEFT PARENTHESIS семантически определена как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».- Параметры:
-
codePoint— символ (кодовая точка Unicode), который требуется проверить. - Возвращает:
-
true, если символ зеркальный;false, если символ не является зеркальным или не определен. - Начиная с:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
Character.- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter— объектCharacterдля сравнения. - Возвращает:
- значение
0, если аргументCharacterравен этому объектуCharacter; значение меньше0, если этот объектCharacterчисленно меньше аргументаCharacter; и значение больше0, если этот объектCharacterчисленно больше аргументаCharacter(беззнаковое сравнение). Обратите внимание, что это исключительно числовое сравнение; оно не зависит от локали. - Начиная с:
- 1.2
compare
public static int compare(char x, char y)
char. Возвращаемое значение совпадает со значением, которое было бы возвращено следующим выражением: Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x— первое значениеcharдля сравнения -
y— второе значениеcharдля сравнения - Возвращает:
- значение
0, еслиx == y; значение меньше0, еслиx < y; и значение больше0, еслиx > y - Начиная с:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
char.- Параметры:
-
ch— значениеchar, в котором требуется изменить порядок байтов. - Возвращает:
- значение, полученное перестановкой (или, что эквивалентно, обменом местами) байтов в заданном значении
char. - Начиная с:
- 1.5
getName
public static String getName(int codePoint)
codePoint или null, если кодовая точка является unassigned. Если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Консорциумом Unicode), возвращаемое имя совпадает с результатом выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для codePointов из файла UnicodeData имя, возвращаемое этим методом, соответствует схеме именования, описанной в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, таких как Hangul/Ideographs, приведенное выше правило формирования имени отличается от правила, определенного в стандарте Unicode.- Параметры:
-
codePoint— символ (кодовая точка Unicode) - Возвращает:
- имя указанного символа или null, если кодовая точка не назначена.
- Вызывает исключение:
-
IllegalArgumentException— если указанное значениеcodePointне является допустимой кодовой точкой Unicode. - Начиная с:
- 1.7
codePointOf
public static int codePointOf(String name)
Если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Консорциумом Unicode), его имя определяется как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Сопоставление name не учитывает регистр; все начальные и конечные пробельные символы удаляются. Для кодовых точек из файла UnicodeData этот метод распознает имена, соответствующие определениям из раздела «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек метод распознает имена, сформированные методом getName(int).
- Параметры:
-
name— имя символа - Возвращает:
- значение кодовой точки символа, заданного его именем.
- Вызывает исключение:
-
IllegalArgumentException— если указанное значениеnameне является допустимым именем символа. -
NullPointerException— еслиnameравноnull - Начиная с:
- 9
© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/25/docs/api/java.base/java/lang/Character.html