Класс Character
- Все реализуемые интерфейсы:
Serializable, Comparable<Character>, Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Character является классом-обёрткой для значений примитивного типа char. Объект типа Character содержит одно поле типа char. Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.), а также для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие Unicode
Поля и методы класса Character определяются на основе информации о символах из стандарта Unicode, в частности файла UnicodeData, входящего в базу данных символов Unicode. В этом файле указаны такие свойства, как имя и категория, для каждой назначенной кодовой точки Unicode или диапазона символов. Файл доступен на сайте Консорциума Unicode: http://www.unicode.org.
Информация о символах основана на стандарте Unicode версии 17.0.
Со временем платформа Java поддерживала различные версии стандарта Unicode. В следующих таблицах указана версия Unicode, используемая в каждом выпуске Java. Если не указано иное, во всех обновлениях одного семейства выпусков Java используется одна и та же версия Unicode.
| Выпуск Java | Версия Unicode |
|---|---|
| Java SE 26 | Unicode 17.0 |
| Java SE 25 | Unicode 16.0 |
| Java SE 21 | Unicode 15.0 |
| Java SE 17 | Unicode 13.0 |
| Java SE 11 | Unicode 10.0 |
| Java SE 8 | Unicode 6.2 |
Показать другие выпуски Java
Выпуски Java, предшествующие Java SE 8, перечислены только в том случае, если в них обновлялась версия Unicode
| Выпуск Java | Версия Unicode |
|---|---|
| Java SE 24 | Unicode 16.0 |
| Java SE 23 | Unicode 15.1 |
| Java SE 22 | Unicode 15.1 |
| Java SE 20 | Unicode 15.0 |
| Java SE 19 | Unicode 14.0 |
| Java SE 18 | Unicode 13.0 |
| Java SE 16 | Unicode 13.0 |
| Java SE 15 | Unicode 13.0 |
| Java SE 14 | Unicode 12.1 |
| Java SE 13 | Unicode 12.1 |
| Java SE 12 | Unicode 11.0 |
| Java SE 10 | Unicode 8.0 |
| Java SE 9 | Unicode 8.0 |
| Java SE 7 | Unicode 6.0 |
| Java SE 5.0 | Unicode 4.0 |
| Java SE 1.4 | Unicode 3.0 |
| JDK 1.1 | Unicode 2.0 |
| JDK 1.0.2 | Unicode 1.1.5 |
Отличия от этих базовых версий Unicode, например распознаваемые дополнения, описаны в других местах.
Представление символов Unicode
Тип данных char (и, следовательно, значение, инкапсулируемое объектом Character) основан на исходной спецификации Unicode, в которой символы определялись как сущности фиксированной ширины размером 16 бит. Позднее стандарт Unicode был изменён, чтобы допустить символы, для представления которых требуется более 16 бит. Диапазон допустимых кодовых точек теперь составляет от U+0000 до U+10FFFF и называется скалярным значением Unicode.
Набор символов от U+0000 до U+FFFF иногда называют основной многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char: первое значение принадлежит диапазону старших суррогатов (\uD800-\uDBFF), второе — диапазону младших суррогатов (\uDC00-\uDFFF).
Таким образом, значение char представляет кодовые точки основной многоязычной плоскости (BMP), включая суррогатные кодовые точки, или единицы кода кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Для представления кодовых точек Unicode используются младшие (наименее значащие) 21 бит значения int, а старшие (наиболее значащие) 11 бит должны быть равны нулю. Если не указано иное, поведение в отношении дополнительных символов и суррогатных значений char следующее:
- Методы, принимающие только значение
char, не поддерживают дополнительные символы. Они считают значенияcharиз суррогатных диапазонов неопределёнными символами. Например,Character.isLetter('\uD840')возвращаетfalse, хотя это конкретное значение, если за ним в строке следует любое значение младшего суррогата, представляет букву. - Методы, принимающие значение
int, поддерживают все символы Unicode, включая дополнительные символы. Например,Character.isLetter(0x2F81A)возвращаетtrue, поскольку значение кодовой точки представляет собой букву (иероглиф ККЯ).
В документации API Java SE термин кодовая точка Unicode используется для значений символов в диапазоне от U+0000 до U+10FFFF, а термин единица кода Unicode — для 16-битных значений char, являющихся единицами кода кодировки UTF-16. Дополнительные сведения о терминологии Unicode см. в глоссарии Unicode.
Это класс, основанный на значениях; программистам следует считать экземпляры, которые равны, взаимозаменяемыми и не использовать экземпляры для синхронизации, иначе возможно непредсказуемое поведение. Например, в одном из будущих выпусков синхронизация может завершиться неудачей.
- Начиная с:
- 1.0
- Внешние спецификации
- См. также:
Краткое описание вложенных классов
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class |
Character.Subset |
Экземпляры этого класса представляют определённые подмножества набора символов Юникода. |
static final class |
Character.UnicodeBlock |
Семейство подмножеств символов, представляющих блоки символов в спецификации Юникода. |
static enum |
Character.UnicodeScript |
Семейство подмножеств символов, представляющих письменности, определённые в Техническом стандарте Юникода № 24: названия письменностей. |
Краткое описание полей
| Модификатор и тип | Поле | Описание |
|---|---|---|
static final int |
BYTES |
Количество байтов, используемых для представления значения char в беззнаковом двоичном формате. |
static final byte |
COMBINING_SPACING_MARK |
Общая категория "Mc" в спецификации Юникода. |
static final byte |
CONNECTOR_PUNCTUATION |
Общая категория "Pc" в спецификации Юникода. |
static final byte |
CONTROL |
Общая категория "Cc" в спецификации Юникода. |
static final byte |
CURRENCY_SYMBOL |
Общая категория "Sc" в спецификации Юникода. |
static final byte |
DASH_PUNCTUATION |
Общая категория "Pd" в спецификации Юникода. |
static final byte |
DECIMAL_DIGIT_NUMBER |
Общая категория "Nd" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_ARABIC_NUMBER |
Слабый двунаправленный тип символа "AN" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL |
Слабый двунаправленный тип символа "BN" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR |
Слабый двунаправленный тип символа "CS" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER |
Слабый двунаправленный тип символа "EN" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR |
Слабый двунаправленный тип символа "ES" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR |
Слабый двунаправленный тип символа "ET" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_FIRST_STRONG_ISOLATE |
Слабый двунаправленный тип символа "FSI" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT |
Сильный двунаправленный тип символа "L" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING |
Сильный двунаправленный тип символа "LRE" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE |
Слабый двунаправленный тип символа "LRI" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE |
Сильный двунаправленный тип символа "LRO" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_NONSPACING_MARK |
Слабый двунаправленный тип символа "NSM" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_OTHER_NEUTRALS |
Нейтральный двунаправленный тип символа "ON" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR |
Нейтральный двунаправленный тип символа "B" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT |
Слабый двунаправленный тип символа "PDF" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE |
Слабый двунаправленный тип символа "PDI" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT |
Сильный двунаправленный тип символа "R" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC |
Сильный двунаправленный тип символа "AL" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING |
Сильный двунаправленный тип символа "RLE" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE |
Слабый двунаправленный тип символа "RLI" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE |
Сильный двунаправленный тип символа "RLO" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_SEGMENT_SEPARATOR |
Нейтральный двунаправленный тип символа "S" в спецификации Юникода. |
static final byte |
DIRECTIONALITY_UNDEFINED |
Неопределённый двунаправленный тип символа. |
static final byte |
DIRECTIONALITY_WHITESPACE |
Нейтральный двунаправленный тип символа "WS" в спецификации Юникода. |
static final byte |
ENCLOSING_MARK |
Общая категория "Me" в спецификации Юникода. |
static final byte |
END_PUNCTUATION |
Общая категория "Pe" в спецификации Юникода. |
static final byte |
FINAL_QUOTE_PUNCTUATION |
Общая категория "Pf" в спецификации Юникода. |
static final byte |
FORMAT |
Общая категория "Cf" в спецификации Юникода. |
static final byte |
INITIAL_QUOTE_PUNCTUATION |
Общая категория "Pi" в спецификации Юникода. |
static final byte |
LETTER_NUMBER |
Общая категория "Nl" в спецификации Юникода. |
static final byte |
LINE_SEPARATOR |
Общая категория "Zl" в спецификации Юникода. |
static final byte |
LOWERCASE_LETTER |
Общая категория "Ll" в спецификации Юникода. |
static final byte |
MATH_SYMBOL |
Общая категория "Sm" в спецификации Юникода. |
static final int |
MAX_CODE_POINT |
Максимальное значение кодовой точки Юникода, константа U+10FFFF. |
static final char |
MAX_HIGH_SURROGATE |
Максимальное значение кодовой единицы старшего суррогата Юникода в кодировке UTF-16, константа '\uDBFF'. |
static final char |
MAX_LOW_SURROGATE |
Максимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDFFF'. |
static final int |
MAX_RADIX |
Максимальное основание системы счисления, доступное для преобразования в строки и из строк. |
static final char |
MAX_SURROGATE |
Максимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uDFFF'. |
static final char |
MAX_VALUE |
Константное значение этого поля — наибольшее значение типа char, '\uFFFF'. |
static final int |
MIN_CODE_POINT |
Минимальное значение кодовой точки Юникода, константа U+0000. |
static final char |
MIN_HIGH_SURROGATE |
Минимальное значение кодовой единицы старшего суррогата Юникода в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_LOW_SURROGATE |
Минимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDC00'. |
static final int |
MIN_RADIX |
Минимальное основание системы счисления, доступное для преобразования в строки и из строк. |
static final int |
MIN_SUPPLEMENTARY_CODE_POINT |
Минимальное значение дополнительной кодовой точки Юникода, константа U+10000. |
static final char |
MIN_SURROGATE |
Минимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_VALUE |
Константное значение этого поля — наименьшее значение типа char, '\u0000'. |
static final byte |
MODIFIER_LETTER |
Общая категория "Lm" в спецификации Юникода. |
static final byte |
MODIFIER_SYMBOL |
Общая категория "Sk" в спецификации Юникода. |
static final byte |
NON_SPACING_MARK |
Общая категория "Mn" в спецификации Юникода. |
static final byte |
OTHER_LETTER |
Общая категория "Lo" в спецификации Юникода. |
static final byte |
OTHER_NUMBER |
Общая категория "No" в спецификации Юникода. |
static final byte |
OTHER_PUNCTUATION |
Общая категория "Po" в спецификации Юникода. |
static final byte |
OTHER_SYMBOL |
Общая категория "So" в спецификации Юникода. |
static final byte |
PARAGRAPH_SEPARATOR |
Общая категория "Zp" в спецификации Юникода. |
static final byte |
PRIVATE_USE |
Общая категория "Co" в спецификации Юникода. |
static final int |
SIZE |
Количество битов, используемых для представления значения char в беззнаковом двоичном формате, константа 16. |
static final byte |
SPACE_SEPARATOR |
Общая категория "Zs" в спецификации Юникода. |
static final byte |
START_PUNCTUATION |
Общая категория "Ps" в спецификации Юникода. |
static final byte |
SURROGATE |
Общая категория "Cs" в спецификации Юникода. |
static final byte |
TITLECASE_LETTER |
Общая категория "Lt" в спецификации Юникода. |
static final Class |
TYPE |
Экземпляр Class, представляющий примитивный тип char. |
static final byte |
UNASSIGNED |
Общая категория "Cn" в спецификации Юникода. |
static final byte |
UPPERCASE_LETTER |
Общая категория "Lu" в спецификации Юникода. |
Краткое описание конструкторов
| Конструктор | Описание |
|---|---|
Character |
Устарел. Использование этого конструктора редко бывает уместным. |
Краткое описание методов
| Модификатор и тип | Метод | Описание |
|---|---|---|
static int |
charCount |
Определяет количество значений char, необходимое для представления указанного символа (кодовой точки Unicode). |
char |
charValue() |
Возвращает значение этого объекта Character. |
static int |
codePointAt |
Возвращает кодовую точку по указанному индексу массива char. |
static int |
codePointAt |
Возвращает кодовую точку по указанному индексу массива char, где можно использовать только элементы массива с index меньше limit. |
static int |
codePointAt |
Возвращает кодовую точку по указанному индексу CharSequence. |
static int |
codePointBefore |
Возвращает кодовую точку перед указанным индексом массива char. |
static int |
codePointBefore |
Возвращает кодовую точку перед указанным индексом массива char, где можно использовать только элементы массива с index больше или равным start. |
static int |
codePointBefore |
Возвращает кодовую точку перед указанным индексом CharSequence. |
static int |
codePointCount |
Возвращает количество кодовых точек Unicode в подмассиве аргумента-массива char. |
static int |
codePointCount |
Возвращает количество кодовых точек Unicode в текстовом диапазоне указанной последовательности символов. |
static int |
codePointOf |
Возвращает значение кодовой точки символа Unicode, заданного указанным именем символа. |
static int |
compare |
Сравнивает два значения char численно. |
int |
compareTo |
Сравнивает два объекта Character численно. |
Optional |
describeConstable() |
Возвращает Optional, содержащий номинальный дескриптор этого экземпляра. |
static int |
digit |
Возвращает числовое значение символа ch в указанной системе счисления. |
static int |
digit |
Возвращает числовое значение указанного символа (кодовой точки Unicode) в указанной системе счисления. |
boolean |
equals |
Сравнивает этот объект с указанным объектом. |
static char |
forDigit |
Определяет представление символа для указанной цифры в заданной системе счисления. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для указанного символа. |
static byte |
getDirectionality |
Возвращает свойство направленности Unicode для указанного символа (кодовой точки Unicode). |
static String |
getName |
Возвращает имя указанного символа codePoint или null, если кодовая точка является unassigned. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ Unicode. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ (кодовая точка Unicode). |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
int |
hashCode() |
Возвращает хеш-код этого объекта Character; он равен результату вызова charValue(). |
static int |
hashCode |
Возвращает хеш-код значения char; совместим с Character.hashCode(). |
static char |
highSurrogate |
Возвращает старший суррогат ( кодовую единицу старшего суррогата) суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. |
static boolean |
isAlphabetic |
Определяет, является ли указанный символ (кодовая точка Unicode) алфавитным. |
static boolean |
isBmpCodePoint |
Определяет, находится ли указанный символ (кодовая точка Unicode) в основной многоязычной плоскости (BMP). |
static boolean |
isDefined |
Определяет, задан ли символ в Unicode. |
static boolean |
isDefined |
Определяет, задан ли символ (кодовая точка Unicode) в Unicode. |
static boolean |
isDigit |
Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit |
Определяет, является ли указанный символ (кодовая точка Unicode) цифрой. |
static boolean |
isEmoji |
Определяет, является ли указанный символ (кодовая точка Unicode) эмодзи. |
static boolean |
isEmojiComponent |
Определяет, является ли указанный символ (кодовая точка Unicode) компонентом эмодзи. |
static boolean |
isEmojiModifier |
Определяет, является ли указанный символ (кодовая точка Unicode) модификатором эмодзи. |
static boolean |
isEmojiModifierBase |
Определяет, является ли указанный символ (кодовая точка Unicode) базовым символом для модификатора эмодзи. |
static boolean |
isEmojiPresentation |
Определяет, обладает ли указанный символ (кодовая точка Unicode) свойством отображения эмодзи по умолчанию. |
static boolean |
isExtendedPictographic |
Определяет, является ли указанный символ (кодовая точка Unicode) расширенным пиктографическим символом. |
static boolean |
isHighSurrogate |
Определяет, является ли указанное значение char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица начального суррогата). |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли считать указанный символ игнорируемым символом в идентификаторе Java или идентификаторе Unicode. |
static boolean |
isIdentifierIgnorable |
Определяет, следует ли считать указанный символ (кодовую точку Unicode) игнорируемым символом в идентификаторе Java или идентификаторе Unicode. |
static boolean |
isIdeographic |
Определяет, является ли указанный символ (кодовая точка Unicode) идеограммой CJKV (китайской, японской, корейской и вьетнамской), согласно определению стандарта Unicode. |
static boolean |
isISOControl |
Определяет, является ли указанный символ управляющим символом ISO. |
static boolean |
isISOControl |
Определяет, является ли указанный символ (кодовая точка Unicode) управляющим символом ISO. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Java, но не его первым символом. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли символ (кодовая точка Unicode) быть частью идентификатора Java, но не его первым символом. |
static boolean |
isJavaIdentifierStart |
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Java. |
static boolean |
isJavaIdentifierStart |
Определяет, допустим ли символ (кодовая точка Unicode) в качестве первого символа идентификатора Java. |
static boolean |
isJavaLetter |
Устарело. Заменено на isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit |
Устарело. Заменено на isJavaIdentifierPart(char). |
static boolean |
isLetter |
Определяет, является ли указанный символ буквой. |
static boolean |
isLetter |
Определяет, является ли указанный символ (кодовая точка Unicode) буквой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ (кодовая точка Unicode) буквой или цифрой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ строчным. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ (кодовая точка Unicode) строчным. |
static boolean |
isLowSurrogate |
Определяет, является ли указанное значение char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица конечного суррогата). |
static boolean |
isMirrored |
Определяет, является ли символ зеркальным согласно спецификации Unicode. |
static boolean |
isMirrored |
Определяет, является ли указанный символ (кодовая точка Unicode) зеркальным согласно спецификации Unicode. |
static boolean |
isSpace |
Устарело. Заменено на isWhitespace(char). |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ пробельным символом Unicode. |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом Unicode. |
static boolean |
isSupplementaryCodePoint |
Определяет, находится ли указанный символ (кодовая точка Unicode) в диапазоне дополнительных символов. |
static boolean |
isSurrogate |
Определяет, является ли указанное значение char суррогатной кодовой единицей Unicode. |
static boolean |
isSurrogatePair |
Определяет, является ли указанная пара значений char допустимой суррогатной парой Unicode. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ заглавным. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ (кодовая точка Unicode) заглавным. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Unicode, но не его первым символом. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ (кодовая точка Unicode) входить в идентификатор Unicode не в качестве первого символа. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ в качестве первого символа идентификатора Unicode. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ (кодовая точка Unicode) в качестве первого символа идентификатора Unicode. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ заглавной буквой. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ (кодовая точка Unicode) заглавной буквой. |
static boolean |
isValidCodePoint |
Определяет, является ли указанная кодовая точка допустимым значением кодовой точки Unicode. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ пробельным символом согласно Java. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ (кодовая точка Unicode) пробельным символом согласно Java. |
static char |
lowSurrogate |
Возвращает замыкающий суррогат (кодовую единицу младшего суррогата) из суррогатной пары, представляющей указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. |
static int |
offsetByCodePoints |
Возвращает индекс в указанном подмассиве char, смещённый относительно заданного index на codePointOffset кодовых точек. |
static int |
offsetByCodePoints |
Возвращает индекс в указанной последовательности символов, смещённый относительно заданного index на codePointOffset кодовых точек. |
static char |
reverseBytes |
Возвращает значение, полученное обращением порядка байтов в указанном значении char. |
static char[] |
toChars |
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16, сохранённое в массиве char. |
static int |
toChars |
Преобразует указанный символ (кодовую точку Unicode) в его представление UTF-16. |
static int |
toCodePoint |
Преобразует указанную суррогатную пару в значение дополнительной кодовой точки. |
static char |
toLowerCase |
Преобразует символ-аргумент в нижний регистр, используя сведения о регистре из файла UnicodeData. |
static int |
toLowerCase |
Преобразует символ (кодовую точку Unicode)-аргумент в нижний регистр, используя сведения о регистре из файла UnicodeData. |
String |
toString() |
Возвращает объект String, представляющий значение этого Character. |
static String |
toString |
Возвращает объект String, представляющий указанный char. |
static String |
toString |
Возвращает объект String, представляющий указанный символ (кодовую точку Unicode). |
static char |
toTitleCase |
Преобразует символ-аргумент в заглавную форму, используя сведения о регистре из файла UnicodeData. |
static int |
toTitleCase |
Преобразует символ (кодовую точку Unicode)-аргумент в заглавную форму, используя сведения о регистре из файла UnicodeData. |
static char |
toUpperCase |
Преобразует символ-аргумент в верхний регистр, используя сведения о регистре из файла UnicodeData. |
static int |
toUpperCase |
Преобразует символ (кодовую точку Unicode)-аргумент в верхний регистр, используя сведения о регистре из файла UnicodeData. |
static Character |
valueOf |
Возвращает экземпляр Character, представляющий указанное значение char. |
Методы, объявленные в классе Object
clone, finalize, getClass, notify, notifyAll, wait, wait, wait | Модификатор и тип | Метод | Описание |
|---|---|---|
protected Object |
clone() |
Создаёт и возвращает копию этого объекта. |
protected void |
finalize() |
Устарело, планируется удаление: этот элемент API подлежит удалению в будущей версии. Финализация объявлена устаревшей и подлежит удалению в одном из следующих выпусков. |
final Class |
getClass() |
Возвращает класс времени выполнения этого Object. |
final void |
notify() |
Пробуждает одну нить, ожидающую на мониторе этого объекта. |
final void |
notifyAll() |
Пробуждает все нити, ожидающие на мониторе этого объекта. |
final void |
wait() |
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания. |
final void |
wait |
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания, либо до истечения заданного промежутка реального времени. |
final void |
wait |
Заставляет текущую нить ожидать пробуждения, обычно посредством уведомления или прерывания, либо до истечения заданного промежутка реального времени. |
Подробное описание полей
MIN_RADIX
public static final int MIN_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MAX_RADIX
public static final int MAX_RADIX
digit, метод forDigit и метод toString класса Integer.- См. также:
MIN_VALUE
public static final char MIN_VALUE
char, '\u0000'.- Начиная с версии:
- 1.0.2
- См. также:
MAX_VALUE
public static final char MAX_VALUE
char, '\uFFFF'.- Начиная с версии:
- 1.0.2
- См. также:
TYPE
public static final Class<Character> TYPE
Class, представляющий примитивный тип char.- Начиная с версии:
- 1.1
UNASSIGNED
public static final byte UNASSIGNED
- Начиная с версии:
- 1.1
- См. также:
UPPERCASE_LETTER
public static final byte UPPERCASE_LETTER
- Начиная с версии:
- 1.1
- См. также:
LOWERCASE_LETTER
public static final byte LOWERCASE_LETTER
- Начиная с версии:
- 1.1
- См. также:
TITLECASE_LETTER
public static final byte TITLECASE_LETTER
- Начиная с версии:
- 1.1
- См. также:
MODIFIER_LETTER
public static final byte MODIFIER_LETTER
- Начиная с версии:
- 1.1
- См. также:
OTHER_LETTER
public static final byte OTHER_LETTER
- Начиная с версии:
- 1.1
- См. также:
NON_SPACING_MARK
public static final byte NON_SPACING_MARK
- Начиная с версии:
- 1.1
- См. также:
ENCLOSING_MARK
public static final byte ENCLOSING_MARK
- Начиная с версии:
- 1.1
- См. также:
COMBINING_SPACING_MARK
public static final byte COMBINING_SPACING_MARK
- Начиная с версии:
- 1.1
- См. также:
DECIMAL_DIGIT_NUMBER
public static final byte DECIMAL_DIGIT_NUMBER
- Начиная с версии:
- 1.1
- См. также:
LETTER_NUMBER
public static final byte LETTER_NUMBER
- Начиная с версии:
- 1.1
- См. также:
OTHER_NUMBER
public static final byte OTHER_NUMBER
- Начиная с версии:
- 1.1
- См. также:
SPACE_SEPARATOR
public static final byte SPACE_SEPARATOR
- Начиная с версии:
- 1.1
- См. также:
LINE_SEPARATOR
public static final byte LINE_SEPARATOR
- Начиная с версии:
- 1.1
- См. также:
PARAGRAPH_SEPARATOR
public static final byte PARAGRAPH_SEPARATOR
- Начиная с версии:
- 1.1
- См. также:
CONTROL
public static final byte CONTROL
- Начиная с версии:
- 1.1
- См. также:
FORMAT
public static final byte FORMAT
- Начиная с версии:
- 1.1
- См. также:
PRIVATE_USE
public static final byte PRIVATE_USE
- Начиная с версии:
- 1.1
- См. также:
SURROGATE
public static final byte SURROGATE
- Начиная с версии:
- 1.1
- См. также:
DASH_PUNCTUATION
public static final byte DASH_PUNCTUATION
- Начиная с версии:
- 1.1
- См. также:
START_PUNCTUATION
public static final byte START_PUNCTUATION
- Начиная с версии:
- 1.1
- См. также:
END_PUNCTUATION
public static final byte END_PUNCTUATION
- Начиная с версии:
- 1.1
- См. также:
CONNECTOR_PUNCTUATION
public static final byte CONNECTOR_PUNCTUATION
- Начиная с версии:
- 1.1
- См. также:
OTHER_PUNCTUATION
public static final byte OTHER_PUNCTUATION
- Начиная с версии:
- 1.1
- См. также:
MATH_SYMBOL
public static final byte MATH_SYMBOL
- Начиная с версии:
- 1.1
- См. также:
CURRENCY_SYMBOL
public static final byte CURRENCY_SYMBOL
- Начиная с:
- 1.1
- См. также:
MODIFIER_SYMBOL
public static final byte MODIFIER_SYMBOL
- Начиная с:
- 1.1
- См. также:
OTHER_SYMBOL
public static final byte OTHER_SYMBOL
- Начиная с:
- 1.1
- См. также:
INITIAL_QUOTE_PUNCTUATION
public static final byte INITIAL_QUOTE_PUNCTUATION
- Начиная с:
- 1.4
- См. также:
FINAL_QUOTE_PUNCTUATION
public static final byte FINAL_QUOTE_PUNCTUATION
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_UNDEFINED
public static final byte DIRECTIONALITY_UNDEFINED
char в спецификации Unicode направление не определено.- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_ARABIC_NUMBER
public static final byte DIRECTIONALITY_ARABIC_NUMBER
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_NONSPACING_MARK
public static final byte DIRECTIONALITY_NONSPACING_MARK
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_BOUNDARY_NEUTRAL
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_PARAGRAPH_SEPARATOR
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_SEGMENT_SEPARATOR
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
- Начиная с:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
- Начиная с:
- 9
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
- Начиная с:
- 9
- См. также:
DIRECTIONALITY_FIRST_STRONG_ISOLATE
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
- Начиная с:
- 9
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
- Начиная с:
- 9
- См. также:
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
'\uD800'. Старший суррогат также известен как начальный суррогат.- Начиная с:
- 1.5
- См. также:
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
'\uDBFF'. Старший суррогат также известен как начальный суррогат.- Начиная с:
- 1.5
- См. также:
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
'\uDC00'. Младший суррогат также известен как конечный суррогат.- Начиная с:
- 1.5
- См. также:
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
'\uDFFF'. Младший суррогат также известен как конечный суррогат.- Начиная с:
- 1.5
- См. также:
MIN_SURROGATE
public static final char MIN_SURROGATE
'\uD800'.- Начиная с:
- 1.5
- См. также:
MAX_SURROGATE
public static final char MAX_SURROGATE
'\uDFFF'.- Начиная с:
- 1.5
- См. также:
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
U+10000.- Начиная с:
- 1.5
- См. также:
MIN_CODE_POINT
public static final int MIN_CODE_POINT
U+0000.- Начиная с:
- 1.5
- См. также:
MAX_CODE_POINT
public static final int MAX_CODE_POINT
U+10FFFF.- Начиная с:
- 1.5
- См. также:
SIZE
public static final int SIZE
char в беззнаковой двоичной форме, константа 16.- Начиная с:
- 1.5
- См. также:
BYTES
public static final int BYTES
char в беззнаковой двоичной форме.- Начиная с:
- 1.8
- См. также:
Подробное описание конструкторов
Character
@Deprecated(since="9") public Character(char value)
valueOf(char), поскольку она, вероятно, обеспечит значительно более высокую эффективность использования памяти и быстродействие.Character, представляющий указанное значение char.- Параметры:
-
value— значение, которое будет представлено объектомCharacter.
Подробное описание методов
describeConstable
public Optional<DynamicConstantDesc<Character>> describeConstable()
Optional, содержащий номинальный дескриптор этого экземпляра.- Указан в:
-
describeConstableв интерфейсеConstable - Возвращает:
Optional, описывающий экземпляр Character- Начиная с:
- 15
valueOf
public static Character valueOf(char c)
Character, представляющий указанное значение char. Если создание нового экземпляра Character не требуется, обычно следует предпочесть этот метод конструктору Character(char), поскольку благодаря кэшированию часто запрашиваемых значений этот метод, вероятно, обеспечит значительно более высокую эффективность использования памяти и быстродействие. Этот метод всегда кэширует значения в диапазоне от
'\u0000' до '\u007F' включительно и может кэшировать другие значения за пределами этого диапазона.- Параметры:
-
c— значение типа char. - Возвращает:
- экземпляр
Character, представляющийc. - Начиная с:
- 1.5
charValue
public char charValue()
Character.- Возвращает:
- примитивное значение
char, представленное этим объектом.
hashCode
hashCode
public static int hashCode(char value)
char; совместим с Character.hashCode().- Параметры:
-
value—char, для которого нужно вернуть хеш-код. - Возвращает:
- значение хеш-кода для значения
char. - Начиная с:
- 1.8
equals
public boolean equals(Object obj)
true тогда и только тогда, когда аргумент не равен null и является объектом Character, представляющим то же значение char, что и этот объект.toString
public String toString()
String, представляющий значение этого Character. Результат — строка длиной 1, единственным элементом которой является примитивное значение char, представленное этим объектом Character.toString
public static String toString(char c)
String, представляющий указанный char. Результат — строка длиной 1, состоящая только из указанного char.- Примечание к API:
- Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод
toString(int). - Параметры:
-
c—charдля преобразования - Возвращает:
- строковое представление указанного
char - Начиная с:
- 1.4
toString
public static String toString(int codePoint)
String, представляющий указанный символ (кодовую точку Unicode). Результат — строка длиной 1 или 2, состоящая только из указанного codePoint.- Параметры:
-
codePoint—codePointдля преобразования - Возвращает:
- строковое представление указанного
codePoint - Выбрасывает:
-
IllegalArgumentException— если указанныйcodePointне является допустимой кодовой точкой Unicode. - Начиная с:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
- Параметры:
-
codePoint— проверяемая кодовая точка Unicode - Возвращает:
-
true, если значение указанной кодовой точки находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно; в противном случае —false. - Начиная с:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
char.isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который требуется проверить - Возвращает:
-
true, если указанная кодовая точка находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно; в противном случае —false. - С версии:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
char кодовой единицей старшего суррогата Unicode (также известной как кодовая единица начального суррогата). Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch— значениеchar, которое требуется проверить. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно; в противном случае —false. - С версии:
- 1.5
- См. также:
isLowSurrogate
public static boolean isLowSurrogate(char ch)
char кодовой единицей младшего суррогата Unicode (также известной как кодовая единица конечного суррогата). Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch— значениеchar, которое требуется проверить. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно; в противном случае —false. - С версии:
- 1.5
- См. также:
isSurrogate
public static boolean isSurrogate(char ch)
char кодовой единицей суррогата Unicode. Такие значения сами по себе не представляют символы, но используются для представления дополнительных символов в кодировке UTF-16.
Значение char является кодовой единицей суррогата тогда и только тогда, когда оно является кодовой единицей младшего суррогата или кодовой единицей старшего суррогата.
- Параметры:
-
ch— значениеchar, которое требуется проверить. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно; в противном случае —false. - С версии:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high, char low)
char допустимой парой суррогатов Unicode. Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Параметры:
-
high— проверяемое значение кода старшего суррогата -
low— проверяемое значение кода младшего суррогата - Возвращает:
-
true, если указанные значения кодов старшего и младшего суррогатов образуют допустимую пару суррогатов; в противном случае —false. - С версии:
- 1.5
charCount
public static int charCount(int codePoint)
char, необходимых для представления указанного символа (кодовой точки Unicode). Если значение указанного символа равно 0x10000 или больше, метод возвращает 2. В противном случае метод возвращает 1. Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. При необходимости вызывающий код должен проверить значение символа с помощью isValidCodePoint.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который требуется проверить. - Возвращает:
- 2, если символ является допустимым дополнительным символом; в противном случае — 1.
- С версии:
- 1.5
- См. также:
toCodePoint
public static int toCodePoint(char high, char low)
isSurrogatePair.- Параметры:
-
high— кодовая единица старшего суррогата -
low— кодовая единица младшего суррогата - Возвращает:
- дополнительную кодовую точку, составленную из указанной пары суррогатов.
- С версии:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq, int index)
CharSequence. Если значение char по указанному индексу в CharSequence входит в диапазон старших суррогатов, следующий индекс меньше длины CharSequence, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
seq— последовательность значенийchar(кодовых единиц Unicode) -
index— индекс значенийchar(кодовых единиц Unicode) вseq, которые требуется преобразовать - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— если значениеindexотрицательно или не меньшеseq.length(). - С версии:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index)
char. Если значение char по указанному индексу в массиве char входит в диапазон старших суррогатов, следующий индекс меньше длины массива char, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
a— массивchar -
index— индекс значенийchar(кодовых единиц Unicode) в массивеchar, которые требуется преобразовать - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— если значениеindexотрицательно или не меньше длины массиваchar. - С версии:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index, int limit)
char; при этом могут использоваться только элементы массива с индексом index меньше limit. Если значение char по указанному индексу в массиве char входит в диапазон старших суррогатов, следующий индекс меньше limit, а значение char по следующему индексу входит в диапазон младших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по указанному индексу.- Параметры:
-
a— массивchar -
index— индекс значенийchar(кодовых единиц Unicode) в массивеchar, которые требуется преобразовать -
limit— индекс после последнего элемента массива, который можно использовать в массивеchar - Возвращает:
- кодовую точку Unicode по указанному индексу
- Выбрасывает:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— если аргументindexотрицателен или не меньше аргументаlimit, либо если аргументlimitотрицателен или больше длины массиваchar. - С версии:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq, int index)
CharSequence. Если значение char по индексу (index - 1) в CharSequence входит в диапазон младших суррогатов, (index - 2) не является отрицательным, а значение char по индексу (index - 2) в CharSequence входит в диапазон старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
seq— экземплярCharSequence -
index— индекс, следующий за кодовой точкой, которую требуется вернуть - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Выбрасывает:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— если аргументindexменьше 1 или большеseq.length(). - С версии:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index)
char. Если значение char по индексу (index - 1) в массиве char входит в диапазон младших суррогатов, (index - 2) не является отрицательным, а значение char по индексу (index - 2) в массиве char входит в диапазон старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char по индексу (index - 1).- Параметры:
-
a— массивchar -
index— индекс, следующий за кодовой точкой, которую требуется вернуть - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Выбрасывает:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— если аргументindexменьше 1 или больше длины массиваchar - С версии:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index, int start)
char, в котором можно использовать только элементы массива с index, большим или равным start. Если значение char в позиции (index - 1) массива char находится в диапазоне младших суррогатов, (index - 2) не меньше start, а значение char в позиции (index - 2) массива char находится в диапазоне старших суррогатов, возвращается дополнительная кодовая точка, соответствующая этой суррогатной паре. В противном случае возвращается значение char в позиции (index - 1).- Параметры:
-
a— массивchar -
index— индекс, следующий за кодовой точкой, которую следует вернуть -
start— индекс первого элемента массива в массивеchar - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Вызывает исключение:
-
NullPointerException— еслиaравен null. -
IndexOutOfBoundsException— если аргументindexне больше аргументаstartили больше длины массиваchar, либо если аргументstartотрицателен или не меньше длины массиваchar. - Начиная с версии:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint— дополнительный символ (кодовая точка Unicode) - Возвращает:
- начальную кодовую единицу суррогата, используемую для представления символа в кодировке UTF-16
- Начиная с версии:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint— дополнительный символ (кодовая точка Unicode) - Возвращает:
- конечную кодовую единицу суррогата, используемую для представления символа в кодировке UTF-16
- Начиная с версии:
- 1.7
toChars
public static int toChars(int codePoint, char[] dst, int dstIndex)
dst[dstIndex], и возвращается 1. Если указанная кодовая точка является дополнительным символом, его суррогатные значения сохраняются в dst[dstIndex] (старший суррогат) и dst[dstIndex+1] (младший суррогат), и возвращается 2.- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно преобразовать. -
dst— массивchar, в котором сохраняется значение UTF-16 дляcodePoint. -
dstIndex— начальный индекс в массивеdst, по которому сохраняется преобразованное значение. - Возвращает:
- 1, если кодовая точка является кодовой точкой BMP, и 2, если кодовая точка является дополнительной кодовой точкой.
- Вызывает исключение:
-
IllegalArgumentException— если указанное значениеcodePointне является допустимой кодовой точкой Unicode. -
NullPointerException— если указанное значениеdstравно null. -
IndexOutOfBoundsException— еслиdstIndexотрицателен или не меньшеdst.length, либо если в массивеdstначиная с позицииdstIndexнедостаточно элементов для хранения результирующего значенияchar. (ЕслиdstIndexравенdst.length-1, а указанное значениеcodePointявляется дополнительным символом, значение старшего суррогата не сохраняется вdst[dstIndex].) - Начиная с версии:
- 1.5
toChars
public static char[] toChars(int codePoint)
char. Если указанная кодовая точка является значением BMP (Basic Multilingual Plane, или плоскость 0), результирующий массив char содержит то же значение, что и codePoint. Если указанная кодовая точка является дополнительной кодовой точкой, результирующий массив char содержит соответствующую суррогатную пару.- Параметры:
-
codePoint— кодовая точка Unicode - Возвращает:
- массив
char, содержащий представление UTF-16 значенияcodePoint. - Вызывает исключение:
-
IllegalArgumentException— если указанное значениеcodePointне является допустимой кодовой точкой Unicode. - Начиная с версии:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
beginIndex и заканчивается char с индексом endIndex - 1. Таким образом, длина диапазона текста (в charах) равна endIndex-beginIndex. Несоставленные суррогаты в диапазоне текста считаются отдельными кодовыми точками.- Параметры:
-
seq— символьная последовательность -
beginIndex— индекс первогоcharдиапазона текста. -
endIndex— индекс после последнегоcharдиапазона текста. - Возвращает:
- количество кодовых точек Unicode в указанном диапазоне текста
- Вызывает исключение:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— еслиbeginIndexотрицателен, илиendIndexбольше длины указанной последовательности, илиbeginIndexбольшеendIndex. - Начиная с версии:
- 1.5
codePointCount
public static int codePointCount(char[] a, int offset, int count)
char. Аргумент offset задаёт индекс первого char подмассива, а аргумент count — длину подмассива в charах. Несоставленные суррогаты в подмассиве считаются отдельными кодовыми точками.- Параметры:
-
a— массивchar -
offset— индекс первогоcharв указанном массивеchar -
count— длина подмассива вcharах - Возвращает:
- количество кодовых точек Unicode в указанном подмассиве
- Вызывает исключение:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— еслиoffsetилиcountотрицателен либо еслиoffset + countбольше длины указанного массива. - Начиная с версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
index на codePointOffset кодовых точек. Несоставленные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.- Параметры:
-
seq— символьная последовательность -
index— индекс, относительно которого вычисляется смещение -
codePointOffset— смещение в кодовых точках - Возвращает:
- индекс в символьной последовательности
- Вызывает исключение:
-
NullPointerException— еслиseqравно null. -
IndexOutOfBoundsException— еслиindexотрицателен или больше длины символьной последовательности, либо еслиcodePointOffsetположителен и подстрока, начинающаяся сindex, содержит меньшеcodePointOffsetкодовых точек, либо еслиcodePointOffsetотрицателен и подпоследовательность передindexсодержит меньше кодовых точек, чем абсолютное значениеcodePointOffset. - Начиная с версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
char, смещённый относительно заданного index на codePointOffset кодовых точек. Аргументы start и count задают подмассив массива char. Несоставленные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются отдельными кодовыми точками.- Параметры:
-
a— массивchar -
start— индекс первогоcharподмассива -
count— длина подмассива вcharах -
index— индекс, относительно которого вычисляется смещение -
codePointOffset— смещение в кодовых точках - Возвращает:
- индекс в подмассиве
- Вызывает исключение:
-
NullPointerException— еслиaравно null. -
IndexOutOfBoundsException— еслиstartилиcountотрицателен, либо еслиstart + countбольше длины указанного массива, либо еслиindexменьшеstartили большеstart + count, либо еслиcodePointOffsetположителен и диапазон текста, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньшеcodePointOffsetкодовых точек, либо еслиcodePointOffsetотрицателен и диапазон текста, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше кодовых точек, чем абсолютное значениеcodePointOffset. - Начиная с версии:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Символ является строчным, если его тип общей категории, определяемый с помощью Character.getType(ch), равен LOWERCASE_LETTER или если он обладает свойством Other_Lowercase, определённым стандартом Unicode.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
Примечание: Этот метод не обрабатывает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isLowerCase(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является строчным; в противном случае —false. - См. также:
isLowerCase
public static boolean isLowerCase(int codePoint)
Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), — LOWERCASE_LETTER или он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ является строчным; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isUpperCase
public static boolean isUpperCase(char ch)
Символ является прописным, если его тип общей категории, предоставляемый Character.getType(ch), — UPPERCASE_LETTER, или он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.
Примеры прописных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются прописными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isUpperCase(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является прописным; в противном случае —false. - Начиная с:
- 1.0
- См. также:
isUpperCase
public static boolean isUpperCase(int codePoint)
Символ является прописным, если его тип общей категории, предоставляемый getType(codePoint), — UPPERCASE_LETTER или он обладает дополнительным свойством Other_Uppercase, определённым стандартом Unicode.
Примеры прописных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются прописными.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ является прописным; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isTitleCase
public static boolean isTitleCase(char ch)
Символ относится к титульному регистру, если его тип общей категории, предоставляемый Character.getType(ch), — TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», и соответствующая ей строчная буква, похожая на «lj». Третья форма, похожая на «Lj», — подходящая форма для отображения слова в нижнем регистре с заглавной первой буквой, например в названии книги.
Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также относятся к титульному регистру.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isTitleCase(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ относится к титульному регистру; в противном случае —false. - Начиная с:
- 1.0.2
- См. также:
isTitleCase
public static boolean isTitleCase(int codePoint)
Символ относится к титульному регистру, если его тип общей категории, предоставляемый getType(codePoint), — TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, существует прописная буква, похожая на «LJ», и соответствующая ей строчная буква, похожая на «lj». Третья форма, похожая на «Lj», — подходящая форма для отображения слова в нижнем регистре с заглавной первой буквой, например в названии книги.
Ниже приведены некоторые символы Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также относятся к титульному регистру.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ относится к титульному регистру; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isDigit
public static boolean isDigit(char ch)
Символ является цифрой, если его тип общей категории, предоставляемый Character.getType(ch), — DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'—'\u0039', цифры ISO-LATIN-1 ('0'—'9') -
'\u0660'—'\u0669', арабско-индийские цифры -
'\u06F0'—'\u06F9', расширенные арабско-индийские цифры -
'\u0966'—'\u096F', цифры деванагари -
'\uFF10'—'\uFF19', полноширинные цифры
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDigit(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является цифрой; в противном случае —false. - См. также:
isDigit
public static boolean isDigit(int codePoint)
Символ является цифрой, если его тип общей категории, предоставляемый getType(codePoint), — DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Unicode, содержащие цифры:
-
'\u0030'—'\u0039', цифры ISO-LATIN-1 ('0'—'9') -
'\u0660'—'\u0669', арабско-индийские цифры -
'\u06F0'—'\u06F9', расширенные арабско-индийские цифры -
'\u0966'—'\u096F', цифры деванагари -
'\uFF10'—'\uFF19', полноширинные цифры
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ является цифрой; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isDefined
public static boolean isDefined(char ch)
Символ считается определённым, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Для него задано значение в диапазоне, определённом файлом UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isDefined(int).
- Параметры:
-
ch— символ, который нужно проверить - Возвращает:
-
true, если символ имеет определённое значение в Unicode; в противном случае —false. - Начиная с:
- 1.0.2
- См. также:
isDefined
public static boolean isDefined(int codePoint)
Символ считается определённым, если выполняется хотя бы одно из следующих условий:
- Он имеет запись в файле UnicodeData.
- Для него задано значение в диапазоне, определённом файлом UnicodeData.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ имеет определённое значение в Unicode; в противном случае —false. - Начиная с:
- 1.5
- См. также:
isLetter
public static boolean isLetter(char ch)
Символ считается буквой, если его тип общей категории, предоставляемый Character.getType(ch), относится к одному из следующих типов:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isLetter(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является буквой; в противном случае —false. - См. также:
isLetter
public static boolean isLetter(int codePoint)
Символ считается буквой, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является буквой;falseв противном случае. - Начиная с версии:
- 1.5
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Символ считается буквой или цифрой, если для него метод Character.isLetter(char ch) или Character.isDigit(char ch) возвращает true.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - Начиная с версии:
- 1.0.2
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Символ считается буквой или цифрой, если для него метод isLetter(codePoint) или isDigit(codePoint) возвращает true.
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - Начиная с версии:
- 1.5
- См. также:
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:
- метод
isLetter(ch)возвращаетtrue - метод
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется соединительным знаком пунктуации (например,'_').
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Начиная с версии:
- 1.0.2
- См. также:
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Символ может входить в идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:
- он является буквой
- он является символом валюты (например,
'$') - он является соединительным знаком пунктуации (например,
'_') - он является цифрой
- он является числовой буквой (например, символом римской цифры)
- он является комбинирующим знаком
- он является невидимым диакритическим знаком
- метод
isIdentifierIgnorableвозвращаетtrueдля этого символа.
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может входить в идентификатор Java;falseв противном случае. - Начиная с версии:
- 1.0.2
- См. также:
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Символ считается алфавитным, если его тип общей категории, возвращаемый методом getType(codePoint), соответствует одному из следующих значений:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является буквой Unicode, иfalseв противном случае. - Начиная с версии:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является идеограммой Unicode, иfalseв противном случае. - Начиная с версии:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:
- метод
isLetter(ch)возвращаетtrue - метод
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется соединительным знаком пунктуации (например,'_').
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isJavaIdentifierStart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Начиная с версии:
- 1.1
- См. также:
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:
- метод
isLetter(codePoint)возвращаетtrue - метод
getType(codePoint)возвращаетLETTER_NUMBER - указанный символ является символом валюты (например,
'$') - указанный символ является соединительным знаком пунктуации (например,
'_').
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может начинать идентификатор Java;falseв противном случае. - Начиная с версии:
- 1.5
- См. также:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Символ может входить в идентификатор Java, если выполняется хотя бы одно из следующих условий:
- он является буквой
- он является символом валюты (например,
'$') - он является соединительным знаком пунктуации (например,
'_') - он является цифрой
- он является числовой буквой (например, символом римской цифры)
- он является комбинирующим знаком
- он является невидимым диакритическим знаком
- метод
isIdentifierIgnorableвозвращаетtrueдля этого символа
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isJavaIdentifierPart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может входить в идентификатор Java;falseв противном случае. - Начиная с версии:
- 1.1
- См. также:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный знак пунктуации (например,
'_') - это цифра
- это буквенный символ числа (например, римская цифра)
- это комбинируемый знак
- это неинтервальный знак
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля этой кодовой точки
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может быть частью идентификатора Java; в противном случае —false. - С версии:
- 1.5
- См. также:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Символ может быть первым символом идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обратной совместимости. Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может быть первым символом идентификатора Unicode; в противном случае —false. - С версии:
- 1.1
- Внешние спецификации
- См. также:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Символ может быть первым символом идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавляется к Start для обратной совместимости.- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может быть первым символом идентификатора Unicode; в противном случае —false. - С версии:
- 1.5
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:
- это буква
- это соединительный знак пунктуации (например,
'_') - это цифра
- это буквенный символ числа (например, римская цифра)
- это комбинируемый знак
- это неинтервальный знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавляется к Continue для обратной совместимости. Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ может быть частью идентификатора Unicode; в противном случае —false. - С версии:
- 1.1
- Внешние спецификации
- См. также:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих условий:
- это буква
- это соединительный знак пунктуации (например,
'_') - это цифра
- это буквенный символ числа (например, римская цифра)
- это комбинируемый знак
- это неинтервальный знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию UAX31-R1: идентификаторы по умолчанию стандарта Unicode со следующим профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавляется к Continue для обратной совместимости.- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ может быть частью идентификатора Unicode; в противном случае —false. - С версии:
- 1.5
- Внешние спецификации
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Следующие символы Unicode являются игнорируемыми в идентификаторе Java или Unicode:
- управляющие символы ISO, не являющиеся пробельными символами
-
от
'\u0000'до'\u0008' -
от
'\u000E'до'\u001B' -
от
'\u007F'до'\u009F'
-
от
- все символы, имеющие значение общей категории
FORMAT
Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch— проверяемый символ. - Возвращает:
-
true, если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode; в противном случае —false. - С версии:
- 1.1
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Следующие символы Unicode являются игнорируемыми в идентификаторе Java или Unicode:
- управляющие символы ISO, не являющиеся пробельными символами
-
от
'\u0000'до'\u0008' -
от
'\u000E'до'\u001B' -
от
'\u007F'до'\u009F'
-
от
- все символы, имеющие значение общей категории
FORMAT
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode; в противном случае —false. - С версии:
- 1.5
- См. также:
isEmoji
public static boolean isEmoji(int codePoint)
Символ считается эмодзи тогда и только тогда, когда ему присвоено свойство Emoji, определенное в документе Unicode Emoji (Технический стандарт № 51).
- Параметры:
-
codePoint— проверяемый символ (кодовая точка Unicode). - Возвращает:
-
true, если символ является эмодзи; в противном случае —false. - С версии:
- 21
- Внешние спецификации
isEmojiPresentation
public static boolean isEmojiPresentation(int codePoint)
Символ считается имеющим свойство Emoji Presentation тогда и только тогда, когда он имеет свойство Emoji_Presentation, определённое в Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ имеет свойство Emoji Presentation; в противном случае —false. - Начиная с версии:
- 21
- Внешние спецификации
isEmojiModifier
public static boolean isEmojiModifier(int codePoint)
Символ считается модификатором Emoji тогда и только тогда, когда он имеет свойство Emoji_Modifier, определённое в Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является модификатором Emoji; в противном случае —false. - Начиная с версии:
- 21
- Внешние спецификации
isEmojiModifierBase
public static boolean isEmojiModifierBase(int codePoint)
Символ считается базовым символом для модификатора Emoji тогда и только тогда, когда он имеет свойство Emoji_Modifier_Base, определённое в Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является базовым символом для модификатора Emoji; в противном случае —false. - Начиная с версии:
- 21
- Внешние спецификации
isEmojiComponent
public static boolean isEmojiComponent(int codePoint)
Символ считается компонентом Emoji тогда и только тогда, когда он имеет свойство Emoji_Component, определённое в Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является компонентом Emoji; в противном случае —false. - Начиная с версии:
- 21
- Внешние спецификации
isExtendedPictographic
public static boolean isExtendedPictographic(int codePoint)
Символ считается расширенным пиктографическим символом тогда и только тогда, когда он имеет свойство Extended_Pictographic, определённое в Unicode Emoji (технический стандарт № 51).
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является расширенным пиктографическим символом; в противном случае —false. - Начиная с версии:
- 21
- Внешние спецификации
toLowerCase
public static char toLowerCase(char ch)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.
Как правило, для преобразования символов в нижний регистр следует использовать String.toLowerCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch— символ, который необходимо преобразовать. - Возвращает:
- эквивалент символа в нижнем регистре, если он существует; в противном случае — сам символ.
- См. также:
toLowerCase
public static int toLowerCase(int codePoint)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.
Как правило, для преобразования символов в нижний регистр следует использовать String.toLowerCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо преобразовать. - Возвращает:
- эквивалент символа (кодовой точки Unicode) в нижнем регистре, если он существует; в противном случае — сам символ.
- Начиная с версии:
- 1.5
- См. также:
toUpperCase
public static char toUpperCase(char ch)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.
Как правило, для преобразования символов в верхний регистр следует использовать String.toUpperCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toUpperCase(int).
- Параметры:
-
ch— символ, который необходимо преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае — сам символ.
- См. также:
toUpperCase
public static int toUpperCase(int codePoint)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, в частности для символов, являющихся знаками или идеограммами.
Как правило, для преобразования символов в верхний регистр следует использовать String.toUpperCase(). String методы преобразования регистра имеют ряд преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования с учётом локали и контекста, а также преобразования символов по схеме 1:M, тогда как Character методы преобразования регистра этого не могут.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он существует; в противном случае — сам символ.
- Начиная с версии:
- 1.5
- См. также:
toTitleCase
public static char toTitleCase(char ch)
char уже является символом титульного регистра char, будет возвращено то же значение char. Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toTitleCase(int).
- Параметры:
-
ch— символ, который необходимо преобразовать. - Возвращает:
- эквивалент символа в титульном регистре, если он существует; в противном случае — сам символ.
- Начиная с версии:
- 1.0.2
- См. также:
toTitleCase
public static int toTitleCase(int codePoint)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо преобразовать. - Возвращает:
- эквивалент символа в титульном регистре, если он существует; в противном случае — сам символ.
- Начиная с версии:
- 1.5
- См. также:
digit
public static int digit(char ch, int radix)
ch в указанной системе счисления. Если основание системы счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если истинно хотя бы одно из следующих условий:
- Метод
isDigitявляетсяtrueсимвола, а значение десятичной цифры этого символа в Unicode (или его односимвольного разложения) меньше указанного основания системы счисления. В этом случае возвращается значение десятичной цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', а его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', а его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из полноширинных заглавных латинских букв от A (
'\uFF21') до Z ('\uFF3A'), а его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из полноширинных строчных латинских букв от a (
'\uFF41') до z ('\uFF5A'), а его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch— символ, который нужно преобразовать. -
radix— основание системы счисления. - Возвращает:
- числовое значение, представленное символом в указанной системе счисления.
- См. также:
digit
public static int digit(int codePoint, int radix)
Если основание системы счисления не входит в диапазон MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в указанной системе счисления, возвращается -1. Символ является допустимой цифрой, если истинно хотя бы одно из следующих условий:
- Метод
isDigit(codePoint)являетсяtrueсимвола, а значение десятичной цифры этого символа в Unicode (или его односимвольного разложения) меньше указанного основания системы счисления. В этом случае возвращается значение десятичной цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', а его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', а его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из полноширинных заглавных латинских букв от A (
'\uFF21') до Z ('\uFF3A'), а его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из полноширинных строчных латинских букв от a (
'\uFF41') до z ('\uFF5A'), а его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно преобразовать. -
radix— основание системы счисления. - Возвращает:
- числовое значение, представленное символом в указанной системе счисления.
- Начиная с версии:
- 1.5
- См. также:
getNumericValue
public static int getNumericValue(char ch)
int значение, которое представляет указанный символ Unicode. Например, символ '\u216C' (римская цифра пятьдесят) вернёт значение int, равное 50. Заглавные латинские буквы A–Z (от '\u0041' до '\u005A'), строчные латинские буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовых значений этим значениям char.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch— символ, который нужно преобразовать. - Возвращает:
- числовое значение символа в виде неотрицательного значения
int; -2, если символ имеет числовое значение, которое нельзя представить в виде неотрицательного значенияint; -1, если символ не имеет числового значения. - Начиная с версии:
- 1.1
- См. также:
getNumericValue
public static int getNumericValue(int codePoint)
int значение, которое представляет указанный символ (кодовая точка Unicode). Например, символ '\u216C' (римская цифра пятьдесят) вернёт значение int, равное 50. Заглавные латинские буквы A–Z (от '\u0041' до '\u005A'), строчные латинские буквы a–z (от '\u0061' до '\u007A') и их полноширинные варианты (от '\uFF21' до '\uFF3A' и от '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это не зависит от спецификации Unicode, которая не присваивает числовых значений этим значениям char.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое нельзя представить в виде неотрицательного целого числа (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно преобразовать. - Возвращает:
- числовое значение символа в виде неотрицательного значения
int; -2, если символ имеет числовое значение, которое нельзя представить в виде неотрицательного значенияint; -1, если символ не имеет числового значения. - Начиная с версии:
- 1.5
- См. также:
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
true только для следующих пяти символов: | Символ | Код | Название |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является пробельным символом ISO-LATIN-1; в противном случае —false. - См. также:
isSpaceChar
public static boolean isSpaceChar(char ch)
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является пробельным; в противном случае —false. - Начиная с версии:
- 1.1
- См. также:
isSpaceChar
public static boolean isSpaceChar(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ является пробельным; в противном случае —false. - Начиная с версии:
- 1.5
- См. также:
isWhitespace
public static boolean isWhitespace(char ch)
- Это пробельный символ Unicode (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), который при этом не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Это
'\t', U+0009 горизонтальная табуляция. - Это
'\n', U+000A перевод строки. - Это
'\u000B', U+000B вертикальная табуляция. - Это
'\f', U+000C перевод страницы. - Это
'\r', U+000D возврат каретки. - Это
'\u001C', U+001C разделитель файлов. - Это
'\u001D', U+001D разделитель групп. - Это
'\u001E', U+001E разделитель записей. - Это
'\u001F', U+001F разделитель единиц.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isWhitespace(int).
- Параметры:
-
ch— символ, который нужно проверить. - Возвращает:
-
true, если символ является пробельным символом Java; в противном случае —false. - Начиная с версии:
- 1.1
- См. также:
isWhitespace
public static boolean isWhitespace(int codePoint)
- Он является символом-разделителем Unicode (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Это
'\t', U+0009 HORIZONTAL TABULATION. - Это
'\n', U+000A LINE FEED. - Это
'\u000B', U+000B VERTICAL TABULATION. - Это
'\f', U+000C FORM FEED. - Это
'\r', U+000D CARRIAGE RETURN. - Это
'\u001C', U+001C FILE SEPARATOR. - Это
'\u001D', U+001D GROUP SEPARATOR. - Это
'\u001E', U+001E RECORD SEPARATOR. - Это
'\u001F', U+001F UNIT SEPARATOR.
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является пробельным символом Java; в противном случае —false. - Начиная с версии:
- 1.5
- См. также:
isISOControl
public static boolean isISOControl(char ch)
'\u0000' до '\u001F' или в диапазоне от '\u007F' до '\u009F'. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).
- Параметры:
-
ch— символ, который необходимо проверить. - Возвращает:
-
true, если символ является управляющим символом ISO; в противном случае —false. - Начиная с версии:
- 1.1
- См. также:
isISOControl
public static boolean isISOControl(int codePoint)
'\u0000' до '\u001F' или в диапазоне от '\u007F' до '\u009F'.- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
-
true, если символ является управляющим символом ISO; в противном случае —false. - Начиная с версии:
- 1.5
- См. также:
getType
public static int getType(char ch)
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).
- Параметры:
-
ch— символ, который необходимо проверить. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - Начиная с версии:
- 1.1
- См. также:
getType
public static int getType(int codePoint)
- Параметры:
-
codePoint— символ (кодовая точка Unicode), который необходимо проверить. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - Начиная с версии:
- 1.5
- См. также:
forDigit
public static char forDigit(int digit, int radix)
radix не является допустимым основанием системы счисления или значение digit не является допустимой цифрой в указанной системе счисления, возвращается нулевой символ ('\u0000'). Аргумент radix является допустимым, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit является допустимым, если 0 <= digit < radix.
Если цифра меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit— число, которое требуется преобразовать в символ. -
radix— основание системы счисления. - Возвращает:
- символьное представление
charуказанной цифры в заданной системе счисления. - См. также:
getDirectionality
public static byte getDirectionality(char ch)
char равно DIRECTIONALITY_UNDEFINED. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch—char, для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - Начиная с версии:
- 1.4
- См. также:
getDirectionality
public static byte getDirectionality(int codePoint)
DIRECTIONALITY_UNDEFINED.- Параметры:
-
codePoint— символ (кодовая точка Unicode), для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- С версии:
- 1.5
- См. также:
isMirrored
public static boolean isMirrored(char ch)
'\u0028' LEFT PARENTHESIS семантически определяется как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)». Примечание: Этот метод не поддерживает дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch—char, для которого запрашивается свойство зеркальности - Возвращает:
-
true, если символ зеркальный,false, еслиcharне является зеркальным или не определён. - С версии:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
'\u0028' LEFT PARENTHESIS семантически определяется как открывающая скобка. В тексте с направлением слева направо она отображается как «(», а в тексте с направлением справа налево — как «)».- Параметры:
-
codePoint— символ (кодовая точка Unicode), который нужно проверить. - Возвращает:
-
true, если символ зеркальный,false, если символ не является зеркальным или не определён. - С версии:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
Character численно.- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter—Characterдля сравнения. - Возвращает:
- значение
0, если аргументCharacterравен этомуCharacter; значение меньше0, если этоCharacterчисленно меньше аргументаCharacter; и значение больше0, если этоCharacterчисленно больше аргументаCharacter(беззнаковое сравнение). Обратите внимание, что это исключительно числовое сравнение, не зависящее от локали. - С версии:
- 1.2
compare
public static int compare(char x, char y)
char численно. Возвращаемое значение совпадает со значением, которое было бы возвращено следующим выражением: Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x— первыйcharдля сравнения -
y— второйcharдля сравнения - Возвращает:
- значение
0, еслиx == y; значение меньше0, еслиx < y; и значение больше0, еслиx > y - С версии:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
char.- Параметры:
-
ch—char, порядок байтов которого нужно обратить. - Возвращает:
- значение, полученное обращением (или, что эквивалентно, перестановкой) байтов в указанном значении
char. - С версии:
- 1.5
getName
public static String getName(int codePoint)
codePoint или null, если кодовая точка является unassigned. Если указанному символу не назначено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Unicode Consortium), возвращаемое имя совпадает с результатом выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для codePointов в файле UnicodeData имя, возвращаемое этим методом, соответствует схеме именования из раздела «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек, например хангыльских символов и идеограмм, приведённое выше правило генерации имени отличается от правила, определённого в стандарте Unicode.- Параметры:
-
codePoint— символ (кодовая точка Unicode) - Возвращает:
- имя указанного символа или null, если кодовая точка не назначена.
- Выбрасывает:
-
IllegalArgumentException— если указаннаяcodePointне является допустимой кодовой точкой Unicode. - С версии:
- 1.7
codePointOf
public static int codePointOf(String name)
Если символу не назначено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой Unicode Consortium), его имя определяется как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Сопоставление name не учитывает регистр; начальные и конечные пробельные символы удаляются. Для кодовых точек из файла UnicodeData этот метод распознаёт имя, соответствующее имени, определённому в разделе «Свойство имени Unicode» стандарта Unicode. Для других кодовых точек этот метод распознаёт имя, сгенерированное методом getName(int).
- Параметры:
-
name— имя символа - Возвращает:
- значение кодовой точки символа, указанного его именем.
- Выбрасывает:
-
IllegalArgumentException— если указанноеnameне является допустимым именем символа. -
NullPointerException— еслиnameравноnull - С версии:
- 9
© 1993, 2025, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.