Класс Character
- Все реализованные интерфейсы:
-
Serializable,Comparable<Character>,Constable
public final class Character extends Object implements Serializable, Comparable<Character>, Constable
Character оборачивает значение примитивного типа char в объект. Объект класса Character содержит единственное поле типа char. Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т.д.) и для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие стандарту Unicode
Поля и методы класса Character определены с учетом информации о символах из стандарта Unicode, в частности, файла UnicodeData, являющегося частью базы данных символов Unicode. Этот файл определяет свойства, включая имя и категорию для каждого присвоенного кодового значения Unicode или диапазона символов. Файл доступен от Консорциума Unicode по адресу http://www.unicode.org.
Информация о символах основана на стандарте Unicode, версии 15.0.
Java платформа поддерживала разные версии стандарта Unicode на протяжении времени. Обновления до новых версий стандарта Unicode происходили в следующих релизах Java, каждый из которых указывает новую версию:
| Релиз Java | Версия Unicode |
|---|---|
| Java SE 20 | Unicode 15.0 |
| Java SE 19 | Unicode 14.0 |
| Java SE 15 | Unicode 13.0 |
| Java SE 13 | Unicode 12.1 |
| Java SE 12 | Unicode 11.0 |
| Java SE 11 | Unicode 10.0 |
| Java SE 9 | Unicode 8.0 |
| Java SE 8 | Unicode 6.2 |
| Java SE 7 | Unicode 6.0 |
| Java SE 5.0 | Unicode 4.0 |
| Java SE 1.4 | Unicode 3.0 |
| JDK 1.1 | Unicode 2.0 |
| JDK 1.0.2 | Unicode 1.1.5 |
Представление символов Unicode
Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основано на оригинальной спецификации Unicode, которая определяла символы как сущности фиксированной ширины в 16 бит. Стандарт Unicode с тех пор был изменён, чтобы позволить символы, представление которых требует более 16 бит. Диапазон допустимых кодовых точек теперь U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда упоминается как Базовая многоязычная плоскость (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Java платформа использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первая из диапазона верхних суррогатов (\uD800-\uDBFF), вторая из диапазона нижних суррогатов (\uDC00-\uDFFF).
Значение char поэтому представляет кодовые точки Базовой многоязычной плоскости (BMP), включая суррогатные кодовые точки или кодовые единицы кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные кодовые точки. Нижние (наименее значимые) 21 бит int используются для представления кодовых точек Unicode, а верхние (наиболее значимые) 11 бит должны быть равны нулю. За исключением случаев, когда явно указано иное, поведение по отношению к дополнительным символам и суррогатным char значениям таково:
- Методы, которые принимают только значение
char, не могут поддерживать дополнительные символы. Они обрабатывают значенияcharиз суррогатных диапазонов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, даже если это конкретное значение, если за ним следует любое низкое суррогатное значение в строке, представляло бы букву. - Методы, принимающие значение
intзначения поддерживают все символы Unicode, включая дополнительные символы. Например,Character.isLetter(0x2F81A)возвращаетtrue, потому что кодовое значение представляет собой букву (китайский иероглиф).
В документации Java SE API кодовая точка Unicode используется для значений символов в диапазоне между U+0000 и U+10FFFF, а кодовая единица Unicode используется для 16-битных char значений, которые являются кодовыми единицами кодировки UTF-16. Для получения дополнительной информации о терминологии Unicode обратитесь к Словарю Unicode.
Это класс на основе значения; программисты должны рассматривать экземпляры, которые равны, как взаимозаменяемые и не должны использовать экземпляры для синхронизации, иначе может произойти непредсказуемое поведение. Например, в будущем выпуске синхронизация может потерпеть неудачу.
- С:
- 1.0
- Внешние спецификации
- См. также:
Краткое описание вложенных классов
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class |
Character.Subset |
Экземпляры этого класса представляют собой определённые подмножества набора символов Unicode. |
static final class |
Character.UnicodeBlock |
Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode. |
static enum |
Character.UnicodeScript |
Семейство подмножеств символов, представляющих наборы символов, определённые в Приложении Unicode #24: Имена наборов символов. |
Краткое описание полей
| Модификатор и тип | Поле | Описание |
|---|---|---|
static final int |
BYTES |
Количество байтов, используемых для представления значения char в беззнаковом двоичном формате. |
static final byte |
COMBINING_SPACING_MARK |
Общая категория "Mc" в спецификации Unicode. |
static final byte |
CONNECTOR_PUNCTUATION |
Общая категория "Pc" в спецификации Unicode. |
static final byte |
CONTROL |
Общая категория "Cc" в спецификации Unicode. |
static final byte |
CURRENCY_SYMBOL |
Общая категория "Sc" в спецификации Unicode. |
static final byte |
DASH_PUNCTUATION |
Общая категория "Pd" в спецификации Unicode. |
static final byte |
DECIMAL_DIGIT_NUMBER |
Общая категория "Nd" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_ARABIC_NUMBER |
Слабый бинациональный тип символа "AN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL |
Слабый бинациональный тип символа "BN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR |
Слабый бинациональный тип символа "CS" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER |
Слабый бинациональный тип символа "EN" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR |
Слабый бинациональный тип символа "ES" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR |
Слабый бинациональный тип символа "ET" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_FIRST_STRONG_ISOLATE |
Слабый бинациональный тип символа "FSI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT |
Сильный бинациональный тип символа "L" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING |
Сильный бинациональный тип символа "LRE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE |
Слабый бинациональный тип символа "LRI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE |
Сильный бинациональный тип символа "LRO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_NONSPACING_MARK |
Слабый бинациональный тип символа "NSM" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_OTHER_NEUTRALS |
Нейтральный бинациональный тип символа "ON" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR |
Нейтральный бинациональный тип символа "B" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT |
Слабый бинациональный тип символа "PDF" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE |
Слабый бинациональный тип символа "PDI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT |
Сильный бинациональный тип символа "R" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC |
Сильный бинациональный тип символа "AL" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING |
Сильный бинациональный тип символа "RLE" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE |
Слабый бинациональный тип символа "RLI" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE |
Сильный бинациональный тип символа "RLO" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_SEGMENT_SEPARATOR |
Нейтральный бинациональный тип символа "S" в спецификации Unicode. |
static final byte |
DIRECTIONALITY_UNDEFINED |
Неопределенный бинациональный тип символа. |
static final byte |
DIRECTIONALITY_WHITESPACE |
Нейтральный бинациональный тип символа "WS" в спецификации Unicode. |
static final byte |
ENCLOSING_MARK |
Общая категория "Me" в спецификации Unicode. |
static final byte |
END_PUNCTUATION |
Общая категория "Pe" в спецификации Unicode. |
static final byte |
FINAL_QUOTE_PUNCTUATION |
Общая категория "Pf" в спецификации Unicode. |
static final byte |
FORMAT |
Общая категория "Cf" в спецификации Unicode. |
static final byte |
INITIAL_QUOTE_PUNCTUATION |
Общая категория "Pi" в спецификации Unicode. |
static final byte |
LETTER_NUMBER |
Общая категория "Nl" в спецификации Unicode. |
static final byte |
LINE_SEPARATOR |
Общая категория "Zl" в спецификации Unicode. |
static final byte |
LOWERCASE_LETTER |
Общая категория "Ll" в спецификации Unicode. |
static final byte |
MATH_SYMBOL |
Общая категория "Sm" в спецификации Unicode. |
static final int |
MAX_CODE_POINT |
Максимальное значение кода символа Unicode, константа U+10FFFF. |
static final char |
MAX_HIGH_SURROGATE |
Максимальное значение высокого суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uDBFF'. |
static final char |
MAX_LOW_SURROGATE |
Максимальное значение низкого суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final int |
MAX_RADIX |
Максимальное основание, доступное для преобразования в и из строк. |
static final char |
MAX_SURROGATE |
Максимальное значение суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uDFFF'. |
static final char |
MAX_VALUE |
Значение константы этого поля - наибольшее значение типа char, '\uFFFF'. |
static final int |
MIN_CODE_POINT |
Минимальное значение кода символа Unicode, константа U+0000. |
static final char |
MIN_HIGH_SURROGATE |
Минимальное значение высокого суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_LOW_SURROGATE |
Минимальное значение низкого суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uDC00'. |
static final int |
MIN_RADIX |
Минимальное основание, доступное для преобразования в и из строк. |
static final int |
MIN_SUPPLEMENTARY_CODE_POINT |
Минимальное значение дополнительного кода символа Unicode, константа U+10000. |
static final char |
MIN_SURROGATE |
Минимальное значение суррогатного кодового блока Unicode в кодировке UTF-16, константа '\uD800'. |
static final char |
MIN_VALUE |
Значение константы этого поля - наименьшее значение типа char, '\u0000'. |
static final byte |
MODIFIER_LETTER |
Общая категория "Lm" в спецификации Unicode. |
static final byte |
MODIFIER_SYMBOL |
Общая категория "Sk" в спецификации Unicode. |
static final byte |
NON_SPACING_MARK |
Общая категория "Mn" в спецификации Unicode. |
static final byte |
OTHER_LETTER |
Общая категория "Lo" в спецификации Unicode. |
static final byte |
OTHER_NUMBER |
Общая категория "No" в спецификации Unicode. |
static final byte |
OTHER_PUNCTUATION |
Общая категория "Po" в спецификации Unicode. |
static final byte |
OTHER_SYMBOL |
Общая категория "So" в спецификации Unicode. |
static final byte |
PARAGRAPH_SEPARATOR |
Общая категория "Zp" в спецификации Unicode. |
static final byte |
PRIVATE_USE |
Общая категория "Co" в спецификации Unicode. |
static final int |
SIZE |
Количество битов, используемых для представления значения char в беззнаковом двоичном формате, константа 16. |
static final byte |
SPACE_SEPARATOR |
Общая категория "Zs" в спецификации Unicode. |
static final byte |
START_PUNCTUATION |
Общая категория "Ps" в спецификации Unicode. |
static final byte |
SURROGATE |
Общая категория "Cs" в спецификации Unicode. |
static final byte |
TITLECASE_LETTER |
Общая категория "Lt" в спецификации Unicode. |
static final Class |
TYPE |
Экземпляр Class, представляющий примитивный тип char. |
static final byte |
UNASSIGNED |
Общая категория "Cn" в спецификации Unicode. |
static final byte |
UPPERCASE_LETTER |
Общая категория "Lu" в спецификации Unicode. |
Краткое описание конструкторов
| Конструктор | Описание |
|---|---|
Character |
Устаревший, для удаления: Этот элемент API может быть удален в будущей версии. Использовать этот конструктор редко уместно. |
Краткое описание методов
| Модификатор и тип | Метод | Описание |
|---|---|---|
static int |
charCount |
Определяет количество значений char необходимых для представления указанного символа (кодовой точки Юникода). |
char |
charValue() |
Возвращает значение этого объекта Character. |
static int |
codePointAt |
Возвращает кодовую точку в заданном индексе массива char. |
static int |
codePointAt |
Возвращает кодовую точку в заданном индексе массива char, где используются только элементы массива с index меньше limit. |
static int |
codePointAt |
Возвращает кодовую точку в заданном индексе CharSequence. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу массива char. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу массива char, где используются только элементы массива с index больше или равно start. |
static int |
codePointBefore |
Возвращает кодовую точку, предшествующую заданному индексу CharSequence. |
static int |
codePointCount |
Возвращает количество кодовых точек Юникода в подмассиве аргумента массива char. |
static int |
codePointCount |
Возвращает количество кодовых точек Юникода в текстовом диапазоне указанной последовательности символов. |
static int |
codePointOf |
Возвращает значение кодовой точки Юникода символа, указанного заданным именем символа. |
static int |
compare |
Числовое сравнение двух значений char. |
int |
compareTo |
Числовое сравнение двух объектов Character. |
Optional |
describeConstable() |
Возвращает Optional, содержащий номинальный дескриптор для этого экземпляра. |
static int |
digit |
Возвращает числовое значение символа ch в указанном основании. |
static int |
digit |
Возвращает числовое значение указанного символа (кодовой точки Юникода) в указанном основании. |
boolean |
equals |
Сравнивает этот объект с указанным объектом. |
static char |
forDigit |
Определяет представление символа для определённой цифры в указанном основании. |
static byte |
getDirectionality |
Возвращает свойство направленности Юникода для данного символа. |
static byte |
getDirectionality |
Возвращает свойство направленности Юникода для данного символа (кодовой точки Юникода). |
static String |
getName |
Возвращает имя указанного символа codePoint, или null, если кодовая точка unassigned. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ Юникода. |
static int |
getNumericValue |
Возвращает значение int, которое представляет указанный символ (кодовую точку Юникода). |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
static int |
getType |
Возвращает значение, указывающее общую категорию символа. |
int |
hashCode() |
Возвращает хеш-код для этого объекта Character; равно результату вызова charValue(). |
static int |
hashCode |
Возвращает хеш-код для значения char ; совместимо с Character.hashCode(). |
static char |
highSurrogate |
Возвращает ведущий суррогат ( код-единицу высокого суррогата) пары суррогатов , представляющей указанный дополнительный символ (кодовую точку Юникода) в кодировке UTF-16. |
static boolean |
isAlphabetic |
Определяет, является ли указанный символ (кодовая точка Юникода) буквенным. |
static boolean |
isBmpCodePoint |
Определяет, находится ли указанный символ (кодовая точка Юникода) в Базовой многоязычной плоскости (BMP). |
static boolean |
isDefined |
Определяет, определён ли символ в Юникоде. |
static boolean |
isDefined |
Определяет, определён ли символ (кодовая точка Юникода) в Юникоде. |
static boolean |
isDigit |
Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit |
Определяет, является ли указанный символ (кодовая точка Юникода) цифрой. |
static boolean |
isEmoji |
Определяет, является ли указанный символ (кодовая точка Юникода) Эмодзи. |
static boolean |
isEmojiComponent |
Определяет, является ли указанный символ (кодовая точка Юникода) компонентом Эмодзи. |
static boolean |
isEmojiModifier |
Определяет, является ли указанный символ (кодовая точка Юникода) модификатором Эмодзи. |
static boolean |
isEmojiModifierBase |
Определяет, является ли указанный символ (кодовая точка Юникода) базовым модификатором Эмодзи. |
static boolean |
isEmojiPresentation |
Определяет, имеет ли указанный символ (кодовая точка Юникода) свойство представления Эмодзи по умолчанию. |
static boolean |
isExtendedPictographic |
Определяет, является ли указанный символ (кодовая точка Юникода) расширенным пиктографическим символом. |
static boolean |
isHighSurrogate |
Определяет, является ли заданное значение char кодом-единицей высокого суррогата Юникода (также известным как ведущая код-единица суррогата). |
static boolean |
isIdentifierIgnorable |
Определяет, должен ли указанный символ рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdentifierIgnorable |
Определяет, должен ли указанный символ (кодовая точка Юникода) рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdeographic |
Определяет, является ли указанный символ CJKV (китайский, японский, корейский и вьетнамский) иероглифом, как определено в стандарте Юникод. |
static boolean |
isISOControl |
Определяет, является ли указанный символ управляющим символом ISO. |
static boolean |
isISOControl |
Определяет, является ли символ (кодовая точка Юникода) управляющим символом ISO. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа. |
static boolean |
isJavaIdentifierPart |
Определяет, может ли символ (кодовая точка Юникода) быть частью идентификатора Java, кроме первого символа. |
static boolean |
isJavaIdentifierStart |
Определяет, разрешён ли указанный символ как первый символ в идентификаторе Java. |
static boolean |
isJavaIdentifierStart |
Определяет, разрешён ли символ (кодовая точка Юникода) как первый символ в идентификаторе Java. |
static boolean |
isJavaLetter |
Устаревший. Заменён на isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit |
Устарело. Заменено на isJavaIdentifierPart(char). |
static boolean |
isLetter |
Определяет, является ли указанный символ буквой. |
static boolean |
isLetter |
Определяет, является ли указанный символ (код Юникода) буквой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit |
Определяет, является ли указанный символ (код Юникода) буквой или цифрой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ строчной буквой. |
static boolean |
isLowerCase |
Определяет, является ли указанный символ (код Юникода) строчной буквой. |
static boolean |
isLowSurrogate |
Определяет, является ли заданное значение char нижним суррогатным кодом Юникода (также известным как кодовый блок последующего суррогата). |
static boolean |
isMirrored |
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isMirrored |
Определяет, является ли указанный символ (код Юникода) зеркальным в соответствии со спецификацией Юникода. |
static boolean |
isSpace |
Устарело. Заменено на isWhitespace(char). |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ символом пробела Юникода. |
static boolean |
isSpaceChar |
Определяет, является ли указанный символ (код Юникода) символом пробела Юникода. |
static boolean |
isSupplementaryCodePoint |
Определяет, находится ли указанный символ (код Юникода) в диапазоне дополнительных символов. |
static boolean |
isSurrogate |
Определяет, является ли заданное значение char кодом суррогата Юникода. |
static boolean |
isSurrogatePair |
Определяет, является ли заданная пара значений char корректной парой суррогатов Юникода. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ заглавной буквой. |
static boolean |
isTitleCase |
Определяет, является ли указанный символ (код Юникода) заглавной буквой. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа. |
static boolean |
isUnicodeIdentifierPart |
Определяет, может ли указанный символ (код Юникода) быть частью идентификатора Юникода, кроме первого символа. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUnicodeIdentifierStart |
Определяет, допустим ли указанный символ (код Юникода) в качестве первого символа в идентификаторе Юникода. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ заглавной буквой. |
static boolean |
isUpperCase |
Определяет, является ли указанный символ (код Юникода) заглавной буквой. |
static boolean |
isValidCodePoint |
Определяет, является ли указанный код точка допустимым значением кода точки Юникода. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ пробелом в соответствии с Java. |
static boolean |
isWhitespace |
Определяет, является ли указанный символ (код Юникода) пробелом в соответствии с Java. |
static char |
lowSurrogate |
Возвращает последующий суррогат (нижний суррогатный код Юникода) пары суррогатов, представляющей указанный дополнительный символ (код Юникода) в кодировке UTF-16. |
static int |
offsetByCodePoints |
Возвращает индекс в заданном подмассиве, смещенном от заданного char на index символов. |
static int |
offsetByCodePoints |
Возвращает индекс в заданной последовательности символов, смещенный от заданного index на codePointOffset символов. |
static char |
reverseBytes |
Возвращает значение, полученное путем перестановки байтов в указанном char значении. |
static char[] |
toChars |
Преобразует указанный символ (код Юникода) в его представление UTF-16, хранящееся в массиве char. |
static int |
toChars |
Преобразует указанный символ (код Юникода) в его представление UTF-16. |
static int |
toCodePoint |
Преобразует указанную пару суррогатов в значение дополнительного кода. |
static char |
toLowerCase |
Преобразует символ-аргумент в строчные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
static int |
toLowerCase |
Преобразует символ (код Юникода) - аргумент в строчные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
String |
toString() |
Возвращает объект String, представляющий значение данного Character. |
static String |
toString |
Возвращает объект String, представляющий указанный char. |
static String |
toString |
Возвращает объект String, представляющий указанный символ (код Юникода). |
static char |
toTitleCase |
Преобразует символ-аргумент в заглавные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
static int |
toTitleCase |
Преобразует символ (код Юникода) - аргумент в заглавные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
static char |
toUpperCase |
Преобразует символ-аргумент в заглавные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
static int |
toUpperCase |
Преобразует символ (код Юникода) - аргумент в заглавные буквы с использованием информации о преобразовании регистра из файла UnicodeData. |
static Character |
valueOf |
Возвращает экземпляр Character, представляющий указанное char значение. |
Подробное описание полей
MIN_RADIX
public static final int MIN_RADIX
digit, метод forDigit, и метод toString класса Integer. - См. также:
MAX_RADIX
public static final int MAX_RADIX
digit, метод forDigit, и метод toString класса Integer. - См. также:
MIN_VALUE
public static final char MIN_VALUE
char, '\u0000'. - С:
- 1.0.2
- См. также:
MAX_VALUE
public static final char MAX_VALUE
char, '\uFFFF'. - С:
- 1.0.2
- См. также:
TYPE
public static final Class<Character> TYPE
Class, представляющий примитивный тип char. - С:
- 1.1
НЕПРИСВОЕННЫЙ
public static final byte UNASSIGNED
- С:
- 1.1
- См. также:
ПРОПИСНАЯ_БУКВА
public static final byte UPPERCASE_LETTER
- С:
- 1.1
- См. также:
МАЛЕНЬКАЯ_БУКВА
public static final byte LOWERCASE_LETTER
- С:
- 1.1
- См. также:
БУКВА_ЗАГЛАВНОЙ_ФОРМЫ
public static final byte TITLECASE_LETTER
- С:
- 1.1
- См. также:
МОДИФИКАТОРНАЯ_БУКВА
public static final byte MODIFIER_LETTER
- С:
- 1.1
- См. также:
ДРУГАЯ_БУКВА
public static final byte OTHER_LETTER
- С:
- 1.1
- См. также:
НЕРАЗРЫВНЫЙ_ДИАКРИТИЧЕСКИЙ_ЗНАК
public static final byte NON_SPACING_MARK
- С:
- 1.1
- См. также:
ОГРАНИЧИТЕЛЬНЫЙ_ЗНАК
public static final byte ENCLOSING_MARK
- С:
- 1.1
- См. также:
СОЧЕТАЕМЫЙ_РАЗРЫВНЫЙ_ДИАКРИТИЧЕСКИЙ_ЗНАК
public static final byte COMBINING_SPACING_MARK
- С:
- 1.1
- См. также:
ДЕСЯТИЧНАЯ_ЦИФРА
public static final byte DECIMAL_DIGIT_NUMBER
- С:
- 1.1
- См. также:
БУКВЕННЫЙ_ЧИСЛОВОЙ_СИМВОЛ
public static final byte LETTER_NUMBER
- С:
- 1.1
- См. также:
ДРУГОЕ_ЧИСЛО
public static final byte OTHER_NUMBER
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_МЕЖДУ_ПРОБЕЛАМИ
public static final byte SPACE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_СТРОК
public static final byte LINE_SEPARATOR
- С:
- 1.1
- См. также:
РАЗДЕЛИТЕЛЬ_АБЗАЦОВ
public static final byte PARAGRAPH_SEPARATOR
- С:
- 1.1
- См. также:
УПРАВЛЯЮЩИЙ
public static final byte CONTROL
- С:
- 1.1
- См. также:
ФОРМАТ
public static final byte FORMAT
- С:
- 1.1
- См. также:
ЛИЧНОЕ_ИСПОЛЬЗОВАНИЕ
public static final byte PRIVATE_USE
- С:
- 1.1
- См. также:
СУРРОГАТ
public static final byte SURROGATE
- С:
- 1.1
- См. также:
ПОДЧЁРКИВАНИЕ_Пунктуация
public static final byte DASH_PUNCTUATION
- С:
- 1.1
- См. также:
НАЧАЛЬНАЯ_Пунктуация
public static final byte START_PUNCTUATION
- С:
- 1.1
- См. также:
КОНЕЧНАЯ_Пунктуация
public static final byte END_PUNCTUATION
- С:
- 1.1
- См. также:
СОЕДИНИТЕЛЬНАЯ_Пунктуация
public static final byte CONNECTOR_PUNCTUATION
- С:
- 1.1
- См. также:
ПРОЧАЯ_Пунктуация
public static final byte OTHER_PUNCTUATION
- С:
- 1.1
- См. также:
МАТЕМАТИЧЕСКИЙ_Символ
public static final byte MATH_SYMBOL
- С:
- 1.1
- См. также:
ВАЛЮТНЫЙ_Символ
public static final byte CURRENCY_SYMBOL
- С:
- 1.1
- См. также:
МОДИФИКАТОРНЫЙ_Символ
public static final byte MODIFIER_SYMBOL
- С:
- 1.1
- См. также:
ПРОЧИЙ_Символ
public static final byte OTHER_SYMBOL
- С:
- 1.1
- См. также:
НАЧАЛЬНАЯ_КАВЫЧКА_Пунктуация
public static final byte INITIAL_QUOTE_PUNCTUATION
- С:
- 1.4
- См. также:
КОНЕЧНАЯ_КАВЫЧКА_Пунктуация
public static final byte FINAL_QUOTE_PUNCTUATION
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_НЕОПРЕДЕЛЁННАЯ
public static final byte DIRECTIONALITY_UNDEFINED
char значения имеют неопределённую направленность в спецификации Unicode.- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_СЛЕВА_НАПРАВО
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_СПРАВА_НАЛЕВО
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_СПРАВА_НАЛЕВО_АРАБСКИЙ
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_ЕВРОПЕЙСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_ЕВРОПЕЙСКИЙ_РАЗДЕЛИТЕЛЬ_ЧИСЕЛ
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_ЕВРОПЕЙСКИЙ_ЗАКЛЮЧИТЕЛЬНЫЙ_РАЗДЕЛИТЕЛЬ_ЧИСЕЛ
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_АРАБСКОЕ_ЧИСЛО
public static final byte DIRECTIONALITY_ARABIC_NUMBER
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_ОБЩИЙ_РАЗДЕЛИТЕЛЬ_ЧИСЕЛ
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_НЕРАЗРЫВНЫЙ_ДИАКРИТИЧЕСКИЙ_ЗНАК
public static final byte DIRECTIONALITY_NONSPACING_MARK
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_ГРАНИЦА_НЕЙТРАЛЬНАЯ
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_РАЗДЕЛИТЕЛЬ_АБЗАЦОВ
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
- С:
- 1.4
- См. также:
НАПРАВЛЕННОСТЬ_РАЗДЕЛИТЕЛЬ_СЕГМЕНТОВ
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
- С:
- 1.4
- См. также:
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
- С:
- 1.4
- См. также:
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
- С:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
- С:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
- С:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
- С:
- 1.4
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
- С:
- 1.4
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
- С:
- 1.4
- См. также:
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
- С:
- 9
- См. также:
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
- С:
- 9
- См. также:
DIRECTIONALITY_FIRST_STRONG_ISOLATE
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
- С:
- 9
- См. также:
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
- С:
- 9
- См. также:
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
'\uD800'. Старший суррогат также известен как ведущий суррогат.- С:
- 1.5
- См. также:
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
'\uDBFF'. Старший суррогат также известен как ведущий суррогат.- С:
- 1.5
- См. также:
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
'\uDC00'. Младший суррогат также известен как последующий суррогат.- С:
- 1.5
- См. также:
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
'\uDFFF'. Младший суррогат также известен как последующий суррогат.- С:
- 1.5
- См. также:
MIN_SURROGATE
public static final char MIN_SURROGATE
'\uD800'. - С:
- 1.5
- См. также:
MAX_SURROGATE
public static final char MAX_SURROGATE
'\uDFFF'. - С:
- 1.5
- См. также:
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
U+10000. - С:
- 1.5
- См. также:
MIN_CODE_POINT
public static final int MIN_CODE_POINT
U+0000. - С:
- 1.5
- См. также:
MAX_CODE_POINT
public static final int MAX_CODE_POINT
U+10FFFF. - С:
- 1.5
- См. также:
SIZE
public static final int SIZE
char в беззнаковой двоичной форме, константа 16.- С:
- 1.5
- См. также:
BYTES
public static final int BYTES
char в беззнаковом двоичном формате.- Since:
- 1.8
- See Also:
Подробное описание конструкторов
Character
@Deprecated(since="9", forRemoval=true) public Character(char value)
valueOf(char) обычно является лучшим выбором, так как, скорее всего, обеспечит значительно лучшую производительность по времени и памяти.Character, представляющий указанное значение char. - Parameters:
-
value- значение, которое должен представлять объектCharacter.
Подробное описание методов
describeConstable
public Optional<DynamicConstantDesc<Character>> describeConstable()
Optional, содержащий номинальное описание для этого экземпляра.- Specified by:
-
describeConstableв интерфейсеConstable - Returns:
- a
Optional, описывающий экземпляр Character - Since:
- 15
valueOf
public static Character valueOf(char c)
Character, представляющий указанное значение char . Если новый экземпляр Character не требуется, этот метод обычно следует предпочесть конструктору Character(char), так как, скорее всего, он обеспечит значительно лучшую производительность по времени и памяти за счёт кэширования часто запрашиваемых значений. Этот метод всегда будет кэшировать значения в диапазоне от
'\u0000' до '\u007F' включительно, и может кэшировать другие значения за пределами этого диапазона.- Parameters:
-
c- значение типа char. - Returns:
- экземпляр
Character, представляющийc. - Since:
- 1.5
charValue
public char charValue()
Character.- Returns:
- примитивное значение
char, представляемое этим объектом.
hashCode
public int hashCode()
Character; равный результату вызова charValue().- Overrides:
-
hashCodeв классеObject - Returns:
- значение хэш-кода для этого
Character - See Also:
hashCode
public static int hashCode(char value)
char ; совместимо с Character.hashCode().- Parameters:
-
value- Значениеchar, для которого требуется хэш-код. - Returns:
- значение хэш-кода для значения
char. - Since:
- 1.8
equals
public boolean equals(Object obj)
true тогда и только тогда, когда аргумент не является null и является объектом Character , представляющим то же самое значение char , что и этот объект.- Overrides:
-
equalsв классеObject - Parameters:
-
obj- сравниваемый объект. - Returns:
-
true, если объекты одинаковы;falseв противном случае. - See Also:
toString
public String toString()
String , представляющий значение этого объекта Character. Результат — строка длиной 1, единственный компонент которой — примитивное значение char , представленное этим объектом Character.- Overrides:
-
toStringв классеObject - Returns:
- строковое представление этого объекта.
toString
public static String toString(char c)
String , представляющий указанное значение char. Результатом является строка длиной 1, состоящая только из указанного значения char.- API Note:
- Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод
toString(int). - Parameters:
-
c- значениеcharдля преобразования - Returns:
- строковое представление указанного значения
char - Since:
- 1.4
toString
public static String toString(int codePoint)
String , представляющий указанный символ (код Юникода). Результатом является строка длиной 1 или 2, состоящая только из указанного codePoint.- Parameters:
-
codePoint- код Юникода для преобразования - Returns:
- строковое представление указанного
codePoint - Throws:
-
IllegalArgumentException- если указанноеcodePointне является валидным кодом Юникода. - Since:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
- Parameters:
-
codePoint- код Юникода для проверки - Returns:
-
true, если указанное значение кода символа находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - Since:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
char.- Parameters:
-
codePoint- символ (код Юникода) для проверки - Returns:
-
true, если указанный код символа находится в диапазоне отMIN_VALUEдоMAX_VALUEвключительно;falseв противном случае. - Since:
- 1.7
isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
- Parameters:
-
codePoint- символ (код Юникода) для проверки - Returns:
-
true, если указанный код символа находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - Since:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
char старшим суррогатным кодом Юникода (также известным как ведущий суррогатный код). Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировании UTF-16.
- Parameters:
-
ch- значениеcharдля проверки. - Returns:
-
true, если значениеcharнаходится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно;falseв противном случае. - Since:
- 1.5
- See Also:
isLowSurrogate
public static boolean isLowSurrogate(char ch)
char значение кодовым элементом низкой суррогатности Unicode (Unicode low-surrogate code unit) (также известным как код элемента кодовой единицы последующего суррогата). Такие значения не представляют символы сами по себе, но используются в представлении дополнительных символов в кодировании UTF-16.
- Parameters:
-
ch- проверяемоеcharзначение. - Returns:
-
true, еслиcharзначение находится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно;falseв противном случае. - Since:
- 1.5
- See Also:
isSurrogate
public static boolean isSurrogate(char ch)
char значение кодовой единицей суррогата Unicode. Такие значения не представляют символы сами по себе, но используются в представлении дополнительных символов в кодировании UTF-16.
Значение типа char является кодовой единицей суррогата тогда и только тогда, когда оно является либо кодовой единицей низкого суррогата, либо кодовой единицей высокого суррогата.
- Parameters:
-
ch- проверяемоеcharзначение. - Returns:
-
true, еслиcharзначение находится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно;falseв противном случае. - Since:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high, char low)
char значений допустимой парой суррогатов Unicode. Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Parameters:
-
high- значение кодовой единицы высокого суррогата, подлежащее проверке -
low- значение кодовой единицы низкого суррогата, подлежащее проверке - Returns:
-
true, если указанные значения кодовой единицы высокого и низкого суррогата представляют собой допустимую пару суррогатов;falseв противном случае. - Since:
- 1.5
charCount
public static int charCount(int codePoint)
char значений, необходимых для представления указанного символа (Unicode code point). Если указанный символ равен или больше 0x10000, то метод возвращает 2. В противном случае метод возвращает 1. Этот метод не проверяет указанный символ на соответствие допустимому Unicode code point. Вызывающий метод должен проверить значение символа с помощью isValidCodePoint, если это необходимо.
- Parameters:
-
codePoint- символ (Unicode code point), подлежащий проверке. - Returns:
- 2, если символ является допустимым дополнительным символом; 1 в противном случае.
- Since:
- 1.5
- See Also:
toCodePoint
public static int toCodePoint(char high, char low)
isSurrogatePair, если это необходимо.- Parameters:
-
high- кодовая единица высокого суррогата -
low- кодовая единица низкого суррогата - Returns:
- дополнительный символ, составленный из указанной пары суррогатов.
- Since:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq, int index)
CharSequence. Если значение char в заданном индексе в CharSequence находится в диапазоне высокого суррогата, следующий индекс меньше длины CharSequence, и значение char в следующем индексе находится в диапазоне низкого суррогата, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.- Parameters:
-
seq- последовательность значенийchar(Unicode code units) -
index- индекс значенийchar(Unicode code units) вseqдля преобразования - Returns:
- Unicode code point в заданном индексе
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньшеseq.length(). - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index)
char. Если значение char в заданном индексе в массиве char находится в диапазоне высокого суррогата, следующий индекс меньше длины массива char, и значение char в следующем индексе находится в диапазоне низкого суррогата, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.- Parameters:
-
a- массивchar -
index- индекс значенийchar(Unicode code units) в массивеcharдля преобразования - Returns:
- Unicode code point в заданном индексе
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньше длины массиваchar. - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a, int index, int limit)
char, где используются только элементы массива с индексом, меньшим чем limit. Если значение char в заданном индексе в массиве char находится в диапазоне высокого суррогата, следующий индекс меньше limit, и значение char в следующем индексе находится в диапазоне низкого суррогата, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.- Parameters:
-
a- массивchar -
index- индекс значенийchar(Unicode code units) в массивеcharдля преобразования -
limit- индекс после последнего элемента массива, который может быть использован в массивеchar - Returns:
- Unicode code point в заданном индексе
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexотрицательный или не меньше аргументаlimit, или если аргументlimitотрицательный или больше длины массиваchar. - Since:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq, int index)
CharSequence. Если значение char в (index - 1) в CharSequence находится в диапазоне низкого суррогата, (index - 2) не отрицательно, и значение char в (index - 2) в CharSequence находится в диапазоне высокого суррогата, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char в (index - 1). - Parameters:
-
seq- объектCharSequence -
index- индекс, следующий за кодом символа, который должен быть возвращен - Returns:
- значение Unicode code point, предшествующее заданному индексу.
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или большеseq.length(). - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index)
char. Если значение char в (index - 1) в массиве char находится в диапазоне низкого суррогата, (index - 2) не отрицательно, и значение char в (index - 2) в массиве char находится в диапазоне высокого суррогата, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение char в (index - 1). - Parameters:
-
a- массивchar -
index- индекс, следующий за кодом символа, который должен быть возвращен - Returns:
- значение Unicode code point, предшествующее заданному индексу.
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или больше длины массиваchar - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a, int index, int start)
char, где используются только элементы массива с индексом, не меньшим start. Если значение элемента char с индексом (index - 1) в массиве char находится в диапазоне низких суррогатных значений, (index - 2) не меньше start, а значение элемента char с индексом (index - 2) в массиве char находится в диапазоне высоких суррогатных значений, то возвращается дополнительный код символа, соответствующий этой паре суррогатов. В противном случае возвращается значение элемента char с индексом (index - 1).- Parameters:
-
a- массивchar -
index- индекс, следующий за кодом символа, который должен быть возвращён -
start- индекс первого элемента массиваchar - Returns:
- значение кода Unicode символа перед заданным индексом.
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexне больше аргументаstartили больше длины массиваchar, или если аргументstartотрицателен или не меньше длины массиваchar. - Since:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Parameters:
-
codePoint- дополнительный символ (код Unicode) - Returns:
- ведущая единица кода суррогата, используемая для представления символа в кодировке UTF-16
- Since:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
char. Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Parameters:
-
codePoint- дополнительный символ (код Unicode) - Returns:
- заключительная единица кода суррогата, используемая для представления символа в кодировке UTF-16
- Since:
- 1.7
toChars
public static int toChars(int codePoint, char[] dst, int dstIndex)
dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогатов хранятся в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.- Parameters:
-
codePoint- символ (код Unicode) для преобразования. -
dst- массив символов, в котором хранится значение UTF-16 символа. -
dstIndex- начальный индекс в массивеdst, где хранится преобразованное значение. - Returns:
- 1, если код символа — код символа BMP, 2, если код символа — дополнительный код символа.
- Throws:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Unicode. -
NullPointerException- если указанныйdstравен null. -
IndexOutOfBoundsException- еслиdstIndexотрицателен или не меньшеdst.length, или еслиdstпо индексуdstIndexне содержит достаточно элементов массива для хранения полученных значенийchar. (ЕслиdstIndexравноdst.length-1и указанныйcodePointявляется дополнительным символом, значение высокого суррогата не хранится вdst[dstIndex].) - Since:
- 1.5
toChars
public static char[] toChars(int codePoint)
char. Если указанный код символа является значением BMP (базовая многоязычная плоскость или плоскость 0), то полученный массив char имеет то же значение, что и codePoint. Если указанный код символа является дополнительным кодом символа, то полученный массив char содержит соответствующую пару суррогатов.- Parameters:
-
codePoint- код Unicode символа - Returns:
- массив символов, содержащий представление
codePointв UTF-16. - Throws:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Unicode. - Since:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq, int beginIndex, int endIndex)
beginIndex и простирается до char с индексом endIndex - 1. Таким образом, длина (в символах) диапазона текста равна endIndex-beginIndex. Неспаренные суррогаты в диапазоне текста считаются по одному символу каждый.- Parameters:
-
seq- последовательность символов -
beginIndex- индекс первого символа в диапазоне текста. -
endIndex- индекс после последнего символа в диапазоне текста. - Returns:
- количество символов Unicode в указанном диапазоне текста
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиbeginIndexотрицательно, илиendIndexбольше длины заданной последовательности, илиbeginIndexбольшеendIndex. - Since:
- 1.5
codePointCount
public static int codePointCount(char[] a, int offset, int count)
char аргумента. Аргумент offset — это индекс первого символа подмассива, а аргумент count задаёт длину подмассива в символах. Неспаренные суррогаты в подмассиве считаются по одному символу каждый.- Parameters:
-
a- массивchar -
offset- индекс первого символа в заданном массивеchar -
count- длина подмассива в символах - Returns:
- количество символов Unicode в заданном подмассиве
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиoffsetилиcountотрицательны, или еслиoffset + countбольше длины заданного массива. - Since:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq, int index, int codePointOffset)
index на codePointOffset символов. Неспаренные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются по одному символу каждый.- Parameters:
-
seq- последовательность символов -
index- индекс, который нужно сместить -
codePointOffset- смещение в символах - Returns:
- индекс в последовательности символов
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиindexотрицательно или больше длины последовательности символов, или еслиcodePointOffsetположительно и подпоследовательность, начинающаяся сindex, содержит меньше чемcodePointOffsetсимволов, или еслиcodePointOffsetотрицательно и подпоследовательность передindexсодержит меньше чем абсолютное значениеcodePointOffsetсимволов. - Since:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a, int start, int count, int index, int codePointOffset)
char подмассиве, смещённом относительно заданного index на codePointOffset количество символов. Аргументы start и count задают подмассив массива char. Неспаренные суррогаты в диапазоне текста, заданном index и codePointOffset, считаются по одному символу каждый.- Параметры:
-
a- массивchar -
start- индекс первогоcharподмассива -
count- длина подмассива вchar -
index- индекс, который нужно сместить -
codePointOffset- смещение в кодах символов - Возвращает:
- индекс внутри подмассива
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиstartилиcountотрицательные, или еслиstart + countбольше длины заданного массива, или еслиindexменьшеstartили большеstart + count, или еслиcodePointOffsetположительное, а диапазон текста, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньшеcodePointOffsetсимволов, или еслиcodePointOffsetотрицательное, а диапазон текста, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше абсолютного значенияcodePointOffsetсимволов. - С версии:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Символ является строчным, если его тип общей категории, предоставляемый Character.getType(ch), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.
Вот примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные символы, используйте метод isLowerCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является строчной буквой;falseв противном случае. - См. также:
isLowerCase
public static boolean isLowerCase(int codePoint)
Символ является строчным, если его тип общей категории, предоставляемый getType(codePoint), равен LOWERCASE_LETTER, или он имеет дополнительное свойство Other_Lowercase, как определено в стандарте Unicode.
Вот примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
-
trueесли символ является строчной буквой;falseв противном случае. - С версии:
- 1.5
- См. также:
isUpperCase
public static boolean isUpperCase(char ch)
Символ является заглавным, если его тип общей категории, предоставляемый Character.getType(ch), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Вот примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные символы, используйте метод isUpperCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является заглавной буквой;falseв противном случае. - С версии:
- 1.0
- См. также:
isUpperCase
public static boolean isUpperCase(int codePoint)
Символ является заглавным, если его тип общей категории, предоставляемый getType(codePoint), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Unicode.
Вот примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Unicode также являются заглавными.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
-
trueесли символ является заглавной буквой;falseв противном случае. - С версии:
- 1.5
- См. также:
isTitleCase
public static boolean isTitleCase(char ch)
Символ является символом строчной буквы с заглавной первой, если его тип общей категории, предоставляемый Character.getType(ch), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с заглавной первой буквой, как в заголовках книг.
Вот некоторые из символов Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются строчными буквами с заглавной первой.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные символы, используйте метод isTitleCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является строчной буквой с заглавной первой;falseв противном случае. - С версии:
- 1.0.2
- См. также:
isTitleCase
public static boolean isTitleCase(int codePoint)
Символ является символом строчной буквы с заглавной первой, если его тип общей категории, предоставляемый getType(codePoint), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, которая выглядит как "LJ", и соответствующая строчная буква, которая выглядит как "lj". Третья форма, которая выглядит как "Lj", является подходящей формой для отображения слова строчными буквами с заглавной первой буквой, как в заголовках книг.
Вот некоторые из символов Unicode, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Unicode также являются строчными буквами с заглавной первой.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
-
trueесли символ является строчной буквой с заглавной первой;falseв противном случае. - С версии:
- 1.5
- См. также:
isDigit
public static boolean isDigit(char ch)
Символ является цифрой, если его тип общей категории, предоставленный Character.getType(ch), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', полноширинные цифры
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDigit(int).
- Параметры:
-
ch- символ, подлежащий проверке. - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - См. также:
isDigit
public static boolean isDigit(int codePoint)
Символ является цифрой, если его тип общей категории, предоставленный getType(codePoint), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', полноширинные цифры
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isDefined
public static boolean isDefined(char ch)
Символ определен, если хотя бы одно из следующих утверждений истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDefined(int).
- Параметры:
-
ch- символ для проверки - Возвращает:
-
true, если символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.0.2
- См. также:
isDefined
public static boolean isDefined(int codePoint)
Символ определен, если хотя бы одно из следующих утверждений истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
true, если символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.5
- См. также:
isLetter
public static boolean isLetter(char ch)
Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), равен любому из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetter(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является буквой;falseв противном случае. - См. также:
isLetter
public static boolean isLetter(int codePoint)
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), равен любому из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
true, если символ является буквой;falseв противном случае. - С:
- 1.5
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Символ считается буквой или цифрой, если либо Character.isLetter(char ch) , либо Character.isDigit(char ch) возвращает true для символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - С:
- 1.0.2
- См. также:
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Символ считается буквой или цифрой, если либо isLetter(codePoint), либо isDigit(codePoint) возвращает true для символа.
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
true, если символ является буквой или цифрой;falseв противном случае. - С:
- 1.5
- См. также:
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительного знака препинания (например,'_')
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.0.2
- See Also:
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Символ может быть частью идентификатора Java только в том случае, если выполняется одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительного знака препинания (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа.
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.0.2
- See Also:
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Символ считается буквенным, если его тип общей категории, предоставляемый getType(codePoint), является любым из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Parameters:
-
codePoint- символ (код точки Unicode) для проверки. - Returns:
-
trueесли символ является символом Unicode алфавита,falseв противном случае. - Since:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
- Parameters:
-
codePoint- символ (код точки Unicode) для проверки. - Returns:
-
trueесли символ является символом Unicode идеографии,falseв противном случае. - Since:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительного знака препинания (например,'_').
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Символ может начинать идентификатор Java только в том случае, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - указанный символ является символом валюты (например,
'$') - указанный символ является символом соединительного знака препинания (например,
'_').
- Parameters:
-
codePoint- символ (код точки Unicode) для проверки. - Returns:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - Since:
- 1.5
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединительного знака препинания (например,
'_') - это цифра
- это цифровая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).
- Parameters:
-
ch- символ, подлежащий проверке. - Returns:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.1
- See Also:
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Символ может быть частью идентификатора Java, если выполняется хотя бы одно из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ пунктуации соединения (например,
'_') - это цифра
- это буквенный символ (например, символ римской цифры)
- это значок объединения
- это значок без пробела
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля кода символа
- Parameters:
-
codePoint- проверяемый символ (код Юникода). - Returns:
-
true, если символ может быть частью идентификатора Java;falseв противном случае. - Since:
- 1.5
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Символ может начинать идентификатор Юникода, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию стандарта Юникода UAX31-R1: Предпочтительные идентификаторы с профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавлен к Start для обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Parameters:
-
ch- тестируемый символ. - Returns:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - Since:
- 1.1
- External Specifications
- See Also:
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Символ может начинать идентификатор Юникода, если и только если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER. - это символ
Other_ID_Start.
Этот метод соответствует требованию стандарта Юникода UAX31-R1: Предпочтительные идентификаторы с профилем UAX31:
Start := ID_Start + 'VERTICAL TILDE' (U+2E2F)
'VERTICAL TILDE' добавлен к Start для обратной совместимости.- Parameters:
-
codePoint- проверяемый символ (код Юникода). - Returns:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - Since:
- 1.5
- External Specifications
- See Also:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Символ может быть частью идентификатора Юникода, если и только если выполняется одно из следующих утверждений:
- это буква
- это символ пунктуации соединения (например,
'_') - это цифра
- это буквенный символ (например, символ римской цифры)
- это значок объединения
- это значок без пробела
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию стандарта Юникода UAX31-R1: Предпочтительные идентификаторы с профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(char) returns true for the character
ignorable добавлен к Continue для обратной совместимости. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Parameters:
-
ch- тестируемый символ. - Returns:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - Since:
- 1.1
- External Specifications
- See Also:
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Символ может быть частью идентификатора Юникода, если и только если выполняется одно из следующих утверждений:
- это буква
- это символ пунктуации соединения (например,
'_') - это цифра
- это буквенный символ (например, символ римской цифры)
- это значок объединения
- это значок без пробела
-
isIdentifierIgnorableвозвращаетtrueдля этого символа. - это символ
Other_ID_Start. - это символ
Other_ID_Continue.
Этот метод соответствует требованию стандарта Юникода UAX31-R1: Предпочтительные идентификаторы с профилем UAX31:
Continue := Start + ID_Continue + ignorable Medial := empty ignorable := isIdentifierIgnorable(int) returns true for the character
ignorable добавлен к Continue для обратной совместимости.- Parameters:
-
codePoint- проверяемый символ (код Юникода). - Returns:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - Since:
- 1.5
- External Specifications
- See Also:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Следующие символы Unicode игнорируются в идентификаторе Java или Unicode:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch- тестируемый символ. - Возвращает:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode;falseв противном случае. - С:
- 1.1
- См. также:
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Следующие символы Unicode игнорируются в идентификаторе Java или Unicode:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode;falseв противном случае. - С:
- 1.5
- См. также:
isEmoji
public static boolean isEmoji(int codePoint)
Символ считается Эмодзи, если и только если он имеет свойство Emoji, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является Эмодзи;falseв противном случае. - С:
- 21
isEmojiPresentation
public static boolean isEmojiPresentation(int codePoint)
Символ считается имеющим свойство Emoji Presentation, если и только если он имеет свойство Emoji_Presentation, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ имеет свойство Emoji Presentation;falseв противном случае. - С:
- 21
isEmojiModifier
public static boolean isEmojiModifier(int codePoint)
Символ считается Модификатором Эмодзи, если и только если он имеет свойство Emoji_Modifier, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является Модификатором Эмодзи;falseв противном случае. - С:
- 21
isEmojiModifierBase
public static boolean isEmojiModifierBase(int codePoint)
Символ считается Базой Модификатора Эмодзи, если и только если он имеет свойство Emoji_Modifier_Base, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является Базой Модификатора Эмодзи;falseв противном случае. - С:
- 21
isEmojiComponent
public static boolean isEmojiComponent(int codePoint)
Символ считается Компонентом Эмодзи, если и только если он имеет свойство Emoji_Component, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является Компонентом Эмодзи;falseв противном случае. - С:
- 21
isExtendedPictographic
public static boolean isExtendedPictographic(int codePoint)
Символ считается Расширенным Пиктографическим, если и только если он имеет свойство Extended_Pictographic, определенное в Unicode Emoji (Технический стандарт #51).
- Параметры:
-
codePoint- тестируемый символ (код точки Unicode). - Возвращает:
-
trueесли символ является Расширенным Пиктографическим;falseв противном случае. - С:
- 21
toLowerCase
public static char toLowerCase(char ch)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для преобразования символов в нижний регистр. String методы преобразования регистра обладают рядом преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять языкоспецифические преобразования, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- эквивалент символа в нижнем регистре, если таковой имеется; в противном случае сам символ.
- См. также:
toLowerCase
public static int toLowerCase(int codePoint)
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для преобразования символов в нижний регистр. String методы преобразования регистра обладают рядом преимуществ перед Character методами преобразования регистра. String методы преобразования регистра могут выполнять языкоспецифические преобразования, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
- Параметры:
-
codePoint- символ (код точки Unicode) для преобразования. - Возвращает:
- эквивалент символа (код точки Unicode) в нижнем регистре, если таковой имеется; в противном случае сам символ.
- С:
- 1.5
- См. также:
toUpperCase
public static char toUpperCase(char ch)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов с верхним регистром. String методы сопоставления регистров имеют несколько преимуществ перед Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров этого не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).
- Parameters:
-
ch- символ, подлежащий преобразованию. - Returns:
- верхний эквивалент символа, если он есть; в противном случае, сам символ.
- See Also:
toUpperCase
public static int toUpperCase(int codePoint)
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов и идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов с верхним регистром. String методы сопоставления регистров имеют несколько преимуществ перед Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять чувствительные к регистру сопоставления, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров этого не могут.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. - Returns:
- верхний эквивалент символа, если он есть; в противном случае, сам символ.
- Since:
- 1.5
- See Also:
toTitleCase
public static char toTitleCase(char ch)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).
- Parameters:
-
ch- символ, подлежащий преобразованию. - Returns:
- эквивалент символа в заглавном регистре, если он есть; в противном случае, сам символ.
- Since:
- 1.0.2
- See Also:
toTitleCase
public static int toTitleCase(int codePoint)
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. - Returns:
- эквивалент символа в заглавном регистре, если он есть; в противном случае, сам символ.
- Since:
- 1.5
- See Also:
digit
public static int digit(char ch, int radix)
ch в указанном радиксе. Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимым числом в заданном радиксе, возвращается -1. Символ является допустимым числом, если хотя бы одно из следующих утверждений истинно:
- Метод
isDigitимеет значениеtrueдля символа, и десятичное числовое значение символа (или его разложения из одного символа) меньше указанного радикса. В этом случае возвращается десятичное значение. - Символ является одной из прописных латинских букв
'A'по'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв
'a'по'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из прописных латинских букв полной ширины A (
'\uFF21') по Z ('\uFF3A') и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из строчных латинских букв полной ширины a (
'\uFF41') по z ('\uFF5A') и его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод digit(int, int).
- Parameters:
-
ch- символ для преобразования. -
radix- радикс. - Returns:
- числовое значение, представленное символом в указанном радиксе.
- See Also:
digit
public static int digit(int codePoint, int radix)
Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимым числом в заданном радиксе, возвращается -1. Символ является допустимым числом, если хотя бы одно из следующих утверждений истинно:
- Метод
isDigit(codePoint)имеет значениеtrueдля символа, и десятичное числовое значение символа (или его разложения из одного символа) меньше указанного радикса. В этом случае возвращается десятичное значение. - Символ является одной из прописных латинских букв
'A'по'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв
'a'по'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из прописных латинских букв полной ширины A (
'\uFF21') по Z ('\uFF3A') и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из строчных латинских букв полной ширины a (
'\uFF41') по z ('\uFF5A') и его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Parameters:
-
codePoint- символ (код Юникода) для преобразования. -
radix- радикс. - Returns:
- числовое значение, представленное символом в указанном радиксе.
- Since:
- 1.5
- See Also:
getNumericValue
public static int getNumericValue(char ch)
'\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50. Буквы A-Z в верхнем регистре ('\u0041' по '\u005A'), нижнем регистре ('\u0061' по '\u007A') и полном варианте ('\uFF21' по '\uFF3A' и '\uFF41' по '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод getNumericValue(int).
- Parameters:
-
ch- символ, который требуется преобразовать. - Returns:
- числовое значение символа как неотрицательное
intзначение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если у символа нет числового значения. - Since:
- 1.1
- See Also:
getNumericValue
public static int getNumericValue(int codePoint)
'\u216C' (римская цифра пятьдесят) вернёт целое int со значением 50. Буквы A-Z в верхнем регистре ('\u0041' по '\u005A'), нижнем регистре ('\u0061' по '\u007A') и полном варианте ('\uFF21' по '\uFF3A' и '\uFF41' по '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовые значения этим char значениям.
Если у символа нет числового значения, возвращается -1. Если у символа есть числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
- Parameters:
-
codePoint- символ (код точки Юникода) для преобразования. - Returns:
- числовое значение символа как неотрицательное
intзначение; -2, если у символа есть числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если у символа нет числового значения. - Since:
- 1.5
- See Also:
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
true только для следующих пяти символов: | Символ | Код | Название |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является пробелом ISO-LATIN-1;falseв противном случае. - See Also:
isSpaceChar
public static boolean isSpaceChar(char ch)
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isSpaceChar(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является символом пробела;falseв противном случае. - Since:
- 1.1
- See Also:
isSpaceChar
public static boolean isSpaceChar(int codePoint)
- Parameters:
-
codePoint- символ (код точки Юникода) для проверки. - Returns:
-
trueесли символ является символом пробела;falseв противном случае. - Since:
- 1.5
- See Also:
isWhitespace
public static boolean isWhitespace(char ch)
- Он является символом пробела Юникода (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПОДДЕРЖИВАЮЩИЙ ПРОБЕЛ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛА. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУППЫ. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСИ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦЫ.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isWhitespace(int).
- Parameters:
-
ch- символ для проверки. - Returns:
-
trueесли символ является символом пробела Java;falseв противном случае. - Since:
- 1.1
- See Also:
isWhitespace
public static boolean isWhitespace(int codePoint)
- Он является символом пробела Юникода (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПОДДЕРЖИВАЮЩИЙ ПРОБЕЛ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛА. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУППЫ. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСИ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦЫ.
- Parameters:
-
codePoint- символ (код точки Юникода) для проверки. - Returns:
-
trueесли символ является символом пробела Java;falseв противном случае. - Since:
- 1.5
- See Also:
isISOControl
public static boolean isISOControl(char ch)
'\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).
- Параметры:
-
ch- символ, который необходимо проверить. - Возвращает:
-
trueесли символ является управляющим символом ISO;falseв противном случае. - С:
- 1.1
- См. также:
isISOControl
public static boolean isISOControl(int codePoint)
'\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.- Параметры:
-
codePoint- символ (код точки Unicode), который необходимо проверить. - Возвращает:
-
trueесли символ является управляющим символом ISO;falseв противном случае. - С:
- 1.5
- См. также:
getType
public static int getType(char ch)
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).
- Параметры:
-
ch- символ, который необходимо проверить. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.1
- См. также:
getType
public static int getType(int codePoint)
- Параметры:
-
codePoint- символ (код точки Unicode), который необходимо проверить. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.5
- См. также:
forDigit
public static char forDigit(int digit, int radix)
radix не является допустимым радиксом или значение digit не является допустимой цифрой в заданном радиксе, возвращается нулевой символ ('\u0000'). Аргумент radix является допустимым, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit является допустимым, если 0 <= digit < radix.
Если цифра меньше 10, то возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit- число, которое нужно преобразовать в символ. -
radix- радикс. - Возвращает:
- представление символа указанной цифры в указанном радиксе.
- См. также:
getDirectionality
public static byte getDirectionality(char ch)
char значений равно DIRECTIONALITY_UNDEFINED. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch-charдля которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - С:
- 1.4
- См. также:
getDirectionality
public static byte getDirectionality(int codePoint)
DIRECTIONALITY_UNDEFINED.- Параметры:
-
codePoint— символ (код точки Unicode), для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- С момента:
- 1.5
- См. также:
isMirrored
public static boolean isMirrored(char ch)
'\u0028' ЛЕВАЯ СКОБКА по смыслу определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево. Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные, используйте метод isMirrored(int).
- Параметры:
-
ch—char, для которого запрашивается свойство зеркальности. - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определён. - С момента:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
'\u0028' ЛЕВАЯ СКОБКА по смыслу определяется как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.- Параметры:
-
codePoint— символ (код точки Unicode), который нужно проверить. - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определён. - С момента:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter— объект Character для сравнения. - Возвращает:
- значение
0если переданный объект Character равен этому; значение меньше0, если этот объект Character численно меньше переданного; и значение больше0, если этот объект Character численно больше переданного (без учёта регистра). Обратите внимание, что это строго численное сравнение; оно не зависит от локали. - С момента:
- 1.2
compare
public static int compare(char x, char y)
Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x— первое значение типа char для сравнения -
y— второе значение типа char для сравнения - Возвращает:
- значение
0если значения равны; значение меньше0если первое значение меньше второго; и значение больше0если первое значение больше второго. - С момента:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
- Параметры:
-
ch— Значение типа char, для которого требуется изменить порядок байтов. - Возвращает:
- значение, полученное путём изменения порядка (или, равнозначно, перестановки) байтов в заданном значении типа char.
- С момента:
- 1.5
getName
public static String getName(int codePoint)
codePoint, или null, если код точки — unassigned. Если заданному символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), возвращаемое имя совпадает с результатом выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Для символов в файле UnicodeData имя, возвращаемое этим методом, следует схеме именования в разделе "Свойство имени Unicode" стандарта Unicode. Для других кодов точек, таких как хангуль/идеограммы, правило генерации имени отличается от определённого в стандарте Unicode.- Параметры:
-
codePoint— символ (код точки Unicode) - Возвращает:
- имя заданного символа, или null, если код точки не присвоен.
- Бросает:
-
IllegalArgumentException— если указанный код точки не является допустимой точкой кода Unicode. - С момента:
- 1.7
codePointOf
public static int codePointOf(String name)
Если символу не присвоено имя в файле UnicodeData (части базы данных символов Unicode, поддерживаемой консорциумом Unicode), его имя определяется как результат выражения:
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ')
+ " "
+ Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
Сопоставление имени регистронезависимое, с удалением всех начальных и конечных пробелов. Для кодов точек в файле UnicodeData этот метод распознаёт имя, соответствующее имени, определённому в разделе "Свойство имени Unicode" в стандарте Unicode. Для других кодов точек метод распознаёт имя, сгенерированное методом getName(int).
- Параметры:
-
name— имя символа - Возвращает:
- значение кодовой точки символа, указанного его именем.
- Бросает:
-
IllegalArgumentException— если указанное имя символа не является допустимым. -
NullPointerException— еслиname—null - С момента:
- 9
© 1993, 2023, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/21/docs/api/java.base/java/lang/Character.html