Класс Character
- java.lang.Object
-
- java.lang.Character
- Все реализованные интерфейсы:
-
Serializable,Comparable<Character>
public final class Character extends Object implements Serializable, Comparable<Character>
Класс Character оборачивает значение примитивного типа char в объект. Объект класса Character содержит единственное поле типа char.
Кроме того, этот класс предоставляет большое количество статических методов для определения категории символа (строчная буква, цифра и т. д.) и для преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие Unicode
Поля и методы класса Character определены на основе информации о символах из стандарта Unicode, в частности, файла UnicodeData, который входит в базу данных символов Unicode. Этот файл определяет свойства, включая имя и категорию для каждого назначенного кода символа Unicode или диапазона символов. Файл доступен в консорциуме Unicode по адресу http://www.unicode.org.
Платформа Java SE 11 использует информацию о символах из версии 10.0 стандарта Unicode с расширением. Платформа Java SE 11 позволяет реализации класса Character использовать японский код эпохи, U+32FF, из первой версии стандарта Unicode после 10.0, которая назначает код. Соответственно, поведение полей и методов класса Character может различаться в разных реализациях платформы Java SE 11 при обработке вышеупомянутого кода (вне версии 10.0), за исключением следующих методов, которые определяют идентификаторы Java: isJavaIdentifierStart(int), isJavaIdentifierStart(char), isJavaIdentifierPart(int) и isJavaIdentifierPart(char). Кодовые точки в идентификаторах Java должны быть взяты из версии 10.0 стандарта Unicode.
Представления символов Unicode
Тип данных char (и, следовательно, значение, которое encapsulates объект Character ) основаны на оригинальной спецификации Unicode, которая определяла символы как сущности фиксированной ширины 16 бит. Стандарт Unicode с тех пор был изменён, чтобы позволить символы, чьё представление требует более 16 бит. Диапазон допустимых кодовых точек теперь U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда называется Основной многоязычной плоскостью (BMP). Символы, кодовые точки которых больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первое из диапазона высоких суррогатов (\uD800-\uDBFF), второе из диапазона низких суррогатов (\uDC00-\uDFFF).
Значение char , следовательно, представляет кодовые точки Основной многоязычной плоскости (BMP), включая суррогатные кодовые точки, или кодовые единицы кодировки UTF-16. Значение int представляет все кодовые точки Unicode, включая дополнительные. Нижние (менее значимые) 21 бит int используются для представления кодовых точек Unicode, а верхние (более значимые) 11 бит должны быть нулевыми. Если не указано иное, поведение по отношению к дополнительным символам и суррогатным значениям char следующее:
- Методы, которые принимают только значение
char, не могут поддерживать дополнительные символы. Они обрабатывают значенияcharиз суррогатных диапазонов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, даже если это конкретное значение, за которым следует любое низкое суррогатное значение в строке, представляло бы букву. - Методы, которые принимают значение
int, поддерживают все символы Unicode, включая дополнительные. Например,Character.isLetter(0x2F81A)возвращаетtrue, потому что значение кодовой точки представляет букву (китайский иероглиф CJK).
В документации Java SE API кодовая точка Unicode используется для значений символов в диапазоне между U+0000 и U+10FFFF, а кодовая единица Unicode используется для 16-битных значений char , которые являются кодовыми единицами кодировки UTF-16. Для получения дополнительной информации о терминологии Unicode обратитесь к Словарю Unicode.
- С момента:
- 1.0
- См. также:
- Сериализованная форма
Вложенные классы
| Модификатор и тип | Класс | Описание |
|---|---|---|
static class | Character.Subset | Экземпляры этого класса представляют определённые подмножества набора символов Unicode. |
static class | Character.UnicodeBlock | Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode. |
static class | Character.UnicodeScript | Семейство подмножеств символов, представляющих наборы символов, определённые в Приложении к стандарту Unicode №24: Имена наборов символов. |
Поля
| Модификатор и тип | Поле | Описание |
|---|---|---|
static int | BYTES | Количество байтов, используемых для представления значения |
static byte | COMBINING_SPACING_MARK | Общая категория "Mc" в спецификации Unicode. |
static byte | CONNECTOR_PUNCTUATION | Общая категория "Pc" в спецификации Unicode. |
static byte | CONTROL | Общая категория "Cc" в спецификации Unicode. |
static byte | CURRENCY_SYMBOL | Общая категория "Sc" в спецификации Unicode. |
static byte | DASH_PUNCTUATION | Общая категория "Pd" в спецификации Unicode. |
static byte | DECIMAL_DIGIT_NUMBER | Общая категория "Nd" в спецификации Unicode. |
static byte | DIRECTIONALITY_ARABIC_NUMBER | Слабый тип двунаправленного символа "AN" в спецификации Unicode. |
static byte | DIRECTIONALITY_BOUNDARY_NEUTRAL | Слабый тип двунаправленного символа "BN" в спецификации Unicode. |
static byte | DIRECTIONALITY_COMMON_NUMBER_SEPARATOR | Слабый тип двунаправленного символа "CS" в спецификации Unicode. |
static byte | DIRECTIONALITY_EUROPEAN_NUMBER | Слабый тип двунаправленного символа "EN" в спецификации Unicode. |
static byte | DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR | Слабый тип двунаправленного символа "ES" в спецификации Unicode. |
static byte | DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR | Слабый тип двунаправленного символа "ET" в спецификации Unicode. |
static byte | DIRECTIONALITY_FIRST_STRONG_ISOLATE | Слабый тип двунаправленного символа "FSI" в спецификации Unicode. |
static byte | DIRECTIONALITY_LEFT_TO_RIGHT | Сильный тип двунаправленного символа "L" в спецификации Unicode. |
static byte | DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING | Сильный тип двунаправленного символа "LRE" в спецификации Unicode. |
static byte | DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE | Слабый тип двунаправленного символа "LRI" в спецификации Unicode. |
static byte | DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE | Сильный тип двунаправленного символа "LRO" в спецификации Unicode. |
static byte | DIRECTIONALITY_NONSPACING_MARK | Слабый тип двунаправленного символа "NSM" в спецификации Unicode. |
static byte | DIRECTIONALITY_OTHER_NEUTRALS | Нейтральный тип двунаправленного символа "ON" в спецификации Unicode. |
static byte | DIRECTIONALITY_PARAGRAPH_SEPARATOR | Нейтральный тип двунаправленного символа "B" в спецификации Unicode. |
static byte | DIRECTIONALITY_POP_DIRECTIONAL_FORMAT | Слабый тип двунаправленного символа "PDF" в спецификации Unicode. |
static byte | DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE | Слабый тип двунаправленного символа "PDI" в спецификации Unicode. |
static byte | DIRECTIONALITY_RIGHT_TO_LEFT | Сильный тип двунаправленного символа "R" в спецификации Unicode. |
static byte | DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC | Сильный тип двунаправленного символа "AL" в спецификации Unicode. |
static byte | DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING | Сильный тип двунаправленного символа "RLE" в спецификации Unicode. |
static byte | DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE | Слабый тип двунаправленного символа "RLI" в спецификации Unicode. |
static byte | DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE | Сильный тип двунаправленного символа "RLO" в спецификации Unicode. |
static byte | DIRECTIONALITY_SEGMENT_SEPARATOR | Нейтральный тип двунаправленного символа "S" в спецификации Unicode. |
static byte | DIRECTIONALITY_UNDEFINED | Неопределенный тип двунаправленного символа. |
static byte | DIRECTIONALITY_WHITESPACE | Нейтральный тип двунаправленного символа "WS" в спецификации Unicode. |
static byte | ENCLOSING_MARK | Общая категория "Me" в спецификации Unicode. |
static byte | END_PUNCTUATION | Общая категория "Pe" в спецификации Unicode. |
static byte | FINAL_QUOTE_PUNCTUATION | Общая категория "Pf" в спецификации Unicode. |
static byte | FORMAT | Общая категория "Cf" в спецификации Unicode. |
static byte | INITIAL_QUOTE_PUNCTUATION | Общая категория "Pi" в спецификации Unicode. |
static byte | LETTER_NUMBER | Общая категория "Nl" в спецификации Unicode. |
static byte | LINE_SEPARATOR | Общая категория "Zl" в спецификации Unicode. |
static byte | LOWERCASE_LETTER | Общая категория "Ll" в спецификации Unicode. |
static byte | MATH_SYMBOL | Общая категория "Sm" в спецификации Unicode. |
static int | MAX_CODE_POINT | Максимальное значение кода символа Unicode, константа |
static char | MAX_HIGH_SURROGATE | Максимальное значение высокого суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static char | MAX_LOW_SURROGATE | Максимальное значение низкого суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static int | MAX_RADIX | Максимальное основание, доступное для преобразования в строки и из строк. |
static char | MAX_SURROGATE | Максимальное значение суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static char | MAX_VALUE | Значение константы этого поля — наибольшее значение типа |
static int | MIN_CODE_POINT | Минимальное значение кода символа Unicode, константа |
static char | MIN_HIGH_SURROGATE | Минимальное значение высокого суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static char | MIN_LOW_SURROGATE | Минимальное значение низкого суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static int | MIN_RADIX | Минимальное основание, доступное для преобразования в строки и из строк. |
static int | MIN_SUPPLEMENTARY_CODE_POINT | Минимальное значение дополнительного кода символа Unicode, константа |
static char | MIN_SURROGATE | Минимальное значение суррогатного кодового блока Unicode в кодировке UTF-16, константа |
static char | MIN_VALUE | Значение константы этого поля — наименьшее значение типа |
static byte | MODIFIER_LETTER | Общая категория "Lm" в спецификации Unicode. |
static byte | MODIFIER_SYMBOL | Общая категория "Sk" в спецификации Unicode. |
static byte | NON_SPACING_MARK | Общая категория "Mn" в спецификации Unicode. |
static byte | OTHER_LETTER | Общая категория "Lo" в спецификации Unicode. |
static byte | OTHER_NUMBER | Общая категория "No" в спецификации Unicode. |
static byte | OTHER_PUNCTUATION | Общая категория "Po" в спецификации Unicode. |
static byte | OTHER_SYMBOL | Общая категория "So" в спецификации Unicode. |
static byte | PARAGRAPH_SEPARATOR | Общая категория "Zp" в спецификации Unicode. |
static byte | PRIVATE_USE | Общая категория "Co" в спецификации Unicode. |
static int | SIZE | Количество битов, используемых для представления значения |
|---|---|---|
static byte | SPACE_SEPARATOR | Общая категория "Zs" в спецификации Unicode. |
static byte | START_PUNCTUATION | Общая категория "Ps" в спецификации Unicode. |
static byte | SURROGATE | Общая категория "Cs" в спецификации Unicode. |
static byte | TITLECASE_LETTER | Общая категория "Lt" в спецификации Unicode. |
static Class<Character> | TYPE | Экземпляр |
static byte | UNASSIGNED | Общая категория "Cn" в спецификации Unicode. |
static byte | UPPERCASE_LETTER | Общая категория "Lu" в спецификации Unicode. |
Конструкторы
| Конструктор | Описание |
|---|---|
Character(char value) | Устарело. Использование этого конструктора редко оправдано. |
Методы
| Модификатор и тип | Метод | Описание |
|---|---|---|
static int | charCount(int codePoint) | Определяет количество значений |
char | charValue() | Возвращает значение этого объекта |
static int | codePointAt(char[] a,
int index) | Возвращает код точки в заданном индексе массива |
static int | codePointAt(char[] a,
int index,
int limit) | Возвращает код точки в заданном индексе массива |
static int | codePointAt(CharSequence seq,
int index) | Возвращает код точки в заданном индексе |
static int | codePointBefore(char[] a,
int index) | Возвращает код точки, предшествующий заданному индексу массива |
static int | codePointBefore(char[] a,
int index,
int start) | Возвращает код точки, предшествующий заданному индексу массива |
static int | codePointBefore(CharSequence seq,
int index) | Возвращает код точки, предшествующий заданному индексу |
static int | codePointCount(char[] a,
int offset,
int count) | Возвращает количество Unicode-кодов точек в подмассиве массива |
static int | codePointCount(CharSequence seq,
int beginIndex,
int endIndex) | Возвращает количество Unicode-кодов точек в диапазоне текста указанной последовательности символов. |
static int | codePointOf(String name) | Возвращает значение кода точки Unicode символа, указанного по его имени. |
static int | compare(char x,
char y) | Числовое сравнение двух значений |
int | compareTo(Character anotherCharacter) | Числовое сравнение двух объектов |
static int | digit(char ch,
int radix) | Возвращает числовое значение символа |
static int | digit(int codePoint,
int radix) | Возвращает числовое значение указанного символа (Unicode-код точки) в указанном основании. |
boolean | equals(Object obj) | Сравнивает этот объект с указанным объектом. |
static char | forDigit(int digit,
int radix) | Определяет представление символа для определенной цифры в указанном основании. |
static byte | getDirectionality(char ch) | Возвращает свойство направленности Unicode для данного символа. |
static byte | getDirectionality(int codePoint) | Возвращает свойство направленности Unicode для данного символа (Unicode-код точки). |
static String | getName(int codePoint) | Возвращает имя Unicode указанного символа |
static int | getNumericValue(char ch) | Возвращает значение |
static int | getNumericValue(int codePoint) | Возвращает значение |
static int | getType(char ch) | Возвращает значение, указывающее общую категорию символа. |
static int | getType(int codePoint) | Возвращает значение, указывающее общую категорию символа. |
int | hashCode() | Возвращает хэш-код этого объекта |
static int | hashCode(char value) | Возвращает хэш-код для значения |
static char | highSurrogate(int codePoint) | Возвращает ведущий суррогат ( высокопорядковый суррогат) пары суррогатов, представляющей указанный дополнительный символ (Unicode-код точки) в кодировке UTF-16. |
static boolean | isAlphabetic(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) буквой. |
static boolean | isBmpCodePoint(int codePoint) | Определяет, находится ли указанный символ (Unicode-код точки) в основной многоязычной плоскости (BMP). |
static boolean | isDefined(char ch) | Определяет, определен ли символ в Unicode. |
static boolean | isDefined(int codePoint) | Определяет, определен ли символ (Unicode-код точки) в Unicode. |
static boolean | isDigit(char ch) | Определяет, является ли указанный символ цифрой. |
static boolean | isDigit(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) цифрой. |
static boolean | isHighSurrogate(char ch) | Определяет, является ли данное значение |
static boolean | isIdentifierIgnorable(char ch) | Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или Unicode. |
static boolean | isIdentifierIgnorable(int codePoint) | Определяет, следует ли рассматривать указанный символ (Unicode-код точки) как игнорируемый символ в идентификаторе Java или Unicode. |
static boolean | isIdeographic(int codePoint) | Определяет, является ли указанный символ идеограммой CJKV (китайской, японской, корейской и вьетнамской), как определено в стандарте Unicode. |
static boolean | isISOControl(char ch) | Определяет, является ли указанный символ управляющим символом ISO. |
static boolean | isISOControl(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) управляющим символом ISO. |
static boolean | isJavaIdentifierPart(char ch) | Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа. |
static boolean | isJavaIdentifierPart(int codePoint) | Определяет, может ли символ (Unicode-код точки) быть частью идентификатора Java, кроме первого символа. |
static boolean | isJavaIdentifierStart(char ch) | Определяет, допускается ли указанный символ в качестве первого символа в идентификаторе Java. |
static boolean | isJavaIdentifierStart(int codePoint) | Определяет, допускается ли символ (Unicode-код точки) в качестве первого символа в идентификаторе Java. |
static boolean | isJavaLetter(char ch) | Устарело. Заменено на isJavaIdentifierStart(char). |
static boolean | isJavaLetterOrDigit(char ch) | Устарело. Заменено на isJavaIdentifierPart(char). |
static boolean | isLetter(char ch) | Определяет, является ли указанный символ буквой. |
static boolean | isLetter(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) буквой. |
static boolean | isLetterOrDigit(char ch) | Определяет, является ли указанный символ буквой или цифрой. |
static boolean | isLetterOrDigit(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) буквой или цифрой. |
static boolean | isLowerCase(char ch) | Определяет, является ли указанный символ строчной буквой. |
static boolean | isLowerCase(int codePoint) | Определяет, является ли указанный символ (Unicode-код точки) строчной буквой. |
static boolean | isLowSurrogate(char ch) | Определяет, является ли данное значение |
static boolean | isMirrored(char ch) | Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. |
|---|---|---|
static boolean | isMirrored(int codePoint) | Определяет, является ли указанный символ (код точки Юникода) зеркальным в соответствии со спецификацией Юникода. |
static boolean | isSpace(char ch) | Устаревшее. Заменено на isWhitespace(char). |
static boolean | isSpaceChar(char ch) | Определяет, является ли указанный символ символом пробела Юникода. |
static boolean | isSpaceChar(int codePoint) | Определяет, является ли указанный символ (код точки Юникода) символом пробела Юникода. |
static boolean | isSupplementaryCodePoint(int codePoint) | Определяет, находится ли указанный символ (код точки Юникода) в диапазоне дополнительных символов. |
static boolean | isSurrogate(char ch) | Определяет, является ли данное значение |
static boolean | isSurrogatePair(char high,
char low) | Определяет, является ли указанная пара значений |
static boolean | isTitleCase(char ch) | Определяет, является ли указанный символ заглавным символом. |
static boolean | isTitleCase(int codePoint) | Определяет, является ли указанный символ (код точки Юникода) заглавным символом. |
static boolean | isUnicodeIdentifierPart(char ch) | Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа. |
static boolean | isUnicodeIdentifierPart(int codePoint) | Определяет, может ли указанный символ (код точки Юникода) быть частью идентификатора Юникода, кроме первого символа. |
static boolean | isUnicodeIdentifierStart(char ch) | Определяет, разрешен ли указанный символ в качестве первого символа в идентификаторе Юникода. |
static boolean | isUnicodeIdentifierStart(int codePoint) | Определяет, разрешен ли указанный символ (код точки Юникода) в качестве первого символа в идентификаторе Юникода. |
static boolean | isUpperCase(char ch) | Определяет, является ли указанный символ заглавным. |
static boolean | isUpperCase(int codePoint) | Определяет, является ли указанный код точки допустимым значением кода точки Юникода. |
static boolean | isValidCodePoint(int codePoint) | Определяет, является ли указанный символ пробелом в соответствии с Java. |
static boolean | isWhitespace(char ch) | Определяет, является ли указанный символ (код точки Юникода) пробелом в соответствии с Java. |
static boolean | isWhitespace(int codePoint) | Возвращает заключительный суррогат (код единицы нижнего суррогата) низкого суррогата кодовой единицы пары суррогатов, представляющих указанный дополнительный символ (код точки Юникода) в кодировке UTF-16. |
static char | lowSurrogate(int codePoint) | Возвращает индекс в заданном |
static int | offsetByCodePoints(CharSequence seq,
int index,
int codePointOffset) | Возвращает индекс в заданной последовательности символов, смещенный от заданного |
static char | reverseBytes(char ch) | Возвращает значение, полученное путем изменения порядка байтов в указанном |
static char[] | toChars(int codePoint) | Преобразует указанный символ (код точки Юникода) в его представление UTF-16, хранящееся в массиве |
static int | toChars(int codePoint,
char[] dst,
int dstIndex) | Преобразует указанный символ (код точки Юникода) в его представление UTF-16. |
static int | toCodePoint(char high,
char low) | Преобразует указанную пару суррогатов в значение дополнительного кода точки. |
static char | toLowerCase(char ch) | Преобразует символ аргумента в строчные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
static int | toLowerCase(int codePoint) | Преобразует символ (код точки Юникода) аргумента в строчные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
String | toString() | Возвращает объект |
static String | toString(char c) | Возвращает объект |
static String | toString(int codePoint) | Возвращает объект |
static char | toTitleCase(char ch) | Преобразует символ аргумента в заглавные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
static int | toTitleCase(int codePoint) | Преобразует символ (код точки Юникода) аргумента в заглавные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
static char | toUpperCase(char ch) | Преобразует символ аргумента в прописные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
static int | toUpperCase(int codePoint) | Преобразует символ (код точки Юникода) аргумента в прописные буквы, используя информацию о преобразовании регистров из файла UnicodeData. |
static Character | valueOf(char c) | Возвращает экземпляр |
clone, finalize, getClass, notify, notifyAll, wait, wait, wait |
Методы, объявленные в классе java.lang.Object
clone, finalize, getClass, notify, notifyAll, wait, wait, wait Поля
MIN_RADIX
public static final int MIN_RADIX
Минимальное основание, доступное для преобразования в строки и из строк. Постоянное значение этого поля — это наименьшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit, и метод toString класса Integer.
- См. также:
-
digit(char, int),forDigit(int, int),Integer.toString(int, int),Integer.valueOf(String), Значения константных полей
MAX_RADIX
public static final int MAX_RADIX
Максимальное основание, доступное для преобразования в строки и из строк. Постоянное значение этого поля — это наибольшее значение, разрешённое для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit, и метод toString класса Integer.
- См. также:
-
digit(char, int),forDigit(int, int),Integer.toString(int, int),Integer.valueOf(String), Значения константных полей
MIN_VALUE
public static final char MIN_VALUE
Постоянное значение этого поля — наименьшее значение типа char, '\u0000'.
- С:
- 1.0.2
- См. также:
- Значения константных полей
MAX_VALUE
public static final char MAX_VALUE
Постоянное значение этого поля — наибольшее значение типа char, '\uFFFF'.
- С:
- 1.0.2
- См. также:
- Значения константных полей
TYPE
public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
- С:
- 1.1
UNASSIGNED
public static final byte UNASSIGNED
Общая категория "Cn" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
UPPERCASE_LETTER
public static final byte UPPERCASE_LETTER
Общая категория "Lu" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LOWERCASE_LETTER
public static final byte LOWERCASE_LETTER
Общая категория "Ll" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
TITLECASE_LETTER
public static final byte TITLECASE_LETTER
Общая категория "Lt" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MODIFIER_LETTER
public static final byte MODIFIER_LETTER
Общая категория "Lm" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_LETTER
public static final byte OTHER_LETTER
Общая категория "Lo" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
NON_SPACING_MARK
public static final byte NON_SPACING_MARK
Общая категория "Mn" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
ENCLOSING_MARK
public static final byte ENCLOSING_MARK
Общая категория "Me" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
COMBINING_SPACING_MARK
public static final byte COMBINING_SPACING_MARK
Общая категория "Mc" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
DECIMAL_DIGIT_NUMBER
public static final byte DECIMAL_DIGIT_NUMBER
Общая категория "Nd" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LETTER_NUMBER
public static final byte LETTER_NUMBER
Общая категория "Nl" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_NUMBER
public static final byte OTHER_NUMBER
Общая категория "No" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
SPACE_SEPARATOR
public static final byte SPACE_SEPARATOR
Общая категория "Zs" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LINE_SEPARATOR
public static final byte LINE_SEPARATOR
Общая категория "Zl" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
PARAGRAPH_SEPARATOR
public static final byte PARAGRAPH_SEPARATOR
Общая категория "Zp" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CONTROL
public static final byte CONTROL
Общая категория "Cc" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
FORMAT
public static final byte FORMAT
Общая категория "Cf" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
PRIVATE_USE
public static final byte PRIVATE_USE
Общая категория "Co" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
SURROGATE
public static final byte SURROGATE
Общая категория "Cs" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
DASH_PUNCTUATION
public static final byte DASH_PUNCTUATION
Общая категория "Pd" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
START_PUNCTUATION
public static final byte START_PUNCTUATION
Общая категория "Ps" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
END_PUNCTUATION
public static final byte END_PUNCTUATION
Общая категория "Pe" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CONNECTOR_PUNCTUATION
public static final byte CONNECTOR_PUNCTUATION
Общая категория "Pc" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_PUNCTUATION
public static final byte OTHER_PUNCTUATION
Общая категория "Po" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MATH_SYMBOL
public static final byte MATH_SYMBOL
Общая категория "Sm" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CURRENCY_SYMBOL
public static final byte CURRENCY_SYMBOL
Общая категория "Sc" в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MODIFIER_SYMBOL
public static final byte MODIFIER_SYMBOL
Общая категория "Sk" в спецификации Unicode.
- С момента:
- 1.1
- См. также:
- Значения постоянных полей
OTHER_SYMBOL
public static final byte OTHER_SYMBOL
Общая категория "So" в спецификации Unicode.
- С момента:
- 1.1
- См. также:
- Значения постоянных полей
INITIAL_QUOTE_PUNCTUATION
public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
FINAL_QUOTE_PUNCTUATION
public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_UNDEFINED
public static final byte DIRECTIONALITY_UNDEFINED
Неопределенный тип бинарального направления символа. Неопределённые char значения имеют неопределённое направление в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип бинарального направления символа "L" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип бинарального направления символа "R" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип бинарального направления символа "AL" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип бинарального направления символа "EN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип бинарального направления символа "ES" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип бинарального направления символа "ET" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_ARABIC_NUMBER
public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип бинарального направления символа "AN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип бинарального направления символа "CS" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_NONSPACING_MARK
public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип бинарального направления символа "NSM" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_BOUNDARY_NEUTRAL
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип бинарального направления символа "BN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_PARAGRAPH_SEPARATOR
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип бинарального направления символа "B" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_SEGMENT_SEPARATOR
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип бинарального направления символа "S" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип бинарального направления символа "WS" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип бинарального направления символа "ON" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип бинарального направления символа "LRE" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип бинарального направления символа "LRO" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип бинарального направления символа "RLE" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип бинарального направления символа "RLO" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип бинарального направления символа "PDF" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE
Слабый тип бинарального направления символа "LRI" в спецификации Unicode.
- С момента:
- 9
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE
Слабый тип бинарального направления символа "RLI" в спецификации Unicode.
- С момента:
- 9
- См. также:
- Значения постоянных полей
DIRECTIONALITY_FIRST_STRONG_ISOLATE
public static final byte DIRECTIONALITY_FIRST_STRONG_ISOLATE
Слабый тип бинарального направления символа "FSI" в спецификации Unicode.
- С момента:
- 9
- См. также:
- Значения постоянных полей
DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
Слабый тип бинарального направления символа "PDI" в спецификации Unicode.
- С момента:
- 9
- См. также:
- Значения постоянных полей
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
Минимальное значение кодового блока высокоуровневого суррогата Unicode в кодировке UTF-16, постоянная '\uD800'. Высокоуровневый суррогат также известен как ведущий суррогат.
- Since:
- 1.5
- See Also:
- Значения константных полей
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
Максимальное значение кодовой единицы старшего суррогата Юникода в кодировке UTF-16, константа '\uDBFF'. Старший суррогат также известен как ведущий суррогат.
- Since:
- 1.5
- See Also:
- Значения константных полей
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
Минимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDC00'. Младший суррогат также известен как замыкающий суррогат.
- Since:
- 1.5
- See Also:
- Значения константных полей
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
Максимальное значение кодовой единицы младшего суррогата Юникода в кодировке UTF-16, константа '\uDFFF'. Младший суррогат также известен как замыкающий суррогат.
- Since:
- 1.5
- See Also:
- Значения константных полей
MIN_SURROGATE
public static final char MIN_SURROGATE
Минимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uD800'.
- Since:
- 1.5
- See Also:
- Значения константных полей
MAX_SURROGATE
public static final char MAX_SURROGATE
Максимальное значение кодовой единицы суррогата Юникода в кодировке UTF-16, константа '\uDFFF'.
- Since:
- 1.5
- See Also:
- Значения константных полей
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительного кодового значения Юникода, константа U+10000.
- Since:
- 1.5
- See Also:
- Значения константных полей
MIN_CODE_POINT
public static final int MIN_CODE_POINT
Минимальное значение кодового значения Юникода, константа U+0000.
- Since:
- 1.5
- See Also:
- Значения константных полей
MAX_CODE_POINT
public static final int MAX_CODE_POINT
Максимальное значение кодового значения Юникода, константа U+10FFFF.
- Since:
- 1.5
- See Also:
- Значения константных полей
SIZE
public static final int SIZE
Количество бит, используемых для представления значения char в беззнаковой двоичной форме, константа 16.
- Since:
- 1.5
- See Also:
- Значения константных полей
BYTES
public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковой двоичной форме.
- Since:
- 1.8
- See Also:
- Значения константных полей
Конструкторы
Character
@Deprecated(since="9") public Character(char value)
valueOf(char) обычно является лучшим выбором, так как он, скорее всего, обеспечит значительно лучшую производительность по памяти и времени.Создаёт новый объект Character, представляющий указанное значение char.
- Parameters:
-
value- значение, которое должен представлять объектCharacter.
Методы
valueOf
public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char. Если новый экземпляр Character не требуется, этот метод обычно следует использовать вместо конструктора Character(char), так как этот метод, скорее всего, обеспечит значительно лучшую производительность по памяти и времени за счёт кеширования часто запрашиваемых значений. Этот метод всегда будет кешировать значения в диапазоне от
'\u0000' до '\u007F', включительно, и может кешировать другие значения за пределами этого диапазона.
- Параметры:
-
c- значение типа char. - Возвращает:
- экземпляр
Character, представляющийc. - С:
- 1.5
charValue
public char charValue()
Возвращает значение этого объекта Character.
- Возвращает:
- примитивное значение
char, представленное этим объектом.
hashCode
public int hashCode()
Возвращает хеш-код для этого Character; равный результату вызова charValue().
- Переопределяет:
-
hashCodeв классеObject - Возвращает:
- значение хеш-кода для этого
Character - См. также:
-
Object.equals(java.lang.Object),System.identityHashCode(java.lang.Object)
hashCode
public static int hashCode(char value)
Возвращает хеш-код для значения char ; совместимый с Character.hashCode().
- Параметры:
-
value- значениеchar, для которого требуется хеш-код. - Возвращает:
- значение хеш-кода для значения
char. - С:
- 1.8
equals
public boolean equals(Object obj)
Сравнивает этот объект с указанным объектом. Результат равен true тогда и только тогда, когда аргумент не null и является объектом Character, представляющим то же значение char , что и этот объект.
- Переопределяет:
-
equalsв классеObject - Параметры:
-
obj- объект для сравнения. - Возвращает:
-
true, если объекты одинаковые;falseв противном случае. - См. также:
-
Object.hashCode(),HashMap
toString
public String toString()
Возвращает объект String , представляющий значение этого объекта Character. Результат — строка длиной 1, содержащая единственное примитивное значение char , представленное этим объектом Character.
toString
public static String toString(char c)
Возвращает объект String , представляющий указанный символ char. Результат — строка длиной 1, состоящая только из указанного символа char.
- Примечание API:
- Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод
toString(int). - Параметры:
-
c- символcharдля преобразования - Возвращает:
- строковое представление указанного символа
char - С:
- 1.4
toString
public static String toString(int codePoint)
Возвращает объект String , представляющий указанный символ (код Юникода). Результат — строка длиной 1 или 2, состоящая только из указанного символа codePoint.
- Параметры:
-
codePoint- символcodePointдля преобразования - Возвращает:
- строковое представление указанного символа
codePoint - Исключения:
-
IllegalArgumentException- если указанный символcodePointне является валидным кодом Юникода. - С:
- 11
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный код символом Юникода.
- Параметры:
-
codePoint- код символа Юникода для проверки - Возвращает:
-
trueесли указанное значение кода символа находится в диапазоне отMIN_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - С:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Юникода) в основной многоязычной плоскости (BMP). Такие коды могут быть представлены с использованием одного char.
- Параметры:
-
codePoint- символ (код Юникода) для проверки - Возвращает:
-
true, если указанный код находится в диапазоне отMIN_VALUEдоMAX_VALUEвключительно;falseв противном случае. - С:
- 1.7
isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (код Юникода) в диапазоне дополнительных символов.
- Параметры:
-
codePoint- символ (код Юникода) для проверки - Возвращает:
-
true, если указанный код находится в диапазоне отMIN_SUPPLEMENTARY_CODE_POINTдоMAX_CODE_POINTвключительно;falseв противном случае. - С:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
Определяет, является ли заданное значение char ведущим замещающим символом (представленный как ведущий замещающий символ).
Такие значения не представляют собой символы сами по себе, но используются в представлении дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_HIGH_SURROGATEдоMAX_HIGH_SURROGATEвключительно;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowSurrogate(char),Character.UnicodeBlock.of(int)
isLowSurrogate
public static boolean isLowSurrogate(char ch)
Определяет, является ли заданное значение char заключительным замещающим символом (представленный как заключительный замещающий символ).
Такие значения не представляют собой символы сами по себе, но используются в представлении дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_LOW_SURROGATEдоMAX_LOW_SURROGATEвключительно;falseв противном случае. - С:
- 1.5
- См. также:
isHighSurrogate(char)
isSurrogate
public static boolean isSurrogate(char ch)
Определяет, является ли заданное значение char замещающим символом Юникода.
Такие значения не представляют собой символы сами по себе, но используются в представлении дополнительных символов в кодировке UTF-16.
Значение char является замещающим символом тогда и только тогда, когда оно является либо заключительным замещающим символом, либо ведущим замещающим символом.
- Параметры:
-
ch- значениеcharдля проверки. - Возвращает:
-
true, если значениеcharнаходится в диапазоне отMIN_SURROGATEдоMAX_SURROGATEвключительно;falseв противном случае. - С:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high,
char low) Определяет, является ли заданная пара значений char валидной парой замещающих символов Юникода.
Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Параметры:
-
high- значение ведущего замещающего символа для проверки -
low- значение заключительного замещающего символа для проверки - Возвращает:
-
trueесли указанные ведущие и заключительные замещающие значения составляют валидную пару;falseв противном случае. - С:
- 1.5
charCount
public static int charCount(int codePoint)
Определяет количество значений char , необходимых для представления указанного символа (код Юникода). Если указанный символ равен или больше 0x10000, метод возвращает 2. В противном случае метод возвращает 1.
Этот метод не проверяет, является ли указанный символ валидным кодом Юникода. Вызывающий метод должен проверить значение символа с использованием isValidCodePoint, если это необходимо.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
- 2, если символ — дополнительный символ; 1 в противном случае.
- С:
- 1.5
- См. также:
isSupplementaryCodePoint(int)
toCodePoint
public static int toCodePoint(char high,
char low) Преобразует указанную пару суррогатов в значение дополнительного кодового пункта. Данный метод не проверяет указанную пару суррогатов. Вызывающий метод должен проверить её с помощью isSurrogatePair, если это необходимо.
- Parameters:
-
high- код старшего суррогата -
low- код младшего суррогата - Returns:
- дополнительный кодовый пункт, составленный из указанной пары суррогатов.
- Since:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq,
int index) Возвращает кодовый пункт в заданном индексе CharSequence. Если значение char в заданном индексе в CharSequence находится в диапазоне старших суррогатов, последующий индекс меньше длины CharSequence, и значение char в последующем индексе находится в диапазоне младших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.
- Parameters:
-
seq- последовательность значенийchar(единицы кода Юникода) -
index- индекс значенийchar(единиц кода Юникода) вseqдля преобразования - Returns:
- кодовый пункт Юникода в заданном индексе
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если значениеindexотрицательное или не меньшеseq.length(). - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a,
int index) Возвращает кодовый пункт в заданном индексе массива char. Если значение char в заданном индексе в массиве char находится в диапазоне старших суррогатов, последующий индекс меньше длины массива char, и значение char в последующем индексе находится в диапазоне младших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.
- Parameters:
-
a- массивchar -
index- индекс значенийchar(единиц кода Юникода) в массивеcharдля преобразования - Returns:
- кодовый пункт Юникода в заданном индексе
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если значениеindexотрицательное или не меньше длины массиваchar. - Since:
- 1.5
codePointAt
public static int codePointAt(char[] a,
int index,
int limit) Возвращает кодовый пункт в заданном индексе массива char, где используются только элементы массива с индексами, меньшими чем limit. Если значение char в заданном индексе в массиве char находится в диапазоне старших суррогатов, последующий индекс меньше limit, и значение char в последующем индексе находится в диапазоне младших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в заданном индексе.
- Parameters:
-
a- массивchar -
index- индекс значенийchar(единиц кода Юникода) в массивеcharдля преобразования -
limit- индекс после последнего элемента массива, который можно использовать в массивеchar - Returns:
- кодовый пункт Юникода в заданном индексе
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexотрицательный или не меньше аргументаlimit, или если аргументlimitотрицательный или больше длины массиваchar. - Since:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq,
int index) Возвращает кодовый пункт, предшествующий заданному индексу CharSequence. Если значение char в (index - 1) в CharSequence находится в диапазоне младших суррогатов, (index - 2) не отрицательно, и значение char в (index - 2) в CharSequence находится в диапазоне старших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Parameters:
-
seq- экземплярCharSequence -
index- индекс, следующий за кодовым пунктом, который должен быть возвращён - Returns:
- значение кодового пункта Юникода, предшествующего заданному индексу.
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или большеseq.length(). - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a,
int index) Возвращает кодовый пункт, предшествующий заданному индексу массива char. Если значение char в (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не отрицательно, и значение char в (index - 2) в массиве char находится в диапазоне старших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Parameters:
-
a- массивchar -
index- индекс, следующий за кодовым пунктом, который должен быть возвращён - Returns:
- значение кодового пункта Юникода, предшествующего заданному индексу.
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или больше длины массиваchar - Since:
- 1.5
codePointBefore
public static int codePointBefore(char[] a,
int index,
int start) Возвращает кодовый пункт, предшествующий заданному индексу массива char, где используются только элементы массива с индексами, большими или равными start. Если значение char в (index - 1) в массиве char находится в диапазоне младших суррогатов, (index - 2) не меньше start, и значение char в (index - 2) в массиве char находится в диапазоне старших суррогатов, то возвращается дополнительный кодовый пункт, соответствующий этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Parameters:
-
a- массивchar -
index- индекс, следующий за кодовым пунктом, который должен быть возвращён -
start- индекс первого элемента массиваchar - Returns:
- значение кодового пункта Юникода, предшествующего заданному индексу.
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexне больше аргументаstart, или больше длины массиваchar, или если аргументstartотрицательный или не меньше длины массиваchar. - Since:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (код старшего суррогата) пары суррогатов, представляющей указанный дополнительный символ (кодовый пункт Юникода) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение.
Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Parameters:
-
codePoint- дополнительный символ (кодовый пункт Юникода) - Returns:
- ведущая единица кода суррогата, используемая для представления символа в кодировке UTF-16
- Since:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
Возвращает заключительный суррогат (код младшего суррогата) пары суррогатов, представляющей указанный дополнительный символ (кодовый пункт Юникода) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённое значение.
Если isSupplementaryCodePoint(x) равно true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Parameters:
-
codePoint- дополнительный символ (кодовый пункт Юникода) - Returns:
- заключительную единицу кода суррогата, используемую для представления символа в кодировке UTF-16
- Since:
- 1.7
toChars
public static int toChars(int codePoint,
char[] dst,
int dstIndex) Преобразует указанный символ (кодовое значение Юникода) в его представление UTF-16. Если указанное кодовое значение — это значение BMP (базовая многоязычная плоскость или плоскость 0), то это же значение сохраняется в dst[dstIndex], и возвращается 1. Если указанное кодовое значение — это дополнительный символ, его значения суррогатов сохраняются в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.
- Параметры:
-
codePoint- символ (кодовое значение Юникода) для преобразования. -
dst- массивchar, в котором хранится значение UTF-16codePoint. -
dstIndex- начальный индекс в массивеdst, где хранится преобразованное значение. - Возвращаемое значение:
- 1, если кодовое значение — кодовое значение BMP, 2, если кодовое значение — дополнительное кодовое значение.
- Исключения:
-
IllegalArgumentException- если указанноеcodePointне является допустимым кодовым значением Юникода. -
NullPointerException- если указанныйdstравен null. -
IndexOutOfBoundsException- еслиdstIndexотрицательно или не меньшеdst.length, или еслиdstпо индексуdstIndexне имеет достаточного количества элементов массива для хранения результирующего значенияchar. (ЕслиdstIndexравноdst.length-1, и указанныйcodePoint— это дополнительный символ, значение высокого суррогата не сохраняется вdst[dstIndex].) - С версии:
- 1.5
toChars
public static char[] toChars(int codePoint)
Преобразует указанный символ (кодовое значение Юникода) в его представление UTF-16, хранящееся в массиве char. Если указанное кодовое значение — значение BMP (базовая многоязычная плоскость или плоскость 0), то результирующий массив char имеет то же значение, что и codePoint. Если указанное кодовое значение — дополнительное кодовое значение, результирующий массив char имеет соответствующую пару суррогатов.
- Параметры:
-
codePoint- кодовое значение Юникода. - Возвращаемое значение:
- массив
char, содержащий UTF-16 представлениеcodePoint. - Исключения:
-
IllegalArgumentException- если указанноеcodePointне является допустимым кодовым значением Юникода. - С версии:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq,
int beginIndex,
int endIndex) Возвращает количество символов Юникода в текстовом диапазоне указанной последовательности символов. Диапазон текста начинается со значения beginIndex и заканчивается символом char с индексом endIndex - 1. Таким образом, длина (в символах) текстового диапазона равна endIndex-beginIndex. Непарные суррогаты в текстовом диапазоне считаются по одному символу каждый.
- Параметры:
-
seq- последовательность символов. -
beginIndex- индекс первогоcharтекстового диапазона. -
endIndex- индекс после последнегоcharтекстового диапазона. - Возвращаемое значение:
- количество символов Юникода в указанном текстовом диапазоне
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиbeginIndexотрицательно, илиendIndexбольше длины заданной последовательности, илиbeginIndexбольшеendIndex. - С версии:
- 1.5
codePointCount
public static int codePointCount(char[] a,
int offset,
int count) Возвращает количество символов Юникода в подмассиве массива char аргументов. Аргумент char — это индекс первого char подмассива, а аргумент count указывает длину подмассива в символах. Непарные суррогаты в подмассиве учитываются по одному символу каждый.
- Параметры:
-
a- массивchar. -
offset- индекс первогоcharв заданном массивеchar. -
count- длина подмассива в символах. - Возвращаемое значение:
- количество символов Юникода в указанном подмассиве
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиoffsetилиcountотрицательны, или еслиoffset + countбольше длины заданного массива. - С версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq,
int index,
int codePointOffset) Возвращает индекс в заданной последовательности символов, который смещен от заданного index на codePointOffset символов Юникода. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, учитываются по одному символу каждый.
- Параметры:
-
seq- последовательность символов. -
index- смещаемый индекс. -
codePointOffset- смещение в символах Юникода. - Возвращаемое значение:
- индекс в последовательности символов
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиindexотрицательно или больше длины последовательности символов, или еслиcodePointOffsetположительно, и подпоследовательность, начинающаяся сindex, содержит меньшеcodePointOffsetсимволов Юникода, или еслиcodePointOffsetотрицательно, и подпоследовательность передindexсодержит меньше модуляcodePointOffsetсимволов Юникода. - С версии:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a,
int start,
int count,
int index,
int codePointOffset) Возвращает индекс в заданном подмассиве char, который смещен от заданного index на codePointOffset символов Юникода. Аргументы start и count задают подмассив массива char. Непарные суррогаты в текстовом диапазоне, заданном index и codePointOffset, учитываются по одному символу каждый.
- Параметры:
-
a- массивchar. -
start- индекс первогоcharподмассива. -
count- длина подмассива в символах. -
index- смещаемый индекс. -
codePointOffset- смещение в символах Юникода. - Возвращаемое значение:
- индекс в подмассиве
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиstartилиcountотрицательны, или еслиstart + countбольше длины заданного массива, или еслиindexменьшеstartили большеstart + count, или еслиcodePointOffsetположительно, и текстовый диапазон, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньшеcodePointOffsetсимволов Юникода, или еслиcodePointOffsetотрицательно, и текстовый диапазон, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше модуляcodePointOffsetсимволов Юникода. - С версии:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчной буквой.
Символ является строчной буквой, если его тип общей категории, предоставленный Character.getType(ch), равен LOWERCASE_LETTER, или он обладает вспомогательным свойством Other_Lowercase, как определено в стандарте Юникод.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Юникода также являются строчными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isLowerCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращаемое значение:
-
true, если символ является строчной буквой;falseв противном случае. - См. также:
-
isLowerCase(char),isTitleCase(char),toLowerCase(char),getType(char)
isLowerCase
public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (кодовое значение Юникода) строчной буквой.
Символ является строчной буквой, если его тип общей категории, предоставленный getType(codePoint), равен LOWERCASE_LETTER, или он обладает вспомогательным свойством Other_Lowercase, как определено в стандарте Юникод.
Примеры строчных символов:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Юникода также являются строчными.
- Параметры:
-
codePoint- символ (кодовое значение Юникода) для проверки. - Возвращаемое значение:
-
true, если символ является строчной буквой;falseв противном случае. - С версии:
- 1.5
- См. также:
-
isLowerCase(int),isTitleCase(int),toLowerCase(int),getType(int)
isUpperCase
public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ заглавной буквой.
Символ является заглавной буквой, если его тип общей категории, предоставленный Character.getType(ch), равен UPPERCASE_LETTER, или он обладает вспомогательным свойством Other_Uppercase, как определено в стандарте Юникод.
Примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Юникода также являются заглавными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUpperCase(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ заглавный;falseв противном случае. - С:
- 1.0
- См. также:
-
isLowerCase(char),isTitleCase(char),toUpperCase(char),getType(char)
isUpperCase
public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) заглавным.
Символ считается заглавным, если его тип общей категории, предоставленный getType(codePoint), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Юникод.
Ниже приведены примеры заглавных символов:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Юникода также являются заглавными.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ заглавный;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowerCase(int),isTitleCase(int),toUpperCase(int),getType(int)
isTitleCase
public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом строчной заглавной буквы.
Символ является символом строчной заглавной буквы, если его тип общей категории, предоставленный Character.getType(ch), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей формой для отображения слова строчными буквами с заглавными начальными буквами, например, в названии книги.
Вот некоторые из символов Юникода, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Юникода также являются заглавными буквами.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isTitleCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ заглавной строчной буквы;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isLowerCase(char),isUpperCase(char),toTitleCase(char),getType(char)
isTitleCase
public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) символом заглавной строчной буквы.
Символ является символом заглавной строчной буквы, если его тип общей категории, предоставленный getType(codePoint), равен TITLECASE_LETTER.
Некоторые символы выглядят как пары латинских букв. Например, есть заглавная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", является подходящей формой для отображения слова строчными буквами с заглавными начальными буквами, например, в названии книги.
Вот некоторые из символов Юникода, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Юникода также являются заглавными буквами.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ заглавной строчной буквы;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowerCase(int),isUpperCase(int),toTitleCase(int),getType(int)
isDigit
public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
Символ считается цифрой, если его тип общей категории, предоставленный Character.getType(ch), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', полноширинные цифры
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isDigit(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является цифрой;falseв противном случае. - См. также:
-
digit(char, int),forDigit(int, int),getType(char)
isDigit
public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) цифрой.
Символ считается цифрой, если его тип общей категории, предоставленный getType(codePoint), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', цифры деванагари -
'\uFF10'по'\uFF19', полноширинные цифры
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ является цифрой;falseв противном случае. - С:
- 1.5
- См. также:
-
forDigit(int, int),getType(int)
isDefined
public static boolean isDefined(char ch)
Определяет, является ли символ определённым в Юникоде.
Символ считается определенным, если хотя бы одно из следующих утверждений истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isDefined(int).
- Параметры:
-
ch- символ для проверки - Возвращает:
-
trueесли символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isDigit(char),isLetter(char),isLetterOrDigit(char),isLowerCase(char),isTitleCase(char),isUpperCase(char)
isDefined
public static boolean isDefined(int codePoint)
Определяет, является ли символ (код Юникода) определённым в Юникоде.
Символ считается определённым, если хотя бы одно из следующих утверждений истинно:
- У него есть запись в файле UnicodeData.
- У него есть значение в диапазоне, определенном файлом UnicodeData.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isLetter(int),isLetterOrDigit(int),isLowerCase(int),isTitleCase(int),isUpperCase(int)
isLetter
public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), равен одному из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isLetter(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - См. также:
-
isDigit(char),isJavaIdentifierStart(char),isJavaLetter(char),isJavaLetterOrDigit(char),isLetterOrDigit(char),isLowerCase(char),isTitleCase(char),isUnicodeIdentifierStart(char),isUpperCase(char)
isLetter
public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой.
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), является любым из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint- символ (кодовый пункт Юникода), который нужно проверить. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isJavaIdentifierStart(int),isLetterOrDigit(int),isLowerCase(int),isTitleCase(int),isUnicodeIdentifierStart(int),isUpperCase(int)
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
Символ считается буквой или цифрой, если либо Character.isLetter(char ch) или Character.isDigit(char ch) возвращает true для символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isDigit(char),isJavaIdentifierPart(char),isJavaLetter(char),isJavaLetterOrDigit(char),isLetter(char),isUnicodeIdentifierPart(char)
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой или цифрой.
Символ считается буквой или цифрой, если либо isLetter(codePoint) или isDigit(codePoint) возвращает true для символа.
- Параметры:
-
codePoint- символ (кодовый пункт Юникода), который нужно проверить. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isJavaIdentifierPart(int),isLetter(int),isUnicodeIdentifierPart(int)
isJavaLetter
@Deprecated(since="1.1") public static boolean isJavaLetter(char ch)
Определяет, разрешен ли указанный символ как первый символ в идентификаторе Java.
Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительного пунктуации (например,'_')
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isJavaLetterOrDigit(char),isJavaIdentifierStart(char),isJavaIdentifierPart(char),isLetter(char),isLetterOrDigit(char),isUnicodeIdentifierStart(char)
isJavaLetterOrDigit
@Deprecated(since="1.1") public static boolean isJavaLetterOrDigit(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа.
Символ может быть частью идентификатора Java, если и только если выполняется одно из следующих условий:
- он является буквой
- он является символом валюты (например,
'$') - он является символом соединительного пунктуации (например,
'_') - он является цифрой
- он является буквой-цифрой (например, символ римской цифры)
- он является значком комбинации
- он является значком без пробелов
-
isIdentifierIgnorableвозвращаетtrueдля символа.
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isJavaLetter(char),isJavaIdentifierStart(char),isJavaIdentifierPart(char),isLetter(char),isLetterOrDigit(char),isUnicodeIdentifierPart(char),isIdentifierIgnorable(char)
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) буквой алфавита.
Символ считается буквой алфавита, если его тип общей категории, предоставленный getType(codePoint), является любым из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Параметры:
-
codePoint- символ (кодовый пункт Юникода), который нужно проверить. - Возвращает:
-
trueесли символ является символом Unicode алфавита,falseв противном случае. - С:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (кодовый пункт Юникода) иероглифом CJKV (китайский, японский, корейский и вьетнамский), как определено стандартом Юникод.
- Параметры:
-
codePoint- символ (кодовый пункт Юникода), который нужно проверить. - Возвращает:
-
trueесли символ является символом Unicode иероглифа,falseв противном случае. - С:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Определяет, разрешен ли указанный символ как первый символ в идентификаторе Java.
Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом соединительного пунктуации (например,'_').
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные, используйте метод isJavaIdentifierStart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - С:
- 1.1
- См. также:
-
isJavaIdentifierPart(char),isLetter(char),isUnicodeIdentifierStart(char),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Определяет, допустим ли символ (код точки Unicode) в качестве первого символа в идентификаторе Java.
Символ может начинать идентификатор Java тогда и только тогда, когда выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - ссылаемый символ является символом валюты (например,
'$') - ссылаемый символ является соединительным пунктуационным символом (например,
'_').
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно проверить. - Возвращаемое значение:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - С версии:
- 1.5
- См. также:
-
isJavaIdentifierPart(int),isLetter(int),isUnicodeIdentifierStart(int),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа.
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный пунктуационный символ (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это соединительная метка
- это неразрывный пробел
-
isIdentifierIgnorableвозвращаетtrueдля символа
Примечание: Этот метод не может обрабатывать вспомогательные символы. Для поддержки всех символов Unicode, включая вспомогательные символы, используйте метод isJavaIdentifierPart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращаемое значение:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - С версии:
- 1.1
- См. также:
-
isIdentifierIgnorable(char),isJavaIdentifierStart(char),isLetterOrDigit(char),isUnicodeIdentifierPart(char),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (код точки Unicode) быть частью идентификатора Java, кроме первого символа.
Символ может быть частью идентификатора Java, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это соединительный пунктуационный символ (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это соединительная метка
- это неразрывный пробел
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля кодовой точки
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно проверить. - Возвращаемое значение:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - С версии:
- 1.5
- См. также:
-
isIdentifierIgnorable(int),isJavaIdentifierStart(int),isLetterOrDigit(int),isUnicodeIdentifierPart(int),SourceVersion.isIdentifier(CharSequence)
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Определяет, допустим ли указанный символ в качестве первого символа в идентификаторе Unicode.
Символ может начинать идентификатор Unicode тогда и только тогда, когда выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER.
Примечание: Этот метод не может обрабатывать вспомогательные символы. Для поддержки всех символов Unicode, включая вспомогательные символы, используйте метод isUnicodeIdentifierStart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращаемое значение:
-
trueесли символ может начинать идентификатор Unicode;falseв противном случае. - С версии:
- 1.1
- См. также:
-
isJavaIdentifierStart(char),isLetter(char),isUnicodeIdentifierPart(char)
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, допустим ли указанный символ (код точки Unicode) в качестве первого символа в идентификаторе Unicode.
Символ может начинать идентификатор Unicode тогда и только тогда, когда выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER.
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно проверить. - Возвращаемое значение:
-
trueесли символ может начинать идентификатор Unicode;falseв противном случае. - С версии:
- 1.5
- См. также:
-
isJavaIdentifierStart(int),isLetter(int),isUnicodeIdentifierPart(int)
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Unicode, кроме первого символа.
Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих утверждений:
- это буква
- это соединительный пунктуационный символ (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это соединительная метка
- это неразрывный пробел
-
isIdentifierIgnorableвозвращаетtrueдля этого символа.
Примечание: Этот метод не может обрабатывать вспомогательные символы. Для поддержки всех символов Unicode, включая вспомогательные символы, используйте метод isUnicodeIdentifierPart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращаемое значение:
-
trueесли символ может быть частью идентификатора Unicode;falseв противном случае. - С версии:
- 1.1
- См. также:
-
isIdentifierIgnorable(char),isJavaIdentifierPart(char),isLetterOrDigit(char),isUnicodeIdentifierStart(char)
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (код точки Unicode) быть частью идентификатора Unicode, кроме первого символа.
Символ может быть частью идентификатора Unicode тогда и только тогда, когда выполняется одно из следующих утверждений:
- это буква
- это соединительный пунктуационный символ (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это соединительная метка
- это неразрывный пробел
-
isIdentifierIgnorableвозвращаетtrueдля этого символа.
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно проверить. - Возвращаемое значение:
-
trueесли символ может быть частью идентификатора Unicode;falseв противном случае. - С версии:
- 1.5
- См. также:
-
isIdentifierIgnorable(int),isJavaIdentifierPart(int),isLetterOrDigit(int),isUnicodeIdentifierStart(int)
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или идентификаторе Unicode.
Следующие символы Unicode игнорируются в идентификаторе Java или идентификаторе Unicode:
- Символы управления ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
Примечание: Этот метод не может обрабатывать вспомогательные символы. Для поддержки всех символов Unicode, включая вспомогательные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращаемое значение:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode;falseв противном случае. - С версии:
- 1.1
- См. также:
-
isJavaIdentifierPart(char),isUnicodeIdentifierPart(char)
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Определяет, должен ли указанный символ (код Юникода) рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Юникода.
Следующие символы Юникода игнорируются в идентификаторе Java или идентификаторе Юникода:
- Управляющие символы ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, имеющие значение общей категории
FORMAT
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Юникода;falseв противном случае. - С:
- 1.5
- См. также:
-
isJavaIdentifierPart(int),isUnicodeIdentifierPart(int)
toLowerCase
public static char toLowerCase(char ch)
Преобразует символ-аргумент в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов, являющихся символами или иероглифами.
В общем случае, String.toLowerCase() следует использовать для преобразования символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ по сравнению с Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования, зависящие от локали, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- эквивалент символа в нижнем регистре, если есть; в противном случае, сам символ.
- См. также:
-
isLowerCase(char),String.toLowerCase()
toLowerCase
public static int toLowerCase(int codePoint)
Преобразует символ-аргумент (код Юникода) в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов, являющихся символами или иероглифами.
В общем случае, String.toLowerCase() следует использовать для преобразования символов в нижний регистр. String методы преобразования регистра имеют несколько преимуществ по сравнению с Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования, зависящие от локали, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. - Возвращает:
- эквивалент символа (код Юникода) в нижнем регистре, если есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isLowerCase(int),String.toLowerCase()
toUpperCase
public static char toUpperCase(char ch)
Преобразует символ-аргумент в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов, являющихся символами или иероглифами.
В общем случае, String.toUpperCase() следует использовать для преобразования символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ по сравнению с Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования, зависящие от локали, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toUpperCase(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- эквивалент символа в верхнем регистре, если есть; в противном случае, сам символ.
- См. также:
-
isUpperCase(char),String.toUpperCase()
toUpperCase
public static int toUpperCase(int codePoint)
Преобразует символ-аргумент (код Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData.
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов, являющихся символами или иероглифами.
В общем случае, String.toUpperCase() следует использовать для преобразования символов в верхний регистр. String методы преобразования регистра имеют несколько преимуществ по сравнению с Character методами преобразования регистра. String методы преобразования регистра могут выполнять преобразования, зависящие от локали, контекстно-зависимые преобразования и преобразования 1:М символов, в то время как Character методы преобразования регистра не могут.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. - Возвращает:
- эквивалент символа в верхнем регистре, если есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isUpperCase(int),String.toUpperCase()
toTitleCase
public static char toTitleCase(char ch)
Преобразует символ-аргумент в заглавную букву, используя информацию о преобразовании регистра из файла UnicodeData. Если у символа нет явного преобразования в заглавную букву и сам символ не является заглавной буквой согласно UnicodeData, то возвращается преобразование в верхний регистр как эквивалентное преобразование в заглавную букву. Если символ-аргумент уже является заглавной буквой, то возвращается то же значение.
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод toTitleCase(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- эквивалент символа в заглавной букве, если есть; в противном случае, сам символ.
- С:
- 1.0.2
- См. также:
-
isTitleCase(char),toLowerCase(char),toUpperCase(char)
toTitleCase
public static int toTitleCase(int codePoint)
Преобразует символ-аргумент (код Юникода) в заглавную букву, используя информацию о преобразовании регистра из файла UnicodeData. Если у символа нет явного преобразования в заглавную букву и сам символ не является заглавной буквой согласно UnicodeData, то возвращается преобразование в верхний регистр как эквивалентное преобразование в заглавную букву. Если символ-аргумент уже является заглавной буквой, то возвращается то же значение символа.
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. - Возвращает:
- эквивалент символа в заглавной букве, если есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isTitleCase(int),toLowerCase(int),toUpperCase(int)
digit
public static int digit(char ch,
int radix) Возвращает числовое значение символа ch в указанном основании.
Если основание не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение символа ch не является допустимым числом в указанном основании, возвращается -1. Символ является допустимым числом, если выполняется хотя бы одно из следующих условий:
- Метод
isDigitявляетсяtrueсимвола, а десятичное значение символа Юникода (или его разложения на один символ) меньше указанного основания. В этом случае возвращается десятичное значение. - Символ является одной из заглавных латинских букв
'A'по'Z'и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв
'a'по'z'и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из полных заглавных латинских букв A (
'\uFF21') по Z ('\uFF3A') и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из полных строчных латинских букв a (
'\uFF41') по z ('\uFF5A') и его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch- символ для преобразования. -
radix- основание. - Возвращает:
- числовое значение, представленное символом в указанном основании.
- См. также:
-
forDigit(int, int),isDigit(char)
digit
public static int digit(int codePoint,
int radix) Возвращает числовое значение указанного символа (кода Юникода) в заданном основании.
Если основание не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в заданном основании, возвращается -1. Символ является допустимой цифрой, если выполняется хотя бы одно из следующих условий:
- Метод
isDigit(codePoint)возвращаетtrueдля символа, и десятичное значение цифры Юникода символа (или его разложения на один символ) меньше заданного основания. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв от
'A'до'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв от
'a'до'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из заглавных латинских букв в полноширинном формате A (
'\uFF21') до Z ('\uFF3A'), и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полноширинном формате a (
'\uFF41') до z ('\uFF5A'), и его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint- символ (код Юникода), который необходимо преобразовать. -
radix- основание. - Возвращаемое значение:
- числовое значение, представленное символом в заданном основании.
- С версии:
- 1.5
- См. также:
-
forDigit(int, int),isDigit(int)
getNumericValue
public static int getNumericValue(char ch)
Возвращает числовое значение, которое представляет указанный символ Юникода. Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.
Буквы A-Z в заглавном ('\u0041' до '\u005A'), строчном ('\u0061' до '\u007A') и полноширинном вариантах ('\uFF21' до '\uFF3A' и '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовых значений этим char значениям.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch- символ для преобразования. - Возвращаемое значение:
- числовое значение символа, как неотрицательное
intзначение; -2, если символ имеет числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если символ не имеет числового значения. - С версии:
- 1.1
- См. также:
-
forDigit(int, int),isDigit(char)
getNumericValue
public static int getNumericValue(int codePoint)
Возвращает числовое значение, которое представляет указанный символ (код Юникода). Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.
Буквы A-Z в заглавном ('\u0041' до '\u005A'), строчном ('\u0061' до '\u007A') и полноширинном вариантах ('\uFF21' до '\uFF3A' и '\uFF41' до '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Юникода, которая не присваивает числовых значений этим char значениям.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint- символ (код Юникода) для преобразования. - Возвращаемое значение:
- числовое значение символа, как неотрицательное
intзначение; -2, если символ имеет числовое значение, но значение не может быть представлено как неотрицательноеintзначение; -1, если символ не имеет числового значения. - С версии:
- 1.5
- См. также:
-
forDigit(int, int),isDigit(int)
isSpace
@Deprecated(since="1.1") public static boolean isSpace(char ch)
Определяет, является ли указанный символ пробелом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
| Символ | Код | Название |
|---|---|---|
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch- символ для проверки. - Возвращаемое значение:
-
true, если символ является пробелом ISO-LATIN-1;falseв противном случае. - См. также:
-
isSpaceChar(char),isWhitespace(char)
isSpaceChar
public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом пробела Юникода. Символ считается символом пробела только в том случае, если он определён как символ пробела стандартом Юникода. Этот метод возвращает true, если тип общей категории символа является одним из следующих:
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isSpaceChar(int).
- Параметры:
-
ch- символ для проверки. - Возвращаемое значение:
-
true, если символ является символом пробела;falseв противном случае. - С версии:
- 1.1
- См. также:
isWhitespace(char)
isSpaceChar
public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (код Юникода) символом пробела Юникода. Символ считается символом пробела только в том случае, если он определён как символ пробела стандартом Юникода. Этот метод возвращает true, если тип общей категории символа является одним из следующих:
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращаемое значение:
-
true, если символ является символом пробела;falseв противном случае. - С версии:
- 1.5
- См. также:
isWhitespace(int)
isWhitespace
public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ символом пробела согласно Java. Символ является символом пробела Java, если и только если он удовлетворяет одному из следующих критериев:
- Это символ пробела Юникода (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Это
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Это
'\n', U+000A ПЕРЕВОД СТРОКИ. - Это
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Это
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Это
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Это
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Это
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Это
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Это
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isWhitespace(int).
- Параметры:
-
ch- символ для проверки. - Возвращаемое значение:
-
true, если символ является символом пробела Java;falseв противном случае. - С версии:
- 1.1
- См. также:
isSpaceChar(char)
isWhitespace
public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) пробелом в соответствии с Java. Символ является пробелом Java, если и только если он удовлетворяет одному из следующих критериев:
- Он является символом пробела Unicode (
SPACE_SEPARATOR,LINE_SEPARATORилиPARAGRAPH_SEPARATOR), но при этом не является неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПОДВОДКА. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
- Параметры:
-
codePoint- символ (код точки Unicode) для проверки. - Возвращает:
-
true, если символ является пробелом Java;falseв противном случае. - С:
- 1.5
- См. также:
isSpaceChar(int)
isISOControl
public static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - С:
- 1.1
- См. также:
-
isSpaceChar(char),isWhitespace(char)
isISOControl
public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (код точки Unicode) управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.
- Параметры:
-
codePoint- символ (код точки Unicode) для проверки. - Возвращает:
-
true, если символ является управляющим символом ISO;falseв противном случае. - С:
- 1.5
- См. также:
-
isSpaceChar(int),isWhitespace(int)
getType
public static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.1
- См. также:
-
COMBINING_SPACING_MARK,CONNECTOR_PUNCTUATION,CONTROL,CURRENCY_SYMBOL,DASH_PUNCTUATION,DECIMAL_DIGIT_NUMBER,ENCLOSING_MARK,END_PUNCTUATION,FINAL_QUOTE_PUNCTUATION,FORMAT,INITIAL_QUOTE_PUNCTUATION,LETTER_NUMBER,LINE_SEPARATOR,LOWERCASE_LETTER,MATH_SYMBOL,MODIFIER_LETTER,MODIFIER_SYMBOL,NON_SPACING_MARK,OTHER_LETTER,OTHER_NUMBER,OTHER_PUNCTUATION,OTHER_SYMBOL,PARAGRAPH_SEPARATOR,PRIVATE_USE,SPACE_SEPARATOR,START_PUNCTUATION,SURROGATE,TITLECASE_LETTER,UNASSIGNED,UPPERCASE_LETTER
getType
public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
- Параметры:
-
codePoint- символ (код точки Unicode) для проверки. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.5
- См. также:
-
COMBINING_SPACING_MARK,CONNECTOR_PUNCTUATION,CONTROL,CURRENCY_SYMBOL,DASH_PUNCTUATION,DECIMAL_DIGIT_NUMBER,ENCLOSING_MARK,END_PUNCTUATION,FINAL_QUOTE_PUNCTUATION,FORMAT,INITIAL_QUOTE_PUNCTUATION,LETTER_NUMBER,LINE_SEPARATOR,LOWERCASE_LETTER,MATH_SYMBOL,MODIFIER_LETTER,MODIFIER_SYMBOL,NON_SPACING_MARK,OTHER_LETTER,OTHER_NUMBER,OTHER_PUNCTUATION,OTHER_SYMBOL,PARAGRAPH_SEPARATOR,PRIVATE_USE,SPACE_SEPARATOR,START_PUNCTUATION,SURROGATE,TITLECASE_LETTER,UNASSIGNED,UPPERCASE_LETTER
forDigit
public static char forDigit(int digit,
int radix) Определяет представление символа для определенного разряда в указанном основании. Если значение radix не является допустимым основанием или значение digit не является допустимым разрядом в указанном основании, возвращается нулевой символ ('\u0000').
Аргумент radix допустим, если он не меньше MIN_RADIX и не больше MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.
Если разряд меньше 10, возвращается '0' + digit. В противном случае возвращается значение 'a' + digit - 10.
- Параметры:
-
digit- число для преобразования в символ. -
radix- основание. - Возвращает:
- представление символа указанного разряда в указанном основании.
- См. также:
-
MIN_RADIX,MAX_RADIX,digit(char, int)
getDirectionality
public static byte getDirectionality(char ch)
Возвращает свойство направленности Unicode для данного символа. Направленность символа используется для вычисления визуального порядка текста. Значение направленности для неопределенных char значений равно DIRECTIONALITY_UNDEFINED.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch-char, для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - С:
- 1.4
- См. также:
-
DIRECTIONALITY_UNDEFINED,DIRECTIONALITY_LEFT_TO_RIGHT,DIRECTIONALITY_RIGHT_TO_LEFT,DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC,DIRECTIONALITY_EUROPEAN_NUMBER,DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR,DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR,DIRECTIONALITY_ARABIC_NUMBER,DIRECTIONALITY_COMMON_NUMBER_SEPARATOR,DIRECTIONALITY_NONSPACING_MARK,DIRECTIONALITY_BOUNDARY_NEUTRAL,DIRECTIONALITY_PARAGRAPH_SEPARATOR,DIRECTIONALITY_SEGMENT_SEPARATOR,DIRECTIONALITY_WHITESPACE,DIRECTIONALITY_OTHER_NEUTRALS,DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING,DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE,DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING,DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE,DIRECTIONALITY_POP_DIRECTIONAL_FORMAT,DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE,DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE,DIRECTIONALITY_FIRST_STRONG_ISOLATE,DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
getDirectionality
public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Юникода для заданного символа (кода символа Юникода). Направленность символа используется для вычисления визуального порядка текста. Значение направленности неопределённого символа равно DIRECTIONALITY_UNDEFINED.
- Параметры:
-
codePoint- символ (код символа Юникода), для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- С:
- 1.5
- См. также:
-
DIRECTIONALITY_UNDEFINED,DIRECTIONALITY_LEFT_TO_RIGHT,DIRECTIONALITY_RIGHT_TO_LEFT,DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC,DIRECTIONALITY_EUROPEAN_NUMBER,DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR,DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR,DIRECTIONALITY_ARABIC_NUMBER,DIRECTIONALITY_COMMON_NUMBER_SEPARATOR,DIRECTIONALITY_NONSPACING_MARK,DIRECTIONALITY_BOUNDARY_NEUTRAL,DIRECTIONALITY_PARAGRAPH_SEPARATOR,DIRECTIONALITY_SEGMENT_SEPARATOR,DIRECTIONALITY_WHITESPACE,DIRECTIONALITY_OTHER_NEUTRALS,DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING,DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE,DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING,DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE,DIRECTIONALITY_POP_DIRECTIONAL_FORMAT,DIRECTIONALITY_LEFT_TO_RIGHT_ISOLATE,DIRECTIONALITY_RIGHT_TO_LEFT_ISOLATE,DIRECTIONALITY_FIRST_STRONG_ISOLATE,DIRECTIONALITY_POP_DIRECTIONAL_ISOLATE
isMirrored
public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным согласно спецификации Юникода. Зеркальные символы должны иметь свои глифы, отображённые горизонтально, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА по смыслу определена как открывающая скобка. Она будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch-char, для которого запрашивается свойство зеркальности - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определён. - С:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (код символа Юникода) зеркальным согласно спецификации Юникода. Зеркальные символы должны иметь свои глифы, отображённые горизонтально, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА по смыслу определена как открывающая скобка. Она будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.
- Параметры:
-
codePoint- символ (код символа Юникода) для проверки. - Возвращает:
-
trueесли символ зеркальный,falseесли символ не зеркальный или не определён. - С:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
- Указано в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter- объектCharacterдля сравнения. - Возвращает:
- значение
0если переданный аргумент равен этомуCharacter; значение меньше0если этотCharacterчисленно меньше, чем переданный аргумент; и значение больше0если этотCharacterчисленно больше, чем переданный аргумент (сравнение без учёта знака). Обратите внимание, что это строго численное сравнение; оно не зависит от локали. - С:
- 1.2
compare
public static int compare(char x,
char y) Сравнивает два значения char численно. Возвращаемое значение идентично тому, что было бы возвращено:
Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x- первое значениеcharдля сравнения -
y- второе значениеcharдля сравнения - Возвращает:
- значение
0еслиx == y; значение меньше0еслиx < y; и значение больше0еслиx > y - С:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
Возвращает значение, полученное путём перестановки байтов в заданном значении char.
- Параметры:
-
ch- Значениеcharдля перестановки байтов. - Возвращает:
- значение, полученное путём перестановки (или, другими словами, обмена) байтов в заданном значении
char. - С:
- 1.5
getName
public static String getName(int codePoint)
Возвращает имя символа Юникода указанного символа codePoint, или null, если код точки unassigned.
Примечание: если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Юникода, поддерживаемой консорциумом Юникода), возвращённое имя равно результату выражения.
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT);
- Параметры:
-
codePoint- символ (код символа Юникода) - Возвращает:
- имя символа Юникода указанного символа, или null, если коду точки не присвоено имя.
- Исключения:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом символа Юникода. - С:
- 1.7
codePointOf
public static int codePointOf(String name)
Возвращает значение кода символа Юникода, указанного именем символа Юникода.
Примечание: если символу не присвоено имя в файле UnicodeData (части базы данных символов Юникода, поддерживаемой консорциумом Юникода), его имя определяется как результат выражения
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ROOT); Сопоставление имён выполняется без учёта регистра, с удалением всех начальных и конечных пробельных символов.
- Параметры:
-
name- имя символа Юникода - Возвращает:
- значение кода символа указанного именем.
- Исключения:
-
IllegalArgumentException- если указанноеnameне является допустимым именем символа Юникода. -
NullPointerException- еслиnameявляетсяnull - С:
- 9
© 1993, 2020, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.
https://docs.oracle.com/en/java/javase/11/docs/api/java.base/java/lang/Character.html