Класс Character
- java.lang.Object
-
- java.lang.Character
- Все реализованные интерфейсы:
- Serializable, Comparable<Character>
public final class Character extends Object implements Serializable, Comparable<Character>
Класс Character оборачивает значение примитивного типа char в объект. Объект класса Character содержит единственное поле типа char.
Кроме того, этот класс предоставляет множество статических методов для определения категории символа (строчная буква, цифра и т.д.) и преобразования символов из верхнего регистра в нижний и наоборот.
Соответствие стандарту Unicode
Поля и методы класса Character определяются на основе информации о символах из стандарта Unicode, конкретно из файла UnicodeData, который входит в базу данных Unicode. Этот файл определяет свойства, включая имя и категорию для каждого назначенного кода символа или диапазона символов Unicode. Файл доступен от консорциума Unicode по адресу http://www.unicode.org.
Платформа Java SE 8 использует информацию о символах из версии 6.2 стандарта Unicode, с двумя расширениями. Во-первых, платформа Java SE 8 разрешает реализации класса Character использовать японский код эпохи, U+32FF, из первой версии стандарта Unicode после 6.2, которая назначает этот код. Во-вторых, признавая тот факт, что новые валюты появляются часто, платформа Java SE 8 разрешает реализации класса Character использовать блок символов валют из версии 10.0 стандарта Unicode. Вследствие этого, поведение полей и методов класса Character может варьироваться между реализациями платформы Java SE 8 при обработке вышеупомянутых кодов (вне версии 6.2), за исключением следующих методов, которые определяют идентификаторы Java: isJavaIdentifierStart(int), isJavaIdentifierStart(char), isJavaIdentifierPart(int), и isJavaIdentifierPart(char). Коды символов в идентификаторах Java должны быть взяты из версии 6.2 стандарта Unicode.
Представления символов Unicode
Тип данных char (и, следовательно, значение, которое encapsulates объект Character) основаны на оригинальной спецификации Unicode, которая определяла символы как сущности фиксированной ширины 16 бит. Стандарт Unicode с тех пор был изменен, чтобы позволить символы, чье представление требует более 16 бит. Диапазон допустимых кодов символов теперь U+0000 до U+10FFFF, известный как скалярное значение Unicode. (Обратитесь к определению обозначения U+n в стандарте Unicode.)
Набор символов от U+0000 до U+FFFF иногда называют Основной многоязычной плоскостью (BMP). Символы, чьи коды больше U+FFFF, называются дополнительными символами. Платформа Java использует представление UTF-16 в массивах char и в классах String и StringBuffer. В этом представлении дополнительные символы представлены парой значений char, первая из диапазона высоких суррогатов (\uD800-\uDBFF), вторая из диапазона низких суррогатов (\uDC00-\uDFFF).
Значение char, следовательно, представляет коды символов Основной многоязычной плоскости (BMP), включая суррогатные коды или код-единицы кодировки UTF-16. Значение int представляет все коды символов Unicode, включая дополнительные. Нижние (менее значимые) 21 бит int используются для представления кодов символов Unicode, а верхние (более значимые) 11 бит должны быть нулевыми. За исключением случаев, когда это оговорено отдельно, поведение относительно дополнительных символов и суррогатных значений char таково:
- Методы, которые принимают только значение
char, не могут поддерживать дополнительные символы. Они обрабатывают значенияcharиз суррогатных диапазонов как неопределённые символы. Например,Character.isLetter('\uD840')возвращаетfalse, даже если это конкретное значение, если за ним следует любое низкое суррогатное значение в строке, представляло бы букву. - Методы, которые принимают значение
int, поддерживают все символы Unicode, включая дополнительные. Например,Character.isLetter(0x2F81A)возвращаетtrue, потому что значение кода символа представляет букву (китайский иероглиф CJK).
В документации API Java SE, код точки Unicode используется для значений символов в диапазоне от U+0000 до U+10FFFF, а код-единица Unicode используется для 16-битных значений char которые являются код-единицами кодировки UTF-16. Для получения дополнительной информации об терминологии Unicode, обратитесь к словарю Unicode.
- С тех пор:
- 1.0
- См. также:
- Сериализованная форма
Вложенные классы
| Модификатор и тип | Класс и описание |
|---|---|
static class |
Character.Subset Экземпляры этого класса представляют собой определенные подмножества набора символов Unicode. |
static class |
Character.UnicodeBlock Семейство подмножеств символов, представляющих блоки символов в спецификации Unicode. |
static class |
Character.UnicodeScript Семейство подмножеств символов, представляющих наборы символов, определенные в приложении к стандарту Unicode № 24: Имена наборов символов. |
Поля
| Модификатор и тип | Поле и описание |
|---|---|
static int |
BYTES Количество байтов, используемых для представления значения |
static byte |
COMBINING_SPACING_MARK Общая категория "Mc" в спецификации Unicode. |
static byte |
CONNECTOR_PUNCTUATION Общая категория "Pc" в спецификации Unicode. |
static byte |
CONTROL Общая категория "Cc" в спецификации Unicode. |
static byte |
CURRENCY_SYMBOL Общая категория "Sc" в спецификации Unicode. |
static byte |
DASH_PUNCTUATION Общая категория "Pd" в спецификации Unicode. |
static byte |
DECIMAL_DIGIT_NUMBER Общая категория "Nd" в спецификации Unicode. |
static byte |
DIRECTIONALITY_ARABIC_NUMBER Слабый тип двунаправленного символа "AN" в спецификации Unicode. |
static byte |
DIRECTIONALITY_BOUNDARY_NEUTRAL Слабый тип двунаправленного символа "BN" в спецификации Unicode. |
static byte |
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR Слабый тип двунаправленного символа "CS" в спецификации Unicode. |
static byte |
DIRECTIONALITY_EUROPEAN_NUMBER Слабый тип двунаправленного символа "EN" в спецификации Unicode. |
static byte |
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR Слабый тип двунаправленного символа "ES" в спецификации Unicode. |
static byte |
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR Слабый тип двунаправленного символа "ET" в спецификации Unicode. |
static byte |
DIRECTIONALITY_LEFT_TO_RIGHT Сильный тип двунаправленного символа "L" в спецификации Unicode. |
static byte |
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING Сильный тип двунаправленного символа "LRE" в спецификации Unicode. |
static byte |
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE Сильный тип двунаправленного символа "LRO" в спецификации Unicode. |
static byte |
DIRECTIONALITY_NONSPACING_MARK Слабый тип двунаправленного символа "NSM" в спецификации Unicode. |
static byte |
DIRECTIONALITY_OTHER_NEUTRALS Нейтральный тип двунаправленного символа "ON" в спецификации Unicode. |
static byte |
DIRECTIONALITY_PARAGRAPH_SEPARATOR Нейтральный тип двунаправленного символа "B" в спецификации Unicode. |
static byte |
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT Слабый тип двунаправленного символа "PDF" в спецификации Unicode. |
static byte |
DIRECTIONALITY_RIGHT_TO_LEFT Сильный тип двунаправленного символа "R" в спецификации Unicode. |
static byte |
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC Сильный тип двунаправленного символа "AL" в спецификации Unicode. |
static byte |
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING Сильный тип двунаправленного символа "RLE" в спецификации Unicode. |
static byte |
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE Сильный тип двунаправленного символа "RLO" в спецификации Unicode. |
static byte |
DIRECTIONALITY_SEGMENT_SEPARATOR Нейтральный тип двунаправленного символа "S" в спецификации Unicode. |
static byte |
DIRECTIONALITY_UNDEFINED Неопределённый тип двунаправленного символа. |
static byte |
DIRECTIONALITY_WHITESPACE Нейтральный тип двунаправленного символа "WS" в спецификации Unicode. |
static byte |
ENCLOSING_MARK Общая категория "Me" в спецификации Unicode. |
static byte |
END_PUNCTUATION Общая категория "Pe" в спецификации Unicode. |
static byte |
FINAL_QUOTE_PUNCTUATION Общая категория "Pf" в спецификации Unicode. |
static byte |
FORMAT Общая категория "Cf" в спецификации Unicode. |
static byte |
INITIAL_QUOTE_PUNCTUATION Общая категория "Pi" в спецификации Unicode. |
static byte |
LETTER_NUMBER Общая категория "Nl" в спецификации Unicode. |
static byte |
LINE_SEPARATOR Общая категория "Zl" в спецификации Unicode. |
static byte |
LOWERCASE_LETTER Общая категория "Ll" в спецификации Unicode. |
static byte |
MATH_SYMBOL Общая категория "Sm" в спецификации Unicode. |
static int |
MAX_CODE_POINT Максимальное значение кода символа Unicode, константа |
static char |
MAX_HIGH_SURROGATE Максимальное значение высокоразрядного суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static char |
MAX_LOW_SURROGATE Максимальное значение низкоразрядного суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static int |
MAX_RADIX Максимальное основание, доступное для преобразования в строки и из строк. |
static char |
MAX_SURROGATE Максимальное значение суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static char |
MAX_VALUE Значение этой переменной — наибольшее значение типа |
static int |
MIN_CODE_POINT Минимальное значение кода символа Unicode, константа |
static char |
MIN_HIGH_SURROGATE Минимальное значение высокоразрядного суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static char |
MIN_LOW_SURROGATE Минимальное значение низкоразрядного суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static int |
MIN_RADIX Минимальное основание, доступное для преобразования в строки и из строк. |
static int |
MIN_SUPPLEMENTARY_CODE_POINT Минимальное значение дополнительного кода символа Unicode, константа |
static char |
MIN_SURROGATE Минимальное значение суррогатного кодового элемента Unicode в кодировке UTF-16, константа |
static char |
MIN_VALUE Значение этой переменной — наименьшее значение типа |
static byte |
MODIFIER_LETTER Общая категория "Lm" в спецификации Unicode. |
static byte |
MODIFIER_SYMBOL Общая категория "Sk" в спецификации Unicode. |
static byte |
NON_SPACING_MARK Общая категория "Mn" в спецификации Unicode. |
static byte |
OTHER_LETTER Общая категория "Lo" в спецификации Unicode. |
static byte |
OTHER_NUMBER Общая категория "No" в спецификации Unicode. |
static byte |
OTHER_PUNCTUATION Общая категория "Po" в спецификации Unicode. |
static byte |
OTHER_SYMBOL Общая категория "So" в спецификации Unicode. |
static byte |
PARAGRAPH_SEPARATOR Общая категория "Zp" в спецификации Unicode. |
static byte |
PRIVATE_USE Общая категория "Co" в спецификации Unicode. |
static int |
SIZE Количество бит, используемых для представления значения |
static byte |
SPACE_SEPARATOR Общая категория "Zs" в спецификации Unicode. |
static byte |
START_PUNCTUATION Общая категория "Ps" в спецификации Unicode. |
static byte |
SURROGATE Общая категория "Cs" в спецификации Unicode. |
static byte |
TITLECASE_LETTER Общая категория "Lt" в спецификации Unicode. |
static Class<Character> |
TYPE Экземпляр |
static byte |
UNASSIGNED Общая категория "Cn" в спецификации Unicode. |
static byte |
UPPERCASE_LETTER Общая категория "Lu" в спецификации Unicode. |
Конструкторы
| Конструктор и описание |
|---|
Character(char value) Создаёт новый объект |
Методы
| Модификатор и тип | Метод и описание |
|---|---|
static int |
charCount(int codePoint) Определяет количество значений |
char |
charValue() Возвращает значение этого объекта |
static int |
codePointAt(char[] a,
int index) Возвращает код символа в заданном индексе массива |
static int |
codePointAt(char[] a,
int index,
int limit) Возвращает код символа в заданном индексе массива |
static int |
codePointAt(CharSequence seq,
int index) Возвращает код символа в заданном индексе |
static int |
codePointBefore(char[] a,
int index) Возвращает код символа, предшествующий заданному индексу массива |
static int |
codePointBefore(char[] a,
int index,
int start) Возвращает код символа, предшествующий заданному индексу массива |
static int |
codePointBefore(CharSequence seq,
int index) Возвращает код символа, предшествующий заданному индексу |
static int |
codePointCount(char[] a,
int offset,
int count) Возвращает количество кодов символов Юникода в подмассиве массива |
static int |
codePointCount(CharSequence seq,
int beginIndex,
int endIndex) Возвращает количество кодов символов Юникода в диапазоне текста указанной последовательности символов. |
static int |
compare(char x,
char y) Сравнивает два значения |
int |
compareTo(Character anotherCharacter) Сравнивает два объекта |
static int |
digit(char ch,
int radix) Возвращает числовое значение символа |
static int |
digit(int codePoint,
int radix) Возвращает числовое значение указанного символа (кода Юникода) в указанном радиксе. |
boolean |
equals(Object obj) Сравнивает этот объект с указанным объектом. |
static char |
forDigit(int digit,
int radix) Определяет представление символа для конкретной цифры в указанном радиксе. |
static byte |
getDirectionality(char ch) Возвращает свойство направленности Юникода для данного символа. |
static byte |
getDirectionality(int codePoint) Возвращает свойство направленности Юникода для данного символа (кода Юникода). |
static String |
getName(int codePoint) Возвращает имя символа Юникода для указанного символа |
static int |
getNumericValue(char ch) Возвращает значение |
static int |
getNumericValue(int codePoint) Возвращает значение |
static int |
getType(char ch) Возвращает значение, обозначающее общую категорию символа. |
static int |
getType(int codePoint) Возвращает значение, обозначающее общую категорию символа. |
int |
hashCode() Возвращает код хэш для этого |
static int |
hashCode(char value) Возвращает код хэш для значения |
static char |
highSurrogate(int codePoint) Возвращает ведущий суррогат (код единицы суррогата высокой) пары суррогатов, представляющей указанный дополнительный символ (код Юникода) в кодировке UTF-16. |
static boolean |
isAlphabetic(int codePoint) Определяет, является ли указанный символ (код Юникода) буквой алфавита. |
static boolean |
isBmpCodePoint(int codePoint) Определяет, находится ли указанный символ (код Юникода) в основной многоязычной плоскости (BMP). |
static boolean |
isDefined(char ch) Определяет, определён ли символ в Юникоде. |
static boolean |
isDefined(int codePoint) Определяет, определён ли символ (код Юникода) в Юникоде. |
static boolean |
isDigit(char ch) Определяет, является ли указанный символ цифрой. |
static boolean |
isDigit(int codePoint) Определяет, является ли указанный символ (код Юникода) цифрой. |
static boolean |
isHighSurrogate(char ch) Определяет, является ли данное значение |
static boolean |
isIdentifierIgnorable(char ch) Определяет, следует ли рассматривать указанный символ как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdentifierIgnorable(int codePoint) Определяет, следует ли рассматривать указанный символ (код Юникода) как игнорируемый символ в идентификаторе Java или идентификаторе Юникода. |
static boolean |
isIdeographic(int codePoint) Определяет, является ли указанный символ (код Юникода) иероглифом CJKV (китайский, японский, корейский и вьетнамский), как определено в стандарте Юникод. |
static boolean |
isISOControl(char ch) Определяет, является ли указанный символ контрольным символом ISO. |
static boolean |
isISOControl(int codePoint) Определяет, является ли указанный символ (код Юникода) контрольным символом ISO. |
static boolean |
isJavaIdentifierPart(char ch) Определяет, может ли указанный символ быть частью идентификатора Java, кроме как первого символа. |
static boolean |
isJavaIdentifierPart(int codePoint) Определяет, может ли символ (код Юникода) быть частью идентификатора Java, кроме как первого символа. |
static boolean |
isJavaIdentifierStart(char ch) Устаревший. Заменён на isJavaIdentifierStart(char). |
static boolean |
isJavaIdentifierStart(int codePoint) Устаревший. Заменён на isJavaIdentifierPart(char). |
static boolean |
isJavaLetter(char ch) Устаревший. Заменён на isJavaIdentifierStart(char). |
static boolean |
isJavaLetterOrDigit(char ch) Устаревший. Заменён на isJavaIdentifierPart(char). |
static boolean |
isLetter(char ch) Определяет, является ли указанный символ буквой. |
static boolean |
isLetter(int codePoint) Определяет, является ли указанный символ (код Юникода) буквой. |
static boolean |
isLetterOrDigit(char ch) Определяет, является ли указанный символ буквой или цифрой. |
static boolean |
isLetterOrDigit(int codePoint) Определяет, является ли указанный символ (код Юникода) буквой или цифрой. |
static boolean |
isLowerCase(char ch) Определяет, является ли указанный символ строчной буквой. |
static boolean |
isLowerCase(int codePoint) Определяет, является ли указанный символ (код Юникода) строчной буквой. |
static boolean |
isLowSurrogate(char ch) Определяет, является ли данное значение |
static boolean |
isMirrored(char ch) Определяет, является ли символ зеркальным согласно спецификации Юникода. |
static boolean |
isMirrored(int codePoint) Определяет, является ли указанный символ (код Юникода) зеркальным согласно спецификации Юникода. |
static boolean |
isSpace(char ch) Устаревший. Заменён на isWhitespace(char). |
static boolean |
isSpaceChar(char ch) Определяет, является ли указанный символ пробелом Юникода. |
static boolean |
isSpaceChar(int codePoint) Определяет, является ли указанный символ (код Юникода) пробелом Юникода. |
static boolean |
isSupplementaryCodePoint(int codePoint) Определяет, находится ли указанный символ (код Юникода) в диапазоне дополнительных символов. |
static boolean |
isSurrogate(char ch) Определяет, является ли данное значение |
static boolean |
isSurrogatePair(char high,
char low) Определяет, является ли указанная пара значений |
static boolean |
isTitleCase(char ch) Определяет, является ли указанный символ заглавным. |
static boolean |
isTitleCase(int codePoint) Определяет, является ли указанный символ (код Юникода) заглавным. |
static boolean |
isUnicodeIdentifierPart(char ch) Определяет, может ли указанный символ быть частью идентификатора Юникода, не являясь при этом первым символом. |
static boolean |
isUnicodeIdentifierPart(int codePoint) Определяет, может ли указанный символ (код Юникода) быть частью идентификатора Юникода, не являясь при этом первым символом. |
static boolean |
isUnicodeIdentifierStart(char ch) Определяет, может ли указанный символ быть первым символом в идентификаторе Юникода. |
static boolean |
isUnicodeIdentifierStart(int codePoint) Определяет, может ли указанный символ (код Юникода) быть первым символом в идентификаторе Юникода. |
static boolean |
isUpperCase(char ch) Определяет, является ли указанный символ заглавным. |
static boolean |
isUpperCase(int codePoint) Определяет, является ли указанный символ (код Юникода) заглавным. |
static boolean |
isValidCodePoint(int codePoint) Определяет, является ли указанный код Юникода допустимым значением кода Юникода. |
static boolean |
isWhitespace(char ch) Определяет, является ли указанный символ пробелом согласно Java. |
static boolean |
isWhitespace(int codePoint) Определяет, является ли указанный символ (код Юникода) пробелом согласно Java. |
static char |
lowSurrogate(int codePoint) Возвращает конечный суррогат (код нижнего суррогата) пары суррогатов, представляющей указанный дополнительный символ (код Юникода) в кодировке UTF-16. |
static int |
offsetByCodePoints(char[] a,
int start,
int count,
int index,
int codePointOffset) Возвращает индекс в данном |
static int |
offsetByCodePoints(CharSequence seq,
int index,
int codePointOffset) Возвращает индекс в данной последовательности символов, смещенный относительно данного |
static char |
reverseBytes(char ch) Возвращает значение, полученное путем изменения порядка байтов в указанном |
static char[] |
toChars(int codePoint) Преобразует указанный символ (код Юникода) в его представление UTF-16, хранящееся в |
static int |
toChars(int codePoint,
char[] dst,
int dstIndex) Преобразует указанный символ (код Юникода) в его представление UTF-16. |
static int |
toCodePoint(char high,
char low) Преобразует указанную пару суррогатов в значение дополнительного кода. |
static char |
toLowerCase(char ch) Преобразует символ в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toLowerCase(int codePoint) Преобразует символ (код Юникода) в нижний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
String |
toString() Возвращает объект |
static String |
toString(char c) Возвращает объект |
static char |
toTitleCase(char ch) Преобразует символ в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toTitleCase(int codePoint) Преобразует символ (код Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static char |
toUpperCase(char ch) Преобразует символ в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static int |
toUpperCase(int codePoint) Преобразует символ (код Юникода) в верхний регистр, используя информацию о преобразовании регистра из файла UnicodeData. |
static Character |
valueOf(char c) Возвращает экземпляр |
Methods inherited from class java.lang.Object
clone, finalize, getClass, notify, notifyAll, wait, wait, wait Поля
MIN_RADIX
public static final int MIN_RADIX
Минимальное основание, доступное для преобразования в строки и из строк. Значение константы этого поля — наименьшее допустимое значение для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
- См. также:
-
digit(char, int),forDigit(int, int),Integer.toString(int, int),Integer.valueOf(String), Значения константных полей
MAX_RADIX
public static final int MAX_RADIX
Максимальное основание, доступное для преобразования в строки и из строк. Значение константы этого поля — наибольшее допустимое значение для аргумента radix в методах преобразования по основанию, таких как метод digit, метод forDigit и метод toString класса Integer.
- См. также:
-
digit(char, int),forDigit(int, int),Integer.toString(int, int),Integer.valueOf(String), Значения константных полей
MIN_VALUE
public static final char MIN_VALUE
Значение константы этого поля — наименьшее значение типа char, '\u0000'.
- С:
- 1.0.2
- См. также:
- Значения константных полей
MAX_VALUE
public static final char MAX_VALUE
Значение константы этого поля — наибольшее значение типа char, '\uFFFF'.
- С:
- 1.0.2
- См. также:
- Значения константных полей
TYPE
public static final Class<Character> TYPE
Экземпляр Class, представляющий примитивный тип char.
- С:
- 1.1
UNASSIGNED
public static final byte UNASSIGNED
Общая категория «Cn» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
UPPERCASE_LETTER
public static final byte UPPERCASE_LETTER
Общая категория «Lu» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LOWERCASE_LETTER
public static final byte LOWERCASE_LETTER
Общая категория «Ll» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
TITLECASE_LETTER
public static final byte TITLECASE_LETTER
Общая категория «Lt» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MODIFIER_LETTER
public static final byte MODIFIER_LETTER
Общая категория «Lm» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_LETTER
public static final byte OTHER_LETTER
Общая категория «Lo» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
NON_SPACING_MARK
public static final byte NON_SPACING_MARK
Общая категория «Mn» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
ENCLOSING_MARK
public static final byte ENCLOSING_MARK
Общая категория «Me» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
COMBINING_SPACING_MARK
public static final byte COMBINING_SPACING_MARK
Общая категория «Mc» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
DECIMAL_DIGIT_NUMBER
public static final byte DECIMAL_DIGIT_NUMBER
Общая категория «Nd» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LETTER_NUMBER
public static final byte LETTER_NUMBER
Общая категория «Nl» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_NUMBER
public static final byte OTHER_NUMBER
Общая категория «No» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
SPACE_SEPARATOR
public static final byte SPACE_SEPARATOR
Общая категория «Zs» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
LINE_SEPARATOR
public static final byte LINE_SEPARATOR
Общая категория «Zl» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
PARAGRAPH_SEPARATOR
public static final byte PARAGRAPH_SEPARATOR
Общая категория «Zp» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CONTROL
public static final byte CONTROL
Общая категория «Cc» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
FORMAT
public static final byte FORMAT
Общая категория «Cf» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
PRIVATE_USE
public static final byte PRIVATE_USE
Общая категория «Co» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
SURROGATE
public static final byte SURROGATE
Общая категория «Cs» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
DASH_PUNCTUATION
public static final byte DASH_PUNCTUATION
Общая категория «Pd» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
START_PUNCTUATION
public static final byte START_PUNCTUATION
Общая категория «Ps» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
END_PUNCTUATION
public static final byte END_PUNCTUATION
Общая категория «Pe» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CONNECTOR_PUNCTUATION
public static final byte CONNECTOR_PUNCTUATION
Общая категория «Pc» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_PUNCTUATION
public static final byte OTHER_PUNCTUATION
Общая категория «Po» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MATH_SYMBOL
public static final byte MATH_SYMBOL
Общая категория «Sm» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
CURRENCY_SYMBOL
public static final byte CURRENCY_SYMBOL
Общая категория «Sc» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
MODIFIER_SYMBOL
public static final byte MODIFIER_SYMBOL
Общая категория «Sk» в спецификации Unicode.
- С:
- 1.1
- См. также:
- Значения константных полей
OTHER_SYMBOL
public static final byte OTHER_SYMBOL
Общая категория «So» в спецификации Unicode.
- С момента:
- 1.1
- См. также:
- Значения постоянных полей
INITIAL_QUOTE_PUNCTUATION
public static final byte INITIAL_QUOTE_PUNCTUATION
Общая категория "Pi" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
FINAL_QUOTE_PUNCTUATION
public static final byte FINAL_QUOTE_PUNCTUATION
Общая категория "Pf" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_UNDEFINED
public static final byte DIRECTIONALITY_UNDEFINED
Неопределенный тип двунаправленного символа. У неопределенных char значений неопределена направленность в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT
Сильный тип двунаправленного символа "L" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT
Сильный тип двунаправленного символа "R" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC
Сильный тип двунаправленного символа "AL" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER
Слабый тип двунаправленного символа "EN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR
Слабый тип двунаправленного символа "ES" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
public static final byte DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR
Слабый тип двунаправленного символа "ET" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_ARABIC_NUMBER
public static final byte DIRECTIONALITY_ARABIC_NUMBER
Слабый тип двунаправленного символа "AN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
public static final byte DIRECTIONALITY_COMMON_NUMBER_SEPARATOR
Слабый тип двунаправленного символа "CS" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_NONSPACING_MARK
public static final byte DIRECTIONALITY_NONSPACING_MARK
Слабый тип двунаправленного символа "NSM" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_BOUNDARY_NEUTRAL
public static final byte DIRECTIONALITY_BOUNDARY_NEUTRAL
Слабый тип двунаправленного символа "BN" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_PARAGRAPH_SEPARATOR
public static final byte DIRECTIONALITY_PARAGRAPH_SEPARATOR
Нейтральный тип двунаправленного символа "B" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_SEGMENT_SEPARATOR
public static final byte DIRECTIONALITY_SEGMENT_SEPARATOR
Нейтральный тип двунаправленного символа "S" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_WHITESPACE
public static final byte DIRECTIONALITY_WHITESPACE
Нейтральный тип двунаправленного символа "WS" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_OTHER_NEUTRALS
public static final byte DIRECTIONALITY_OTHER_NEUTRALS
Нейтральный тип двунаправленного символа "ON" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING
Сильный тип двунаправленного символа "LRE" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
public static final byte DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE
Сильный тип двунаправленного символа "LRO" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING
Сильный тип двунаправленного символа "RLE" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
public static final byte DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE
Сильный тип двунаправленного символа "RLO" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
public static final byte DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
Слабый тип двунаправленного символа "PDF" в спецификации Unicode.
- С момента:
- 1.4
- См. также:
- Значения постоянных полей
MIN_HIGH_SURROGATE
public static final char MIN_HIGH_SURROGATE
Минимальное значение кодового блока Unicode старшего суррогата в кодировке UTF-16, константа '\uD800'. Старший суррогат также известен как ведущий суррогат.
- С момента:
- 1.5
- См. также:
- Значения постоянных полей
MAX_HIGH_SURROGATE
public static final char MAX_HIGH_SURROGATE
Максимальное значение кодового блока Unicode старшего суррогата в кодировке UTF-16, константа '\uDBFF'. Старший суррогат также известен как ведущий суррогат.
- С момента:
- 1.5
- См. также:
- Значения постоянных полей
MIN_LOW_SURROGATE
public static final char MIN_LOW_SURROGATE
Минимальное значение кодового блока Unicode младшего суррогата в кодировке UTF-16, константа '\uDC00'. Младший суррогат также известен как завершающий суррогат.
- С момента:
- 1.5
- См. также:
- Значения постоянных полей
MAX_LOW_SURROGATE
public static final char MAX_LOW_SURROGATE
Максимальное значение кодового блока Unicode младшего суррогата в кодировке UTF-16, константа '\uDFFF'. Младший суррогат также известен как завершающий суррогат.
- С момента:
- 1.5
- См. также:
- Значения постоянных полей
MIN_SURROGATE
public static final char MIN_SURROGATE
Минимальное значение кодового блока Unicode суррогата в кодировке UTF-16, константа '\uD800'.
- С момента:
- 1.5
- См. также:
- Значения постоянных полей
MAX_SURROGATE
public static final char MAX_SURROGATE
Максимальное значение кодового блока Unicode суррогата в кодировке UTF-16, константа '\uDFFF'.
- С момента:
- 1.5
- См. также:
- Значения константных полей
MIN_SUPPLEMENTARY_CODE_POINT
public static final int MIN_SUPPLEMENTARY_CODE_POINT
Минимальное значение дополнительного кода символа Юникода, константа U+10000.
- С момента:
- 1.5
- См. также:
- Значения константных полей
MIN_CODE_POINT
public static final int MIN_CODE_POINT
Минимальное значение кода символа Юникода, константа U+0000.
- С момента:
- 1.5
- См. также:
- Значения константных полей
MAX_CODE_POINT
public static final int MAX_CODE_POINT
Максимальное значение кода символа Юникода, константа U+10FFFF.
- С момента:
- 1.5
- См. также:
- Значения константных полей
SIZE
public static final int SIZE
Количество бит, используемых для представления значения char в беззнаковом двоичном формате, константа 16.
- С момента:
- 1.5
- См. также:
- Значения константных полей
BYTES
public static final int BYTES
Количество байтов, используемых для представления значения char в беззнаковом двоичном формате.
- С момента:
- 1.8
- См. также:
- Значения константных полей
Конструкторы
Character
public Character(char value)
Создаёт новый объект Character, представляющий указанное значение char.
- Параметры:
-
value- значение, которое должен представлять объектCharacter.
Методы
valueOf
public static Character valueOf(char c)
Возвращает экземпляр Character, представляющий указанное значение char. Если новый экземпляр Character не требуется, этот метод обычно следует использовать вместо конструктора Character(char), так как этот метод, вероятно, обеспечит значительно лучшую производительность по памяти и времени за счёт кэширования часто запрашиваемых значений. Этот метод всегда кэширует значения в диапазоне от '\u0000' до '\u007F', включительно, и может кэшировать другие значения за пределами этого диапазона.
- Параметры:
-
c- значение типа char. - Возвращает:
- экземпляр
Character, представляющийc. - С момента:
- 1.5
charValue
public char charValue()
Возвращает значение этого объекта Character.
- Возвращает:
- примитивное значение
char, представленное этим объектом.
hashCode
public int hashCode()
Возвращает код хэширования для этого объекта Character; равный результату вызова charValue().
- Переопределяет:
-
hashCodeв классеObject - Возвращает:
- значение кода хэширования для этого объекта
Character - См. также:
-
Object.equals(java.lang.Object),System.identityHashCode(java.lang.Object)
hashCode
public static int hashCode(char value)
Возвращает код хэширования для значения char , совместимого с Character.hashCode().
- Параметры:
-
value- Значениеcharдля которого нужно вернуть код хэширования. - Возвращает:
- значение кода хэширования для значения
char. - С момента:
- 1.8
equals
public boolean equals(Object obj)
Сравнивает этот объект с указанным объектом. Результат является true тогда и только тогда, когда аргумент не null и является объектом Character , представляющим то же самое значение char , что и этот объект.
- Переопределяет:
-
equalsв классеObject - Параметры:
-
obj- объект для сравнения. - Возвращает:
-
true, если объекты одинаковы;falseв противном случае. - См. также:
-
Object.hashCode(),HashMap
toString
public String toString()
Возвращает объект String , представляющий значение этого объекта Character. Результат — строка длиной 1, единственный компонент которой — примитивное значение char , представленное этим объектом Character.
toString
public static String toString(char c)
Возвращает объект String , представляющий указанное значение char. Результат — строка длиной 1, состоящая только из указанного значения char.
- Параметры:
-
c- преобразуемое значениеchar - Возвращает:
- строковое представление указанного значения
char - С момента:
- 1.4
isValidCodePoint
public static boolean isValidCodePoint(int codePoint)
Определяет, является ли указанный код символа допустимым значением кода символа Юникода.
- Параметры:
-
codePoint- проверяемый код символа Юникода - Возвращает:
-
true, если указанное значение кода символа находится междуMIN_CODE_POINTиMAX_CODE_POINTвключительно;falseв противном случае. - С момента:
- 1.5
isBmpCodePoint
public static boolean isBmpCodePoint(int codePoint)
Определяет, находится ли указанный символ (код символа Юникода) в основной многоязычной плоскости (BMP). Такие коды символов могут быть представлены с помощью одного char.
- Параметры:
-
codePoint- тестируемый символ (код символа Юникода) - Возвращает:
-
true, если указанный код символа находится междуMIN_VALUEиMAX_VALUEвключительно;falseв противном случае. - С момента:
- 1.7
isSupplementaryCodePoint
public static boolean isSupplementaryCodePoint(int codePoint)
Определяет, находится ли указанный символ (код символа Юникода) в диапазоне дополнительных символов.
- Параметры:
-
codePoint- тестируемый символ (код символа Юникода) - Возвращает:
-
true, если указанный код символа находится междуMIN_SUPPLEMENTARY_CODE_POINTиMAX_CODE_POINTвключительно;falseв противном случае. - С момента:
- 1.5
isHighSurrogate
public static boolean isHighSurrogate(char ch)
Определяет, является ли данное значение char представлением старшего замещающего кода символа Юникода (также известного как старший замещающий код символа).
Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится междуMIN_HIGH_SURROGATEиMAX_HIGH_SURROGATEвключительно;falseв противном случае. - С момента:
- 1.5
- См. также:
-
isLowSurrogate(char),Character.UnicodeBlock.of(int)
isLowSurrogate
public static boolean isLowSurrogate(char ch)
Определяет, является ли данное значение char представлением младшего замещающего кода символа Юникода (также известного как младший замещающий код символа).
Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится междуMIN_LOW_SURROGATEиMAX_LOW_SURROGATEвключительно;falseв противном случае. - С момента:
- 1.5
- См. также:
isHighSurrogate(char)
isSurrogate
public static boolean isSurrogate(char ch)
Определяет, является ли данное значение char кодом замещения Юникода.
Такие значения сами по себе не представляют символы, а используются для представления дополнительных символов в кодировке UTF-16.
Значение char является кодом замещения тогда и только тогда, когда оно является либо младшим замещающим кодом, либо старшим замещающим кодом.
- Параметры:
-
ch- тестируемое значениеchar. - Возвращает:
-
true, если значениеcharнаходится междуMIN_SURROGATEиMAX_SURROGATEвключительно;falseв противном случае. - С момента:
- 1.7
isSurrogatePair
public static boolean isSurrogatePair(char high,
char low) Определяет, является ли указанная пара значений char допустимой парой суррогатных символов Unicode.
Этот метод эквивалентен выражению:
isHighSurrogate(high) && isLowSurrogate(low)
- Параметры:
-
high- проверяемое значение кода верхнего суррогата -
low- проверяемое значение кода нижнего суррогата - Возвращает:
-
trueесли указанные значения кодов верхнего и нижнего суррогатов представляют собой допустимую пару суррогатов;falseв противном случае. - С версии:
- 1.5
charCount
public static int charCount(int codePoint)
Определяет количество значений char, необходимых для представления указанного символа (кодовой точки Unicode). Если указанный символ равен или больше 0x10000, то метод возвращает 2. В противном случае метод возвращает 1.
Этот метод не проверяет, является ли указанный символ допустимой кодовой точкой Unicode. Вызывающий абонент должен проверить значение символа с помощью isValidCodePoint, если необходимо.
- Параметры:
-
codePoint- проверяемый символ (кодовая точка Unicode). - Возвращает:
- 2, если символ является допустимым дополнительным символом; 1 в противном случае.
- С версии:
- 1.5
- См. также:
isSupplementaryCodePoint(int)
toCodePoint
public static int toCodePoint(char high,
char low) Преобразует указанную пару суррогатов в её дополнительное значение кодовой точки. Этот метод не проверяет указанную пару суррогатов. Вызывающий абонент должен проверить её с помощью isSurrogatePair, если необходимо.
- Параметры:
-
high- кодовая единица верхнего суррогата -
low- кодовая единица нижнего суррогата - Возвращает:
- дополнительная кодовая точка, составленная из указанной пары суррогатов.
- С версии:
- 1.5
codePointAt
public static int codePointAt(CharSequence seq,
int index) Возвращает кодовую точку в указанном индексе CharSequence. Если значение char в указанном индексе в CharSequence находится в диапазоне верхнего суррогата, следующий индекс меньше длины CharSequence, и значение char в следующем индексе находится в диапазоне нижнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в указанном индексе.
- Параметры:
-
seq- последовательность значенийchar(кодовых единиц Unicode) -
index- индекс к значениямchar(кодовые единицы Unicode) вseq, которые должны быть преобразованы - Возвращает:
- кодовая точка Unicode в указанном индексе
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньше, чемseq.length(). - С версии:
- 1.5
codePointAt
public static int codePointAt(char[] a,
int index) Возвращает кодовую точку в указанном индексе массива char. Если значение char в указанном индексе массива char находится в диапазоне верхнего суррогата, следующий индекс меньше длины массива char, и значение char в следующем индексе находится в диапазоне нижнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в указанном индексе.
- Параметры:
-
a- массивchar -
index- индекс к значениямchar(кодовые единицы Unicode) в массивеchar, которые должны быть преобразованы - Возвращает:
- кодовая точка Unicode в указанном индексе
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если значениеindexотрицательно или не меньше длины массиваchar. - С версии:
- 1.5
codePointAt
public static int codePointAt(char[] a,
int index,
int limit) Возвращает кодовую точку в указанном индексе массива char, где могут использоваться только элементы массива с index меньше limit. Если значение char в указанном индексе массива char находится в диапазоне верхнего суррогата, следующий индекс меньше limit, и значение char в следующем индексе находится в диапазоне нижнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в указанном индексе.
- Параметры:
-
a- массивchar -
index- индекс к значениямchar(кодовые единицы Unicode) в массивеchar, которые должны быть преобразованы -
limit- индекс после последнего элемента массива, который может быть использован в массивеchar - Возвращает:
- кодовая точка Unicode в указанном индексе
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexотрицательный или не меньше аргументаlimit, или если аргументlimitотрицательный или больше длины массиваchar. - С версии:
- 1.5
codePointBefore
public static int codePointBefore(CharSequence seq,
int index) Возвращает кодовую точку, предшествующую указанному индексу CharSequence. Если значение char в (index - 1) в CharSequence находится в диапазоне нижнего суррогата, (index - 2) неотрицательно, и значение char в (index - 2) в CharSequence находится в диапазоне верхнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Параметры:
-
seq- экземплярCharSequence -
index- индекс, следующий за кодовой точкой, которая должна быть возвращена - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Исключения:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или большеseq.length(). - С версии:
- 1.5
codePointBefore
public static int codePointBefore(char[] a,
int index) Возвращает кодовую точку, предшествующую указанному индексу массива char. Если значение char в (index - 1) в массиве char находится в диапазоне нижнего суррогата, (index - 2) неотрицательно, и значение char в (index - 2) в массиве char находится в диапазоне верхнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Параметры:
-
a- массивchar -
index- индекс, следующий за кодовой точкой, которая должна быть возвращена - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexменьше 1 или больше длины массиваchar - С версии:
- 1.5
codePointBefore
public static int codePointBefore(char[] a,
int index,
int start) Возвращает кодовую точку, предшествующую указанному индексу массива char, где могут использоваться только элементы массива с index больше или равно start. Если значение char в (index - 1) в массиве char находится в диапазоне нижнего суррогата, (index - 2) не меньше start, и значение char в (index - 2) в массиве char находится в диапазоне верхнего суррогата, то возвращается дополнительная кодовая точка, соответствующая этой паре суррогатов. В противном случае возвращается значение char в (index - 1).
- Параметры:
-
a- массивchar -
index- индекс, следующий за кодовой точкой, которая должна быть возвращена -
start- индекс первого элемента массива в массивеchar - Возвращает:
- значение кодовой точки Unicode перед указанным индексом.
- Исключения:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- если аргументindexне больше аргументаstartили больше длины массиваchar, или если аргументstartотрицательный или не меньше длины массиваchar. - С версии:
- 1.5
highSurrogate
public static char highSurrogate(int codePoint)
Возвращает ведущий суррогат (кодовая единица верхнего суррогата) пары суррогатов пар суррогатных символов, представляющих указанный дополнительный символ (кодовую точку Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неуказанное значение char.
Если isSupplementaryCodePoint(x) равно true, то isHighSurrogate(highSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Параметры:
-
codePoint- дополнительный символ (кодовая точка Unicode) - Возвращает:
- ведущая кодовая единица суррогата, используемая для представления символа в кодировке UTF-16
- С версии:
- 1.7
lowSurrogate
public static char lowSurrogate(int codePoint)
Возвращает заключительный суррогат (a низкий код суррогата) пары суррогатов, представляющей указанный дополнительный символ (код Unicode) в кодировке UTF-16. Если указанный символ не является дополнительным символом, возвращается неопределённая char.
Если isSupplementaryCodePoint(x) true, то isLowSurrogate(lowSurrogate(x)) и toCodePoint(highSurrogate(x), lowSurrogate(x)) == x также всегда true.
- Parameters:
-
codePoint- дополнительный символ (код Unicode) - Returns:
- конечный суррогат, используемый для представления символа в кодировке UTF-16
- Since:
- 1.7
toChars
public static int toChars(int codePoint,
char[] dst,
int dstIndex) Преобразует указанный символ (код Unicode) в его представление UTF-16. Если указанный код символа является значением BMP (базовой многоязычной плоскости или плоскости 0), то это же значение сохраняется в dst[dstIndex], и возвращается 1. Если указанный код символа является дополнительным символом, его значения суррогата сохраняются в dst[dstIndex] (высокий суррогат) и dst[dstIndex+1] (низкий суррогат), и возвращается 2.
- Parameters:
-
codePoint- символ (код Unicode) для преобразования. -
dst- массивchar, в котором хранится значение UTF-16codePoint. -
dstIndex- начальный индекс в массивеdst, где хранится преобразованное значение. - Returns:
- 1, если код символа — код символа BMP, 2, если код символа — дополнительный код символа.
- Throws:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Unicode. -
NullPointerException- если указанныйdstравен null. -
IndexOutOfBoundsException- еслиdstIndexотрицательный или не меньшеdst.length, или еслиdstпоdstIndexне содержит достаточно элементов массива для хранения полученного значенияchar. - Since:
- 1.5
toChars
public static char[] toChars(int codePoint)
Преобразует указанный символ (код Unicode) в его представление UTF-16, хранящееся в массиве char. Если указанный код символа — значение BMP (базовой многоязычной плоскости или плоскости 0), то массив char имеет то же значение, что и codePoint. Если указанный код символа — дополнительный код символа, результирующий массив char имеет соответствующую пару суррогатов.
- Parameters:
-
codePoint- код Unicode - Returns:
- массив
char, содержащий представление UTF-16codePoint. - Throws:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом Unicode. - Since:
- 1.5
codePointCount
public static int codePointCount(CharSequence seq,
int beginIndex,
int endIndex) Возвращает количество символов Unicode в текстовом диапазоне указанной последовательности символов. Текстовый диапазон начинается с указанного beginIndex и продолжается до char с индексом endIndex - 1. Таким образом, длина (в charых) текстового диапазона равна endIndex-beginIndex. Неспаренные суррогаты в текстовом диапазоне учитываются как по одному символу каждый.
- Parameters:
-
seq- последовательность символов -
beginIndex- индекс первогоcharтекстового диапазона. -
endIndex- индекс после последнегоcharтекстового диапазона. - Returns:
- количество символов Unicode в указанном текстовом диапазоне
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиbeginIndexотрицательное, илиendIndexбольше длины заданной последовательности, илиbeginIndexбольшеendIndex. - Since:
- 1.5
codePointCount
public static int codePointCount(char[] a,
int offset,
int count) Возвращает количество символов Unicode в подмассиве аргумента массива char массива. Аргумент offset — это индекс первого char подмассива, а аргумент count задаёт длину подмассива в charых. Неспаренные суррогаты в подмассиве учитываются как по одному символу каждый.
- Parameters:
-
a- массивchar -
offset- индекс первогоcharв заданном массивеchar -
count- длина подмассива вcharых - Returns:
- количество символов Unicode в указанном подмассиве
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиoffsetилиcountотрицательные, или еслиoffset + countбольше длины заданного массива. - Since:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(CharSequence seq,
int index,
int codePointOffset) Возвращает индекс в данной последовательности символов, который смещён от данного index на codePointOffset символов Unicode. Неспаренные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу каждый.
- Parameters:
-
seq- последовательность символов -
index- индекс, который нужно сместить -
codePointOffset- смещение в символах Unicode - Returns:
- индекс в последовательности символов
- Throws:
-
NullPointerException- еслиseqравно null. -
IndexOutOfBoundsException- еслиindexотрицательное или больше длины последовательности символов, или еслиcodePointOffsetположительное и подпоследовательность, начинающаяся сindex, содержит меньше чемcodePointOffsetсимволов Unicode, или еслиcodePointOffsetотрицательное и подпоследовательность передindexсодержит меньше чем абсолютное значениеcodePointOffsetсимволов Unicode. - Since:
- 1.5
offsetByCodePoints
public static int offsetByCodePoints(char[] a,
int start,
int count,
int index,
int codePointOffset) Возвращает индекс в данном массиве char подмассива, который смещён от данного index на codePointOffset символов Unicode. Аргументы start и count задают подмассив массива char. Неспаренные суррогаты в текстовом диапазоне, заданном index и codePointOffset, считаются по одному символу каждый.
- Parameters:
-
a- массивchar -
start- индекс первогоcharподмассива -
count- длина подмассива вcharых -
index- индекс, который нужно сместить -
codePointOffset- смещение в символах Unicode - Returns:
- индекс в подмассиве
- Throws:
-
NullPointerException- еслиaравно null. -
IndexOutOfBoundsException- еслиstartилиcountотрицательные, или еслиstart + countбольше длины данного массива, или еслиindexменьшеstartили больше чемstart + count, или еслиcodePointOffsetположительное и текстовый диапазон, начинающийся сindexи заканчивающийсяstart + count - 1, содержит меньше чемcodePointOffsetсимволов Unicode, или еслиcodePointOffsetотрицательное и текстовый диапазон, начинающийся сstartи заканчивающийсяindex - 1, содержит меньше чем абсолютное значениеcodePointOffsetсимволов Unicode. - Since:
- 1.5
isLowerCase
public static boolean isLowerCase(char ch)
Определяет, является ли указанный символ строчной буквой.
Символ является строчной буквой, если его тип общей категории, предоставленный Character.getType(ch), равен LOWERCASE_LETTER, или он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.
Вот примеры строчных букв:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
Примечание: Этот метод не может обрабатывать дополнительные символы. Чтобы поддерживать все символы Unicode, включая дополнительные, используйте метод isLowerCase(int).
- Parameters:
-
ch- проверяемый символ. - Returns:
-
trueесли символ является строчной буквой;falseв противном случае. - See Also:
-
isLowerCase(char),isTitleCase(char),toLowerCase(char),getType(char)
isLowerCase
public static boolean isLowerCase(int codePoint)
Определяет, является ли указанный символ (код Unicode) строчной буквой.
Символ является строчной буквой, если его тип общей категории, предоставленный getType(codePoint), равен LOWERCASE_LETTER, или он обладает дополнительным свойством Other_Lowercase, определённым стандартом Unicode.
Вот примеры строчных букв:
a b c d e f g h i j k l m n o p q r s t u v w x y z '\u00DF' '\u00E0' '\u00E1' '\u00E2' '\u00E3' '\u00E4' '\u00E5' '\u00E6' '\u00E7' '\u00E8' '\u00E9' '\u00EA' '\u00EB' '\u00EC' '\u00ED' '\u00EE' '\u00EF' '\u00F0' '\u00F1' '\u00F2' '\u00F3' '\u00F4' '\u00F5' '\u00F6' '\u00F8' '\u00F9' '\u00FA' '\u00FB' '\u00FC' '\u00FD' '\u00FE' '\u00FF'
Многие другие символы Unicode также являются строчными.
- Параметры:
-
codePoint- символ (код Юникода), который нужно проверить. - Возвращает:
-
true, если символ в нижнем регистре;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowerCase(int),isTitleCase(int),toLowerCase(int),getType(int)
isUpperCase
public static boolean isUpperCase(char ch)
Определяет, является ли указанный символ символом верхнего регистра.
Символ считается символом верхнего регистра, если его тип общей категории, предоставляемый Character.getType(ch), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Юникод.
Вот примеры символов верхнего регистра:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Юникода также являются символами верхнего регистра.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUpperCase(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
true, если символ в верхнем регистре;falseв противном случае. - С:
- 1.0
- См. также:
-
isLowerCase(char),isTitleCase(char),toUpperCase(char),getType(char)
isUpperCase
public static boolean isUpperCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) символом верхнего регистра.
Символ считается символом верхнего регистра, если его тип общей категории, предоставляемый getType(codePoint), равен UPPERCASE_LETTER, или он имеет дополнительное свойство Other_Uppercase, как определено в стандарте Юникод.
Вот примеры символов верхнего регистра:
A B C D E F G H I J K L M N O P Q R S T U V W X Y Z '\u00C0' '\u00C1' '\u00C2' '\u00C3' '\u00C4' '\u00C5' '\u00C6' '\u00C7' '\u00C8' '\u00C9' '\u00CA' '\u00CB' '\u00CC' '\u00CD' '\u00CE' '\u00CF' '\u00D0' '\u00D1' '\u00D2' '\u00D3' '\u00D4' '\u00D5' '\u00D6' '\u00D8' '\u00D9' '\u00DA' '\u00DB' '\u00DC' '\u00DD' '\u00DE'
Многие другие символы Юникода также являются символами верхнего регистра.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
true, если символ в верхнем регистре;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowerCase(int),isTitleCase(int),toUpperCase(int),getType(int)
isTitleCase
public static boolean isTitleCase(char ch)
Определяет, является ли указанный символ символом строчного регистра.
Символ считается символом строчного регистра, если его тип общей категории, предоставляемый Character.getType(ch), равен TITLECASE_LETTER.
Некоторые символы похожи на пары латинских букв. Например, есть прописная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", — это подходящая форма для отображения слова строчными буквами с прописными начальными буквами, например, для названия книги.
Вот некоторые символы Юникода, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Юникода также являются символами строчного регистра.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isTitleCase(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ в строчном регистре;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isLowerCase(char),isUpperCase(char),toTitleCase(char),getType(char)
isTitleCase
public static boolean isTitleCase(int codePoint)
Определяет, является ли указанный символ (код Юникода) символом строчного регистра.
Символ считается символом строчного регистра, если его тип общей категории, предоставляемый getType(codePoint), равен TITLECASE_LETTER.
Некоторые символы похожи на пары латинских букв. Например, есть прописная буква, похожая на "LJ", и соответствующая строчная буква, похожая на "lj". Третья форма, похожая на "Lj", — это подходящая форма для отображения слова строчными буквами с прописными начальными буквами, например, для названия книги.
Вот некоторые символы Юникода, для которых этот метод возвращает true:
-
LATIN CAPITAL LETTER D WITH SMALL LETTER Z WITH CARON -
LATIN CAPITAL LETTER L WITH SMALL LETTER J -
LATIN CAPITAL LETTER N WITH SMALL LETTER J -
LATIN CAPITAL LETTER D WITH SMALL LETTER Z
Многие другие символы Юникода также являются символами строчного регистра.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
true, если символ в строчном регистре;falseв противном случае. - С:
- 1.5
- См. также:
-
isLowerCase(int),isUpperCase(int),toTitleCase(int),getType(int)
isDigit
public static boolean isDigit(char ch)
Определяет, является ли указанный символ цифрой.
Символ считается цифрой, если его тип общей категории, предоставляемый Character.getType(ch), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', деванагари цифры -
'\uFF10'по'\uFF19', полноширинные цифры
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDigit(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - См. также:
-
digit(char, int),forDigit(int, int),getType(char)
isDigit
public static boolean isDigit(int codePoint)
Определяет, является ли указанный символ (код Юникода) цифрой.
Символ считается цифрой, если его тип общей категории, предоставляемый getType(codePoint), равен DECIMAL_DIGIT_NUMBER.
Некоторые диапазоны символов Юникода, содержащие цифры:
-
'\u0030'по'\u0039', цифры ISO-LATIN-1 ('0'по'9') -
'\u0660'по'\u0669', арабские цифры -
'\u06F0'по'\u06F9', расширенные арабские цифры -
'\u0966'по'\u096F', деванагари цифры -
'\uFF10'по'\uFF19', полноширинные цифры
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
true, если символ является цифрой;falseв противном случае. - С:
- 1.5
- См. также:
-
forDigit(int, int),getType(int)
isDefined
public static boolean isDefined(char ch)
Определяет, определен ли символ в Юникоде.
Символ определен, если выполняется хотя бы одно из следующих условий:
- У него есть запись в файле UnicodeData.
- Он имеет значение в диапазоне, определенном в файле UnicodeData.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isDefined(int).
- Параметры:
-
ch- символ для проверки - Возвращает:
-
true, если символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isDigit(char),isLetter(char),isLetterOrDigit(char),isLowerCase(char),isTitleCase(char),isUpperCase(char)
isDefined
public static boolean isDefined(int codePoint)
Определяет, определен ли символ (код Юникода) в Юникоде.
Символ определен, если выполняется хотя бы одно из следующих условий:
- У него есть запись в файле UnicodeData.
- Он имеет значение в диапазоне, определенном в файле UnicodeData.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
true, если символ имеет определенное значение в Юникоде;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isLetter(int),isLetterOrDigit(int),isLowerCase(int),isTitleCase(int),isUpperCase(int)
isLetter
public static boolean isLetter(char ch)
Определяет, является ли указанный символ буквой.
Символ считается буквой, если его тип общей категории, предоставленный Character.getType(ch), является одним из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
Примечание: Этот метод не поддерживает дополнительные символы. Чтобы поддержать все символы Юникода, включая дополнительные символы, используйте метод isLetter(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - См. также:
-
isDigit(char),isJavaIdentifierStart(char),isJavaLetter(char),isJavaLetterOrDigit(char),isLetterOrDigit(char),isLowerCase(char),isTitleCase(char),isUnicodeIdentifierStart(char),isUpperCase(char)
isLetter
public static boolean isLetter(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) буквой.
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), является одним из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
trueесли символ является буквой;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isJavaIdentifierStart(int),isLetterOrDigit(int),isLowerCase(int),isTitleCase(int),isUnicodeIdentifierStart(int),isUpperCase(int)
isLetterOrDigit
public static boolean isLetterOrDigit(char ch)
Определяет, является ли указанный символ буквой или цифрой.
Символ считается буквой или цифрой, если либо Character.isLetter(char ch) или Character.isDigit(char ch) возвращают true для символа.
Примечание: Этот метод не поддерживает дополнительные символы. Чтобы поддержать все символы Юникода, включая дополнительные символы, используйте метод isLetterOrDigit(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.0.2
- См. также:
-
isDigit(char),isJavaIdentifierPart(char),isJavaLetter(char),isJavaLetterOrDigit(char),isLetter(char),isUnicodeIdentifierPart(char)
isLetterOrDigit
public static boolean isLetterOrDigit(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) буквой или цифрой.
Символ считается буквой или цифрой, если либо isLetter(codePoint) или isDigit(codePoint) возвращают true для символа.
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
trueесли символ является буквой или цифрой;falseв противном случае. - С:
- 1.5
- См. также:
-
isDigit(int),isJavaIdentifierPart(int),isLetter(int),isUnicodeIdentifierPart(int)
isJavaLetter
@Deprecated public static boolean isJavaLetter(char ch)
Устаревший. Заменён на isJavaIdentifierStart(char).
Определяет, может ли указанный символ быть первым символом в идентификаторе Java.
Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом пунктуации соединения (например,'_').
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ может начинать идентификатор Java;falseв противном случае. - С:
- 1.02
- См. также:
-
isJavaLetterOrDigit(char),isJavaIdentifierStart(char),isJavaIdentifierPart(char),isLetter(char),isLetterOrDigit(char),isUnicodeIdentifierStart(char)
isJavaLetterOrDigit
@Deprecated public static boolean isJavaLetterOrDigit(char ch)
Устаревший. Заменён на isJavaIdentifierPart(char).
Определяет, может ли указанный символ быть частью идентификатора Java, кроме первого символа.
Символ может быть частью идентификатора Java, если и только если выполняется любое из следующих условий:
- он является буквой
- он является символом валюты (например,
'$') - он является символом пунктуации соединения (например,
'_') - он является цифрой
- он является буквой цифры (например, символ римского числа)
- он является комбинирующей меткой
- он является символом без пробела
-
isIdentifierIgnorableвозвращаетtrueдля символа.
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ может быть частью идентификатора Java;falseв противном случае. - С:
- 1.02
- См. также:
-
isJavaLetter(char),isJavaIdentifierStart(char),isJavaIdentifierPart(char),isLetter(char),isLetterOrDigit(char),isUnicodeIdentifierPart(char),isIdentifierIgnorable(char)
isAlphabetic
public static boolean isAlphabetic(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) буквой.
Символ считается буквой, если его тип общей категории, предоставленный getType(codePoint), является одним из следующих:
-
UPPERCASE_LETTER -
LOWERCASE_LETTER -
TITLECASE_LETTER -
MODIFIER_LETTER -
OTHER_LETTER -
LETTER_NUMBER
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
trueесли символ является буквой Юникода;falseв противном случае. - С:
- 1.7
isIdeographic
public static boolean isIdeographic(int codePoint)
Определяет, является ли указанный символ (код точки Юникода) идеограммой CJKV (китайский, японский, корейский и вьетнамский), как определено в стандарте Юникод.
- Параметры:
-
codePoint- символ (код точки Юникода) для проверки. - Возвращает:
-
trueесли символ является идеограммой Юникода;falseв противном случае. - С:
- 1.7
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(char ch)
Определяет, может ли указанный символ быть первым символом в идентификаторе Java.
Символ может начинать идентификатор Java, если и только если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER -
chявляется символом валюты (например,'$') -
chявляется символом пунктуации соединения (например,'_').
Примечание: Этот метод не поддерживает дополнительные символы. Чтобы поддержать все символы Юникода, включая дополнительные символы, используйте метод isJavaIdentifierStart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
true, если символ может начинать Java идентификатор;falseв противном случае. - С:
- 1.1
- См. также:
-
isJavaIdentifierPart(char),isLetter(char),isUnicodeIdentifierStart(char),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierStart
public static boolean isJavaIdentifierStart(int codePoint)
Определяет, является ли символ (код Юникода) допустимым первым символом в Java идентификаторе.
Символ может начинать Java идентификатор только в том случае, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER - ссылка на символ является символом валюты (например,
'$') - ссылка на символ является символом соединения (например,
'_').
- Параметры:
-
codePoint- символ (код Юникода), который нужно проверить. - Возвращает:
-
true, если символ может начинать Java идентификатор;falseв противном случае. - С:
- 1.5
- См. также:
-
isJavaIdentifierPart(int),isLetter(int),isUnicodeIdentifierStart(int),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью Java идентификатора, кроме первого символа.
Символ может быть частью Java идентификатора, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединения (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля символа
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isJavaIdentifierPart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
true, если символ может быть частью Java идентификатора;falseв противном случае. - С:
- 1.1
- См. также:
-
isIdentifierIgnorable(char),isJavaIdentifierStart(char),isLetterOrDigit(char),isUnicodeIdentifierPart(char),SourceVersion.isIdentifier(CharSequence)
isJavaIdentifierPart
public static boolean isJavaIdentifierPart(int codePoint)
Определяет, может ли символ (код Юникода) быть частью Java идентификатора, кроме первого символа.
Символ может быть частью Java идентификатора, если выполняется любое из следующих условий:
- это буква
- это символ валюты (например,
'$') - это символ соединения (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorable(codePoint)возвращаетtrueдля кода символа
- Параметры:
-
codePoint- символ (код Юникода), который нужно проверить. - Возвращает:
-
true, если символ может быть частью Java идентификатора;falseв противном случае. - С:
- 1.5
- См. также:
-
isIdentifierIgnorable(int),isJavaIdentifierStart(int),isLetterOrDigit(int),isUnicodeIdentifierPart(int),SourceVersion.isIdentifier(CharSequence)
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(char ch)
Определяет, является ли указанный символ допустимым первым символом в идентификаторе Юникода.
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
-
isLetter(ch)возвращаетtrue -
getType(ch)возвращаетLETTER_NUMBER.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierStart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - С:
- 1.1
- См. также:
-
isJavaIdentifierStart(char),isLetter(char),isUnicodeIdentifierPart(char)
isUnicodeIdentifierStart
public static boolean isUnicodeIdentifierStart(int codePoint)
Определяет, является ли указанный символ (код Юникода) допустимым первым символом в идентификаторе Юникода.
Символ может начинать идентификатор Юникода только в том случае, если выполняется одно из следующих условий:
-
isLetter(codePoint)возвращаетtrue -
getType(codePoint)возвращаетLETTER_NUMBER.
- Параметры:
-
codePoint- символ (код Юникода), который нужно проверить. - Возвращает:
-
true, если символ может начинать идентификатор Юникода;falseв противном случае. - С:
- 1.5
- См. также:
-
isJavaIdentifierStart(int),isLetter(int),isUnicodeIdentifierPart(int)
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(char ch)
Определяет, может ли указанный символ быть частью идентификатора Юникода, кроме первого символа.
Символ может быть частью идентификатора Юникода, если выполняется любое из следующих утверждений:
- это буква
- это символ соединения (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isUnicodeIdentifierPart(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - С:
- 1.1
- См. также:
-
isIdentifierIgnorable(char),isJavaIdentifierPart(char),isLetterOrDigit(char),isUnicodeIdentifierStart(char)
isUnicodeIdentifierPart
public static boolean isUnicodeIdentifierPart(int codePoint)
Определяет, может ли указанный символ (код Юникода) быть частью идентификатора Юникода, кроме первого символа.
Символ может быть частью идентификатора Юникода, если выполняется любое из следующих утверждений:
- это буква
- это символ соединения (например,
'_') - это цифра
- это числовая буква (например, символ римской цифры)
- это диакритический знак
- это неразрывный знак
-
isIdentifierIgnorableвозвращаетtrueдля этого символа.
- Параметры:
-
codePoint- символ (код Юникода), который нужно проверить. - Возвращает:
-
true, если символ может быть частью идентификатора Юникода;falseв противном случае. - С:
- 1.5
- См. также:
-
isIdentifierIgnorable(int),isJavaIdentifierPart(int),isLetterOrDigit(int),isUnicodeIdentifierStart(int)
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(char ch)
Определяет, должен ли указанный символ рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Unicode.
Следующие символы Unicode игнорируются в идентификаторе Java или идентификаторе Unicode:
- Символы управления ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, которые имеют значение общей категории
FORMAT
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isIdentifierIgnorable(int).
- Параметры:
-
ch- символ, который нужно проверить. - Возвращает:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode;falseв противном случае. - С:
- 1.1
- См. также:
-
isJavaIdentifierPart(char),isUnicodeIdentifierPart(char)
isIdentifierIgnorable
public static boolean isIdentifierIgnorable(int codePoint)
Определяет, должен ли указанный символ (код точки Unicode) рассматриваться как игнорируемый символ в идентификаторе Java или идентификаторе Unicode.
Следующие символы Unicode игнорируются в идентификаторе Java или идентификаторе Unicode:
- Символы управления ISO, которые не являются пробелами
-
'\u0000'по'\u0008' -
'\u000E'по'\u001B' -
'\u007F'по'\u009F'
-
- все символы, которые имеют значение общей категории
FORMAT
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно проверить. - Возвращает:
-
trueесли символ является игнорируемым управляющим символом, который может быть частью идентификатора Java или Unicode;falseв противном случае. - С:
- 1.5
- См. также:
-
isJavaIdentifierPart(int),isUnicodeIdentifierPart(int)
toLowerCase
public static char toLowerCase(char ch)
Преобразует символ аргумента в нижний регистр с использованием информации о сопоставлении регистров из файла UnicodeData.
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы сопоставления регистров имеют несколько преимуществ по сравнению с Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять сопоставления, зависящие от языка, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toLowerCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в нижнем регистре, если он есть; в противном случае, сам символ.
- См. также:
-
isLowerCase(char),String.toLowerCase()
toLowerCase
public static int toLowerCase(int codePoint)
Преобразует символ (код точки Unicode) аргумента в нижний регистр с использованием информации о сопоставлении регистров из файла UnicodeData.
Обратите внимание, что Character.isLowerCase(Character.toLowerCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toLowerCase() следует использовать для сопоставления символов в нижний регистр. String методы сопоставления регистров имеют несколько преимуществ по сравнению с Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять сопоставления, зависящие от языка, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров не могут.
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно преобразовать. - Возвращает:
- эквивалент символа в нижнем регистре (код точки Unicode), если он есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isLowerCase(int),String.toLowerCase()
toUpperCase
public static char toUpperCase(char ch)
Преобразует символ аргумента в верхний регистр с использованием информации о сопоставлении регистров из файла UnicodeData.
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(ch)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы сопоставления регистров имеют несколько преимуществ по сравнению с Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять сопоставления, зависящие от языка, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров не могут.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toUpperCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он есть; в противном случае, сам символ.
- См. также:
-
isUpperCase(char),String.toUpperCase()
toUpperCase
public static int toUpperCase(int codePoint)
Преобразует символ (код точки Unicode) аргумента в верхний регистр с использованием информации о сопоставлении регистров из файла UnicodeData.
Обратите внимание, что Character.isUpperCase(Character.toUpperCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов, особенно для символов или идеограмм.
В общем случае, String.toUpperCase() следует использовать для сопоставления символов в верхний регистр. String методы сопоставления регистров имеют несколько преимуществ по сравнению с Character методами сопоставления регистров. String методы сопоставления регистров могут выполнять сопоставления, зависящие от языка, контекстно-зависимые сопоставления и сопоставления символов 1:М, тогда как Character методы сопоставления регистров не могут.
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно преобразовать. - Возвращает:
- эквивалент символа в верхнем регистре, если он есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isUpperCase(int),String.toUpperCase()
toTitleCase
public static char toTitleCase(char ch)
Преобразует символ аргумента в заглавный регистр с использованием информации о сопоставлении регистров из файла UnicodeData. Если у символа нет явного сопоставления в заглавном регистре и он сам по себе не является символом заглавного регистра согласно UnicodeData, то возвращается сопоставление в верхнем регистре в качестве эквивалента сопоставления в заглавном регистре. Если символ аргумента уже является символом заглавного регистра, то будет возвращено то же самое значение символа.
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(ch)) не всегда возвращает true для некоторых диапазонов символов.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод toTitleCase(int).
- Параметры:
-
ch- символ, который нужно преобразовать. - Возвращает:
- эквивалент символа в заглавном регистре, если он есть; в противном случае, сам символ.
- С:
- 1.0.2
- См. также:
-
isTitleCase(char),toLowerCase(char),toUpperCase(char)
toTitleCase
public static int toTitleCase(int codePoint)
Преобразует символ (код точки Unicode) аргумента в заглавный регистр с использованием информации о сопоставлении регистров из файла UnicodeData. Если у символа нет явного сопоставления в заглавном регистре и он сам по себе не является символом заглавного регистра согласно UnicodeData, то возвращается сопоставление в верхнем регистре в качестве эквивалента сопоставления в заглавном регистре. Если символ аргумента уже является символом заглавного регистра, то будет возвращено то же самое значение символа.
Обратите внимание, что Character.isTitleCase(Character.toTitleCase(codePoint)) не всегда возвращает true для некоторых диапазонов символов.
- Параметры:
-
codePoint- символ (код точки Unicode), который нужно преобразовать. - Возвращает:
- эквивалент символа в заглавном регистре, если он есть; в противном случае, сам символ.
- С:
- 1.5
- См. также:
-
isTitleCase(int),toLowerCase(int),toUpperCase(int)
digit
public static int digit(char ch,
int radix) Возвращает числовое значение символа ch в указанном радиксе.
Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если значение ch не является допустимой цифрой в указанном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:
- Метод
isDigitявляетсяtrueсимвола, и десятичное значение цифры Unicode символа (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв
'A'по'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяch - 'A' + 10. - Символ является одной из строчных латинских букв
'a'по'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяch - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате A (
'\uFF21') по Z ('\uFF3A') и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяch - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате a (
'\uFF41') по z ('\uFF5A') и его код меньшеradix + '\uFF41' - 10. В этом случае возвращаетсяch - '\uFF41' + 10.
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод digit(int, int).
- Параметры:
-
ch- символ для преобразования. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- См. также:
-
forDigit(int, int),isDigit(char)
digit
public static int digit(int codePoint,
int radix) Возвращает числовое значение указанного символа (кодовой точки Unicode) в заданном радиксе.
Если радикс не находится в диапазоне MIN_RADIX ≤ radix ≤ MAX_RADIX или если символ не является допустимой цифрой в заданном радиксе, возвращается -1. Символ является допустимой цифрой, если хотя бы одно из следующих условий истинно:
- Метод
isDigit(codePoint)являетсяtrueсимвола, и десятичное значение цифры Unicode символа (или его односимвольного разложения) меньше указанного радикса. В этом случае возвращается десятичное значение цифры. - Символ является одной из заглавных латинских букв
'A'по'Z', и его код меньшеradix + 'A' - 10. В этом случае возвращаетсяcodePoint - 'A' + 10. - Символ является одной из строчных латинских букв
'a'по'z', и его код меньшеradix + 'a' - 10. В этом случае возвращаетсяcodePoint - 'a' + 10. - Символ является одной из заглавных латинских букв в полном формате A (
'\uFF21') по Z ('\uFF3A') и его код меньшеradix + '\uFF21' - 10. В этом случае возвращаетсяcodePoint - '\uFF21' + 10. - Символ является одной из строчных латинских букв в полном формате a (
'\uFF41') по z ('\uFF5A') и его код меньшеradix + '\uFF41'- 10. В этом случае возвращаетсяcodePoint - '\uFF41' + 10.
- Параметры:
-
codePoint- символ (кодовая точка Unicode) для преобразования. -
radix- радикс. - Возвращает:
- числовое значение, представленное символом в указанном радиксе.
- С:
- 1.5
- См. также:
-
forDigit(int, int),isDigit(int)
getNumericValue
public static int getNumericValue(char ch)
Возвращает числовое значение, которое представляет указанный символ Unicode. Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.
Буквы A-Z в их прописных ('\u0041' по '\u005A'), строчных ('\u0061' по '\u007A') и полных форматах ('\uFF21' по '\uFF3A' и '\uFF41' по '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Unicode, которая не присваивает числовые значения этим char значениям.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getNumericValue(int).
- Параметры:
-
ch- символ для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное
intзначение; -2, если символ имеет числовое значение, которое не является неотрицательным целым числом; -1, если символ не имеет числового значения. - С:
- 1.1
- См. также:
-
forDigit(int, int),isDigit(char)
getNumericValue
public static int getNumericValue(int codePoint)
Возвращает числовое значение, которое представляет указанный символ (кодовая точка Unicode). Например, символ '\u216C' (римская цифра пятьдесят) вернёт целое число со значением 50.
Буквы A-Z в их прописных ('\u0041' по '\u005A'), строчных ('\u0061' по '\u007A') и полных форматах ('\uFF21' по '\uFF3A' и '\uFF41' по '\uFF5A') имеют числовые значения от 10 до 35. Это независимо от спецификации Unicode, которая не присваивает числовые значения этим char значениям.
Если символ не имеет числового значения, возвращается -1. Если символ имеет числовое значение, которое не может быть представлено как неотрицательное целое число (например, дробное значение), возвращается -2.
- Параметры:
-
codePoint- символ (кодовая точка Unicode) для преобразования. - Возвращает:
- числовое значение символа, как неотрицательное
intзначение; -2, если символ имеет числовое значение, которое не является неотрицательным целым числом; -1, если символ не имеет числового значения. - С:
- 1.5
- См. также:
-
forDigit(int, int),isDigit(int)
isSpace
@Deprecated public static boolean isSpace(char ch)
Устарело. Заменено на isWhitespace(char).
Определяет, является ли указанный символ пробелом ISO-LATIN-1. Этот метод возвращает true только для следующих пяти символов:
'\t' | U+0009 | HORIZONTAL TABULATION |
'\n' | U+000A | NEW LINE |
'\f' | U+000C | FORM FEED |
'\r' | U+000D | CARRIAGE RETURN |
' ' | U+0020 | SPACE |
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является пробелом ISO-LATIN-1;falseв противном случае. - См. также:
-
isSpaceChar(char),isWhitespace(char)
isSpaceChar
public static boolean isSpaceChar(char ch)
Определяет, является ли указанный символ символом пробела Unicode. Символ считается символом пробела только в том случае, если он определён как символ пробела в стандарте Unicode. Этот метод возвращает true, если тип общей категории символа является одним из следующих:
-
SPACE_SEPARATOR -
LINE_SEPARATOR -
PARAGRAPH_SEPARATOR
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isSpaceChar(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
true, если символ является символом пробела;falseв противном случае. - С:
- 1.1
- См. также:
isWhitespace(char)
isSpaceChar
public static boolean isSpaceChar(int codePoint)
Определяет, является ли указанный символ (кодовая точка Unicode) символом пробела Unicode. Символ считается символом пробела только в том случае, если он определён как символ пробела в стандарте Unicode. Этот метод возвращает true, если тип общей категории символа является одним из следующих:
- Параметры:
-
codePoint- символ (кодовая точка Unicode) для проверки. - Возвращает:
-
true, если символ является символом пробела;falseв противном случае. - С:
- 1.5
- См. также:
isWhitespace(int)
isWhitespace
public static boolean isWhitespace(char ch)
Определяет, является ли указанный символ пробелом в соответствии с Java. Символ является символом пробела Java, если и только если он удовлетворяет одному из следующих критериев:
- Он является символом Unicode-пробела (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isWhitespace(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является символом пробела Java;falseв противном случае. - С:
- 1.1
- См. также:
isSpaceChar(char)
isWhitespace
public static boolean isWhitespace(int codePoint)
Определяет, является ли указанный символ (код Unicode) пробелом в соответствии с Java. Символ является символом пробела Java, если и только если он удовлетворяет одному из следующих критериев:
- Он является символом Unicode-пробела (
SPACE_SEPARATOR,LINE_SEPARATOR, илиPARAGRAPH_SEPARATOR) но не является также неразрывным пробелом ('\u00A0','\u2007','\u202F'). - Он равен
'\t', U+0009 ГОРИЗОНТАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\n', U+000A ПЕРЕВОД СТРОКИ. - Он равен
'\u000B', U+000B ВЕРТИКАЛЬНАЯ ТАБУЛЯЦИЯ. - Он равен
'\f', U+000C ПЕРЕВОД СТРАНИЦЫ. - Он равен
'\r', U+000D ВОЗВРАТ КАРЕТКИ. - Он равен
'\u001C', U+001C РАЗДЕЛИТЕЛЬ ФАЙЛОВ. - Он равен
'\u001D', U+001D РАЗДЕЛИТЕЛЬ ГРУПП. - Он равен
'\u001E', U+001E РАЗДЕЛИТЕЛЬ ЗАПИСЕЙ. - Он равен
'\u001F', U+001F РАЗДЕЛИТЕЛЬ ЕДИНИЦ.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
-
trueесли символ является символом пробела Java;falseв противном случае. - С:
- 1.5
- См. также:
isSpaceChar(int)
isISOControl
public static boolean isISOControl(char ch)
Определяет, является ли указанный символ управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод isISOControl(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
-
trueесли символ является управляющим символом ISO;falseв противном случае. - С:
- 1.1
- См. также:
-
isSpaceChar(char),isWhitespace(char)
isISOControl
public static boolean isISOControl(int codePoint)
Определяет, является ли указанный символ (код Unicode) управляющим символом ISO. Символ считается управляющим символом ISO, если его код находится в диапазоне '\u0000' по '\u001F' или в диапазоне '\u007F' по '\u009F'.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
-
trueесли символ является управляющим символом ISO;falseв противном случае. - С:
- 1.5
- См. также:
-
isSpaceChar(int),isWhitespace(int)
getType
public static int getType(char ch)
Возвращает значение, указывающее общую категорию символа.
Примечание: Данный метод не может обрабатывать дополнительные символы. Для поддержки всех символов Unicode, включая дополнительные символы, используйте метод getType(int).
- Параметры:
-
ch- символ для проверки. - Возвращает:
- значение типа
int, представляющее общую категорию символа. - С:
- 1.1
- См. также:
-
COMBINING_SPACING_MARK,CONNECTOR_PUNCTUATION,CONTROL,CURRENCY_SYMBOL,DASH_PUNCTUATION,DECIMAL_DIGIT_NUMBER,ENCLOSING_MARK,END_PUNCTUATION,FINAL_QUOTE_PUNCTUATION,FORMAT,INITIAL_QUOTE_PUNCTUATION,LETTER_NUMBER,LINE_SEPARATOR,LOWERCASE_LETTER,MATH_SYMBOL,MODIFIER_LETTER,MODIFIER_SYMBOL,NON_SPACING_MARK,OTHER_LETTER,OTHER_NUMBER,OTHER_PUNCTUATION,OTHER_SYMBOL,PARAGRAPH_SEPARATOR,PRIVATE_USE,SPACE_SEPARATOR,START_PUNCTUATION,SURROGATE,TITLECASE_LETTER,UNASSIGNED,UPPERCASE_LETTER
getType
public static int getType(int codePoint)
Возвращает значение, указывающее общую категорию символа.
- Параметры:
-
codePoint- символ (код Unicode) для проверки. - Возвращает:
- значение типа
intпредставляющее общую категорию символа. - С:
- 1.5
- См. также:
-
COMBINING_SPACING_MARK,CONNECTOR_PUNCTUATION,CONTROL,CURRENCY_SYMBOL,DASH_PUNCTUATION,DECIMAL_DIGIT_NUMBER,ENCLOSING_MARK,END_PUNCTUATION,FINAL_QUOTE_PUNCTUATION,FORMAT,INITIAL_QUOTE_PUNCTUATION,LETTER_NUMBER,LINE_SEPARATOR,LOWERCASE_LETTER,MATH_SYMBOL,MODIFIER_LETTER,MODIFIER_SYMBOL,NON_SPACING_MARK,OTHER_LETTER,OTHER_NUMBER,OTHER_PUNCTUATION,OTHER_SYMBOL,PARAGRAPH_SEPARATOR,PRIVATE_USE,SPACE_SEPARATOR,START_PUNCTUATION,SURROGATE,TITLECASE_LETTER,UNASSIGNED,UPPERCASE_LETTER
forDigit
public static char forDigit(int digit,
int radix) Определяет символьное представление заданной цифры в заданной системе счисления. Если значение radix не является допустимой системой счисления, или значение digit не является допустимой цифрой в заданной системе счисления, возвращается нулевой символ ('\u0000').
Аргумент radix допустим, если он больше или равен MIN_RADIX и меньше или равен MAX_RADIX. Аргумент digit допустим, если 0 <= digit < radix.
Если цифра меньше 10, возвращается '0' + digit. В противном случае, возвращается значение 'a' + digit - 10.
- Параметры:
-
digit- число для преобразования в символ. -
radix- система счисления. - Возвращает:
- символьное представление заданной цифры в заданной системе счисления.
- См. также:
-
MIN_RADIX,MAX_RADIX,digit(char, int)
getDirectionality
public static byte getDirectionality(char ch)
Возвращает свойство направленности Юникода для данного символа. Направленность символа используется для расчета визуального порядка текста. Значение направленности для неопределённых char значений равно DIRECTIONALITY_UNDEFINED.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод getDirectionality(int).
- Параметры:
-
ch-char, для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности значения
char. - С:
- 1.4
- См. также:
-
DIRECTIONALITY_UNDEFINED,DIRECTIONALITY_LEFT_TO_RIGHT,DIRECTIONALITY_RIGHT_TO_LEFT,DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC,DIRECTIONALITY_EUROPEAN_NUMBER,DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR,DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR,DIRECTIONALITY_ARABIC_NUMBER,DIRECTIONALITY_COMMON_NUMBER_SEPARATOR,DIRECTIONALITY_NONSPACING_MARK,DIRECTIONALITY_BOUNDARY_NEUTRAL,DIRECTIONALITY_PARAGRAPH_SEPARATOR,DIRECTIONALITY_SEGMENT_SEPARATOR,DIRECTIONALITY_WHITESPACE,DIRECTIONALITY_OTHER_NEUTRALS,DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING,DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE,DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING,DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE,DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
getDirectionality
public static byte getDirectionality(int codePoint)
Возвращает свойство направленности Юникода для данного символа (кода Юникода). Направленность символа используется для расчета визуального порядка текста. Значение направленности для неопределённого символа равно DIRECTIONALITY_UNDEFINED.
- Параметры:
-
codePoint- символ (код Юникода), для которого запрашивается свойство направленности. - Возвращает:
- свойство направленности символа.
- С:
- 1.5
- См. также:
-
DIRECTIONALITY_UNDEFINED,DIRECTIONALITY_LEFT_TO_RIGHT,DIRECTIONALITY_RIGHT_TO_LEFT,DIRECTIONALITY_RIGHT_TO_LEFT_ARABIC,DIRECTIONALITY_EUROPEAN_NUMBER,DIRECTIONALITY_EUROPEAN_NUMBER_SEPARATOR,DIRECTIONALITY_EUROPEAN_NUMBER_TERMINATOR,DIRECTIONALITY_ARABIC_NUMBER,DIRECTIONALITY_COMMON_NUMBER_SEPARATOR,DIRECTIONALITY_NONSPACING_MARK,DIRECTIONALITY_BOUNDARY_NEUTRAL,DIRECTIONALITY_PARAGRAPH_SEPARATOR,DIRECTIONALITY_SEGMENT_SEPARATOR,DIRECTIONALITY_WHITESPACE,DIRECTIONALITY_OTHER_NEUTRALS,DIRECTIONALITY_LEFT_TO_RIGHT_EMBEDDING,DIRECTIONALITY_LEFT_TO_RIGHT_OVERRIDE,DIRECTIONALITY_RIGHT_TO_LEFT_EMBEDDING,DIRECTIONALITY_RIGHT_TO_LEFT_OVERRIDE,DIRECTIONALITY_POP_DIRECTIONAL_FORMAT
isMirrored
public static boolean isMirrored(char ch)
Определяет, является ли символ зеркальным в соответствии со спецификацией Юникода. Зеркальные символы должны иметь свои глифы, отражённые по горизонтали, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА семантически определена как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.
Примечание: Этот метод не может обрабатывать дополнительные символы. Для поддержки всех символов Юникода, включая дополнительные символы, используйте метод isMirrored(int).
- Параметры:
-
ch-char, для которого запрашивается свойство зеркальности. - Возвращает:
-
true, если символ зеркальный,false, если символ не зеркальный или не определён. - С:
- 1.4
isMirrored
public static boolean isMirrored(int codePoint)
Определяет, является ли указанный символ (код Юникода) зеркальным в соответствии со спецификацией Юникода. Зеркальные символы должны иметь свои глифы, отражённые по горизонтали, при отображении в тексте справа налево. Например, '\u0028' ЛЕВАЯ СКОБКА семантически определена как открывающая скобка. Это будет отображаться как "(" в тексте слева направо, но как ")" в тексте справа налево.
- Параметры:
-
codePoint- символ (код Юникода) для проверки. - Возвращает:
-
true, если символ зеркальный,false, если символ не зеркальный или не определён. - С:
- 1.5
compareTo
public int compareTo(Character anotherCharacter)
Сравнивает два объекта Character численно.
- Определено в:
-
compareToв интерфейсеComparable<Character> - Параметры:
-
anotherCharacter- объектCharacterдля сравнения. - Возвращает:
- значение
0если аргументCharacterравен этому объектуCharacter; значение меньше0если этот объектCharacterчисленно меньше аргументаCharacter; и значение больше0если этот объектCharacterчисленно больше аргументаCharacter. (Без учёта локали). - С:
- 1.2
compare
public static int compare(char x,
char y) Сравнивает два значения char численно. Возвращаемое значение идентично тому, что вернул бы:
Character.valueOf(x).compareTo(Character.valueOf(y))
- Параметры:
-
x- первое значениеcharдля сравнения -
y- второе значениеcharдля сравнения - Возвращает:
- значение
0еслиx == y; значение меньше0еслиx < y; и значение больше0еслиx > y - С:
- 1.7
reverseBytes
public static char reverseBytes(char ch)
Возвращает значение, полученное путём перестановки порядка байтов в указанном значении char.
- Параметры:
-
ch- Значениеchar, для которого необходимо переставить порядок байтов. - Возвращает:
- значение, полученное путём перестановки (или, эквивалентно, перестановкой) байтов в указанном значении
char. - С:
- 1.5
getName
public static String getName(int codePoint)
Возвращает имя Unicode указанного символа codePoint, или null, если код символа равен unassigned.
Примечание: если указанному символу не присвоено имя в файле UnicodeData (части базы данных символов Юникода, поддерживаемой консорциумом Unicode), возвращаемое имя совпадает с результатом выражения.
Character.UnicodeBlock.of(codePoint).toString().replace('_', ' ') + " " + Integer.toHexString(codePoint).toUpperCase(Locale.ENGLISH);
- Параметры:
-
codePoint- символ (код Юникода) - Возвращает:
- имя символа Unicode, или null, если код символа не назначен.
- Выбрасывает:
-
IllegalArgumentException- если указанныйcodePointне является допустимым кодом символа Юникода. - С:
- 1.7
© 1993, 2020, Oracle and/or its affiliates. All rights reserved.
Documentation extracted from Debian's OpenJDK Development Kit package.
Licensed under the GNU General Public License, version 2, with the Classpath Exception.
Various third party code in OpenJDK is licensed under different licenses (see Debian package).
Java and OpenJDK are trademarks or registered trademarks of Oracle and/or its affiliates.