tf.strings.unicode_script
Определяет коды скриптов заданного тензора кодовых точек Unicode.
tf.strings.unicode_script(
input: Annotated[Any, _atypes.Int32], name=None
) -> Annotated[Any, _atypes.Int32]
Используется в блокнотах
| Используется в руководстве |
|---|
Эта операция преобразует кодовые точки Unicode в коды скриптов, соответствующие каждой кодовой точке. Коды скриптов соответствуют значениям UScriptCode из International Components for Unicode (ICU).
См. документацию проекта ICU для получения дополнительной информации о кодах скриптов.
Для примера см. руководство по строкам Unicode на странице о скриптах Unicode.
Возвращает -1 (USCRIPT_INVALID_CODE) для недопустимых кодовых точек. Формат выходных данных будет соответствовать входному формату.
Примеры:
tf.strings.unicode_script([1, 31, 38]) <tf.Tensor: shape=(3,), dtype=int32, numpy=array([0, 0, 0], dtype=int32)>
| Аргументы | |
|---|---|
input | A Tensor типа int32. Тензор целочисленных кодовых точек Unicode типа int32. |
name | Имя операции (необязательно). |
| Возвращаемые значения | |
|---|---|
A Tensor типа int32. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/api_docs/python/tf/strings/unicode_script