Модуль: tf.keras.preprocessing.text
Утилиты для предобработки текстового ввода.
Классы
class Tokenizer: Класс утилиты для токенизации текста.
Функции
hashing_trick(...): Преобразует текст в последовательность индексов в пространстве хэширования фиксированного размера.
one_hot(...): Преобразует текст в one-hot представление в список индексов слов размера n.
text_to_word_sequence(...): Преобразует текст в последовательность слов (или токенов).
tokenizer_from_json(...): Парсит конфигурацию токенизатора в формате JSON и возвращает экземпляр токенизатора.
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/keras/preprocessing/text