Модуль: tf.keras.preprocessing.text
Утилиты для предобработки текстового ввода.
Классы
class Tokenizer: Класс утилиты для токенизации текста.
Функции
hashing_trick(...): Преобразует текст в последовательность индексов в пространстве хэширования фиксированного размера.
one_hot(...): Преобразует текст в однобитовое кодирование в список индексов слов размером n.
text_to_word_sequence(...): Преобразует текст в последовательность слов (или токенов).
tokenizer_from_json(...): Парсит файл конфигурации токенизатора JSON и возвращает
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/keras/preprocessing/text