Модуль: tf.keras.preprocessing.text
Утилиты для предварительной обработки текстового ввода.
Классы
class Tokenizer: Утилита для токенизации текста.
Функции
hashing_trick(...): Преобразует текст в последовательность индексов в фиксированном хэширующем пространстве.
one_hot(...): Преобразует текст в одну горячую кодировку в список индексов слов размера n.
text_to_word_sequence(...): Преобразует текст в последовательность слов (или токенов).
tokenizer_from_json(...): Парсит файл конфигурации токенизатора JSON и возвращает
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/keras/preprocessing/text