Модуль: tf.compat.v1.keras.preprocessing.text
Утилиты для предобработки текстового ввода.
Классы
class Tokenizer: Утилитарный класс для токенизации текста.
Функции
hashing_trick(...): Преобразует текст в последовательность индексов в пространстве хеширования фиксированного размера.
one_hot(...): Преобразует текст в одну-горячую кодировку в список индексов слов размера n.
text_to_word_sequence(...): Преобразует текст в последовательность слов (или токенов).
tokenizer_from_json(...): Разбирает файл конфигурации токенизатора JSON и возвращает
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/compat/v1/keras/preprocessing/text