Spec-Zone.ru › TensorFlow 2.9

Модуль: tf.keras.preprocessing.text

Утилиты для предобработки текстового ввода.

Устарело: tf.keras.preprocessing.text API не рекомендуются для нового кода. Предпочитайте tf.keras.utils.text_dataset_from_directory и tf.keras.layers.TextVectorization, которые обеспечивают более эффективный подход к предобработке текстового ввода. Для ознакомления с этими API см. учебник по загрузке текста и руководство по слоям предобработки.

Классы

class Tokenizer: Класс утилиты для токенизации текста.

Функции

hashing_trick(...): Преобразует текст в последовательность индексов в пространстве хэширования фиксированного размера.

one_hot(...): Преобразует текст в one-hot представление в список индексов слов размера n.

text_to_word_sequence(...): Преобразует текст в последовательность слов (или токенов).

tokenizer_from_json(...): Парсит конфигурацию токенизатора в формате JSON и возвращает экземпляр токенизатора.

© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/keras/preprocessing/text

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API