tf.keras.datasets.reuters.get_word_index
Получает словарь, сопоставляющий слова их индексам в наборе данных Reuters.
tf.keras.datasets.reuters.get_word_index(
path='reuters_word_index.json'
)
Фактические индексы слов начинаются с 3, при этом 3 индекса зарезервированы для: 0 (заполнение), 1 (начало), 2 (oov).
Например, индекс слова «the» равен 1, но в фактических обучающих данных индекс «the» будет 1 + 3 = 4. И наоборот, чтобы перевести индексы слов в обучающих данных обратно в слова с помощью этого отображения, от индексов необходимо вычесть 3.
| Аргументы | |
|---|---|
path | место кэширования данных (относительно ~/.keras/dataset). |
| Возвращаемое значение | |
|---|---|
| Словарь индексов слов. Ключи — строки слов, значения — их индексы. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/api_docs/python/tf/keras/datasets/reuters/get_word_index