tf.contrib.lookup.index_to_string_table_from_file
Возвращает таблицу поиска, которая отображает Tensor индексов в строки.
tf.contrib.lookup.index_to_string_table_from_file(
vocabulary_file, vocab_size=None, default_value='UNK', name=None,
key_column_index=TextFileIndex.LINE_NUMBER,
value_column_index=TextFileIndex.WHOLE_LINE, delimiter='\t'
)
Эта операция создаёт таблицу поиска для отображения индексов int64 в строковые значения. Таблица инициализируется из файла словаря, указанного в vocabulary_file, где вся строка является значением, а нулевой индекс строки — индексом.
Любой вход, у которого нет соответствующего индекса в файле словаря (вход вне словаря), получает значение default_value
Базовая таблица должна быть инициализирована вызовом session.run(tf.compat.v1.tables_initializer()) или session.run(table.init()) один раз.
Для указания файлов словаря с несколькими столбцами используйте key_column_index и value_column_index и разделитель.
- TextFileIndex.LINE_NUMBER означает использовать номер строки, начиная с нуля, ожидает тип данных int64.
- TextFileIndex.WHOLE_LINE означает использовать содержимое всей строки, ожидает тип данных string.
- Значение >=0 означает использовать индекс (начиная с нуля) разделителя строки на основе
delimiter.
Примеры использования:
Если у нас есть файл словаря "test.txt" со следующим содержимым:
emerson lake palmer
indices = tf.constant([1, 5], tf.int64)
table = tf.lookup.index_to_string_table_from_file(
vocabulary_file="test.txt", default_value="UNKNOWN")
values = table.lookup(indices)
...
tf.compat.v1.tables_initializer().run()
values.eval() ==> ["lake", "UNKNOWN"]
| Аргументы | |
|---|---|
vocabulary_file | Имя файла словаря, может быть скалярной константой Tensor. |
vocab_size | Количество элементов в словаре, если известно. |
default_value | Значение для индексов вне словаря. |
name | Имя этой операции (необязательно). |
key_column_index | Индекс столбца из текстового файла для получения key значений. По умолчанию используется номер строки, начиная с нуля. |
value_column_index | Индекс столбца из текстового файла для получения value значений. По умолчанию используется содержимое всей строки. |
delimiter | Разделитель для разделения полей в строке. |
| Возвращаемое значение | |
|---|---|
Таблица поиска для отображения строковых значений, связанных с заданным индексом int64 Tensors. |
| Исключения | |
|---|---|
ValueError | когда vocabulary_file пуст. |
ValueError | когда vocab_size некорректен. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/contrib/lookup/index_to_string_table_from_file