Spec-Zone.ru › TensorFlow 1.15

tf.contrib.lookup.index_to_string_table_from_file

Возвращает таблицу поиска, которая отображает Tensor индексов в строки.

tf.contrib.lookup.index_to_string_table_from_file(
    vocabulary_file, vocab_size=None, default_value='UNK', name=None,
    key_column_index=TextFileIndex.LINE_NUMBER,
    value_column_index=TextFileIndex.WHOLE_LINE, delimiter='\t'
)

Эта операция создаёт таблицу поиска для отображения индексов int64 в строковые значения. Таблица инициализируется из файла словаря, указанного в vocabulary_file, где вся строка является значением, а нулевой индекс строки — индексом.

Любой вход, у которого нет соответствующего индекса в файле словаря (вход вне словаря), получает значение default_value

Базовая таблица должна быть инициализирована вызовом session.run(tf.compat.v1.tables_initializer()) или session.run(table.init()) один раз.

Для указания файлов словаря с несколькими столбцами используйте key_column_index и value_column_index и разделитель.

  • TextFileIndex.LINE_NUMBER означает использовать номер строки, начиная с нуля, ожидает тип данных int64.
  • TextFileIndex.WHOLE_LINE означает использовать содержимое всей строки, ожидает тип данных string.
  • Значение >=0 означает использовать индекс (начиная с нуля) разделителя строки на основе delimiter.

Примеры использования:

Если у нас есть файл словаря "test.txt" со следующим содержимым:

emerson
lake
palmer
indices = tf.constant([1, 5], tf.int64)
table = tf.lookup.index_to_string_table_from_file(
    vocabulary_file="test.txt", default_value="UNKNOWN")
values = table.lookup(indices)
...
tf.compat.v1.tables_initializer().run()

values.eval() ==> ["lake", "UNKNOWN"]
Аргументы
vocabulary_file Имя файла словаря, может быть скалярной константой Tensor.
vocab_size Количество элементов в словаре, если известно.
default_value Значение для индексов вне словаря.
name Имя этой операции (необязательно).
key_column_index Индекс столбца из текстового файла для получения key значений. По умолчанию используется номер строки, начиная с нуля.
value_column_index Индекс столбца из текстового файла для получения value значений. По умолчанию используется содержимое всей строки.
delimiter Разделитель для разделения полей в строке.
Возвращаемое значение
Таблица поиска для отображения строковых значений, связанных с заданным индексом int64 Tensors.
Исключения
ValueError когда vocabulary_file пуст.
ValueError когда vocab_size некорректен.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/contrib/lookup/index_to_string_table_from_file

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API