Spec-Zone.ru › TensorFlow 1.15

tf.lookup.StaticVocabularyTable

Просмотреть исходный код на GitHub

Оборачивает таблицу преобразования строка-в-ID, которая назначает ключи вне словаря в ведра.

Наследуется от: StaticVocabularyTable

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения более подробной информации.

tf.compat.v1.lookup.StaticVocabularyTable

tf.lookup.StaticVocabularyTable(
    initializer, num_oov_buckets, lookup_key_dtype=None, name=None
)

Например, если экземпляр StaticVocabularyTable инициализирован с инициализатором строка-в-ID, который отображает:

  • emerson -> 0
  • lake -> 1
  • palmer -> 2

Объект Vocabulary выполнит следующее отображение:

  • emerson -> 0
  • lake -> 1
  • palmer -> 2
  • <other term> -> bucket_id, где идентификатор ведра будет находиться между 3 и 3 + num_oov_buckets - 1, вычисленный по формуле: hash(<term>) % num_oov_buckets + vocab_size

Если input_tensor — ["emerson", "lake", "palmer", "king", "crimson"], результат поиска — [0, 1, 2, 4, 7].

Если initializer равно None, используются только ведра вне словаря.

Пример использования:

num_oov_buckets = 3
input_tensor = tf.constant(["emerson", "lake", "palmer", "king", "crimnson"])
table = tf.lookup.StaticVocabularyTable(
    tf.TextFileIdTableInitializer(filename), num_oov_buckets)
out = table.lookup(input_tensor).
table.init.run()
print(out.eval())

Функция хэширования для генерации идентификаторов ведер вне словаря — Fingerprint64.

Аргументы
initializer Объект TableInitializerBase, содержащий данные, используемые для инициализации таблицы. Если None, то используются только ведра вне словаря.
num_oov_buckets Количество ведер для ключей вне словаря. Должно быть больше нуля.
lookup_key_dtype Тип данных ключей, передаваемых в lookup. По умолчанию initializer.key_dtype, если initializer указан, в противном случае tf.string. Должно быть строкой или целым числом и приводимым к типу initializer.key_dtype.
name Имя операции (необязательно).
Исключения
ValueError при num_oov_buckets не положительно.
TypeError при lookup_key_dtype или initializer.key_dtype не являются целыми числами или строками. Также, если initializer.value_dtype != int64.
Атрибуты
initializer
key_dtype Тип данных ключа таблицы.
name Имя таблицы.
resource_handle Возвращает дескриптор ресурса, связанный с этим ресурсом.
value_dtype Тип данных значений таблицы.

Методы

lookup

Просмотреть исходный код

lookup(
    keys, name=None
)

Ищет keys в таблице, возвращает соответствующие значения.

Ключи вне словаря назначаются ведрам на основе их хэшей.

Аргументы
keys Ключи для поиска. Может быть либо SparseTensor, либо плотной Tensor.
name Необязательное имя для операции.
Возвращаемое значение
SparseTensor, если ключи разреженные, в противном случае плотная Tensor.
Исключения
TypeError при keys не соответствует типу данных ключа таблицы.

size

Просмотреть исходный код

size(
    name=None
)

Вычисляет количество элементов в этой таблице.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/lookup/StaticVocabularyTable

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API