tf.data.experimental.table_from_dataset
Возвращает таблицу поиска, основанную на заданном наборе данных.
tf.data.experimental.table_from_dataset(
dataset=None,
num_oov_buckets=0,
vocab_size=None,
default_value=None,
hasher_spec=lookup_ops.FastHashSpec,
key_dtype=tf.dtypes.string,
name=None
)
Эта операция строит таблицу поиска на основе заданного набора данных пар (ключ, значение).
Любой поиск токена вне словаря вернёт идентификатор корзины, основанный на его хэше, если num_oov_buckets больше нуля. В противном случае ему назначается default_value. Диапазон идентификаторов корзины [vocabulary size, vocabulary size + num_oov_buckets - 1].
Примеры использования:
keys = tf.data.Dataset.range(100)
values = tf.data.Dataset.range(100).map(
lambda x: tf.strings.as_string(x * 2))
ds = tf.data.Dataset.zip((keys, values))
table = tf.data.experimental.table_from_dataset(
ds, default_value='n/a', key_dtype=tf.int64)
table.lookup(tf.constant([0, 1, 2], dtype=tf.int64)).numpy()
array([b'0', b'2', b'4'], dtype=object)
| Аргументы | |
|---|---|
dataset | Набор данных, содержащий пары (ключ, значение). |
num_oov_buckets | Количество корзин для токенов вне словаря. |
vocab_size | Число элементов в словаре, если известно. |
default_value | Значение, используемое для значений признаков вне словаря. По умолчанию равно -1. |
hasher_spec | Функция хеширования для назначения корзин для токенов вне словаря. |
key_dtype | Тип данных key. |
name | Имя этой операции (необязательно). |
| Возвращаемое значение | |
|---|---|
| Таблица поиска, основанная на заданном наборе данных. |
| Исключения | |
|---|---|
ValueError | Если
|
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/data/experimental/table_from_dataset