Spec-Zone.ru › TensorFlow 1.15

tf.contrib.feature_column.sequence_categorical_column_with_vocabulary_file

Последовательность категориальных терминов, где идентификаторы используют файл словаря.

tf.contrib.feature_column.sequence_categorical_column_with_vocabulary_file(
    key, vocabulary_file, vocabulary_size=None, num_oov_buckets=0,
    default_value=None, dtype=tf.dtypes.string
)

Передайте этот объект в embedding_column или indicator_column, чтобы преобразовать последовательные категориальные данные в плотное представление для ввода в последовательную нейронную сеть, такую как RNN.

Пример:

states = sequence_categorical_column_with_vocabulary_file(
    key='states', vocabulary_file='/us/states.txt', vocabulary_size=50,
    num_oov_buckets=5)
states_embedding = embedding_column(states, dimension=10)
columns = [states_embedding]

features = tf.io.parse_example(..., features=make_parse_example_spec(columns))
input_layer, sequence_length = sequence_input_layer(features, columns)

rnn_cell = tf.compat.v1.nn.rnn_cell.BasicRNNCell(hidden_size)
outputs, state = tf.compat.v1.nn.dynamic_rnn(
    rnn_cell, inputs=input_layer, sequence_length=sequence_length)
Аргументы
key Уникальная строка, идентифицирующая входной признак.
vocabulary_file Имя файла словаря.
vocabulary_size Количество элементов в словаре. Это значение не должно быть больше длины vocabulary_file, если меньше, то последующие значения игнорируются. Если None, то устанавливается в длину vocabulary_file.
num_oov_buckets Неотрицательное целое число, количество ведер для значений вне словаря. Все входные значения вне словаря будут назначены идентификаторам в диапазоне [vocabulary_size, vocabulary_size+num_oov_buckets) на основе хэша входного значения. Положительное значение num_oov_buckets не может быть указано вместе с default_value.
default_value Целое значение ID, возвращаемое для значений признаков вне словаря, по умолчанию -1. Это значение не может быть указано вместе с положительным num_oov_buckets.
dtype Тип признаков. Поддерживаются только строковый и целочисленный типы.
Возвращаемое значение
_SequenceCategoricalColumn.
Исключения
ValueError Файл vocabulary_file отсутствует или недоступен.
ValueError Файл vocabulary_size отсутствует или содержит меньше 1 элемента.
ValueError num_oov_buckets является отрицательным целым числом.
ValueError num_oov_buckets и default_value заданы одновременно.
ValueError dtype не является ни строкой, ни целым числом.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/contrib/feature_column/sequence_categorical_column_with_vocabulary_file

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API