tf.contrib.layers.sparse_column_with_vocabulary_file
Создаёт _SparseColumn с конфигурацией файла словаря.
tf.contrib.layers.sparse_column_with_vocabulary_file(
column_name, vocabulary_file, num_oov_buckets=0, vocab_size=None,
default_value=-1, combiner='sum', dtype=tf.dtypes.string
)
Используйте эту функцию, когда ваши разреженные признаки представлены в строчном или целочисленном формате, и у вас есть файл словаря, который сопоставляет каждое значение целочисленному идентификатору. output_id = LookupIdFromVocab(input_feature_string)
| Аргументы | |
|---|---|
column_name | Строка, определяющая имя разреженного столбца. |
vocabulary_file | Имя файла словаря. |
num_oov_buckets | Количество ведер для внесловных слов. Если равно нулю, все внесловные признаки будут проигнорированы. |
vocab_size | Количество элементов в словаре. |
default_value | Значение для использования для внесловных значений признаков. По умолчанию -1. |
combiner | Строка, определяющая способ агрегации, если разреженный столбец многозначный. В настоящее время поддерживаются "mean", "sqrtn" и "sum", по умолчанию "sum". "sqrtn" часто обеспечивает хорошую точность, особенно для столбцов «мешок слов».
|
dtype | Тип признаков. Поддерживаются только строковые и целочисленные типы. |
| Возвращаемое значение | |
|---|---|
| _SparseColumn с конфигурацией файла словаря. |
| Исключения | |
|---|---|
ValueError | vocab_size не определён. |
ValueError | тип dtype не является строковым или целочисленным. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/contrib/layers/sparse_column_with_vocabulary_file