tensorflow::ops::FixedUnigramCandidateSampler::Attrs
#include <candidate_sampling_ops.h>
Дополнительные атрибуты для FixedUnigramCandidateSampler.
Краткое описание
| Общедоступные атрибуты | |
|---|---|
distortion_ = 1.0f | float |
num_reserved_ids_ = 0 | int64 |
num_shards_ = 1 | int64 |
seed2_ = 0 | int64 |
seed_ = 0 | int64 |
shard_ = 0 | int64 |
unigrams_ = {} | gtl::ArraySlice< float > |
vocab_file_ = "" | StringPiece |
| Общедоступные функции | |
|---|---|
Distortion(float x) | TF_MUST_USE_RESULT Attrs Искажение используется для искажения распределения вероятностей униграм. |
NumReservedIds(int64 x) | TF_MUST_USE_RESULT Attrs Пользователь может добавить некоторые зарезервированные идентификаторы в диапазоне [0, ..., num_reserved_ids). |
NumShards(int64 x) | TF_MUST_USE_RESULT Attrs Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма. |
Seed(int64 x) | TF_MUST_USE_RESULT Attrs Если либо seed, либо seed2 установлены в ненулевое значение, генератор случайных чисел инициализируется заданным seed. |
Seed2(int64 x) | TF_MUST_USE_RESULT Attrs Дополнительное значение seed для предотвращения коллизий seed. |
Shard(int64 x) | TF_MUST_USE_RESULT Attrs Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма. |
Unigrams(const gtl::ArraySlice< float > & x) | TF_MUST_USE_RESULT Attrs Список частот или вероятностей униграм, по одной для каждого ID в последовательном порядке. |
VocabFile(StringPiece x) | TF_MUST_USE_RESULT Attrs Каждая допустимая строка в этом файле (которая должна иметь формат, похожий на CSV), соответствует допустимому идентификатору слова. |
Общедоступные атрибуты
distortion_
float tensorflow::ops::FixedUnigramCandidateSampler::Attrs::distortion_ = 1.0f
num_reserved_ids_
int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::num_reserved_ids_ = 0
num_shards_
int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::num_shards_ = 1
seed2_
int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::seed2_ = 0
seed_
int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::seed_ = 0
shard_
int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::shard_ = 0
unigrams_
gtl::ArraySlice< float > tensorflow::ops::FixedUnigramCandidateSampler::Attrs::unigrams_ = {} vocab_file_
StringPiece tensorflow::ops::FixedUnigramCandidateSampler::Attrs::vocab_file_ = ""
Общедоступные функции
Искажение
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Distortion( float x )
Искажение используется для искажения распределения вероятностей униграм.
Каждое значение сначала возводится в степень искажения, прежде чем добавляться к внутреннему распределению униграм. В результате, distortion = 1.0 обеспечивает обычную выборку униграм (как определено в файле vocab), а distortion = 0.0 — равномерное распределение.
По умолчанию 1
Количество зарезервированных идентификаторов
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::NumReservedIds( int64 x )
Пользователь может добавить некоторые зарезервированные IDs в диапазоне [0, ..., num_reserved_ids).
Один из случаев использования - использование специального маркера неизвестного слова с ID 0. У этих ID будет вероятность выборки 0.
По умолчанию 0
Количество фрагментов
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::NumShards( int64 x )
Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.
Этот параметр (вместе с 'shard') указывает количество разделов, используемых в общем вычислении.
По умолчанию 1
Seed
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Seed( int64 x )
Если либо seed, либо seed2 установлены в ненулевое значение, генератор случайных чисел инициализируется заданным seed.
В противном случае он инициализируется случайным seed.
По умолчанию 0
Дополнительный seed
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Seed2( int64 x )
Дополнительное значение seed для предотвращения коллизий seed.
По умолчанию 0
Фрагмент
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Shard( int64 x )
Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.
Этот параметр (вместе с 'num_shards') указывает номер конкретного раздела оператора сэмплера, когда используется разбиение.
По умолчанию 0
Униграммы
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Unigrams( const gtl::ArraySlice< float > & x )
Список частот или вероятностей униграм, по одной для каждого ID в последовательном порядке.
В этот опер нужно передать ровно один из vocab_file или unigrams.
По умолчанию []
Файл словаря
TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::VocabFile( StringPiece x )
Каждая допустимая строка в этом файле (которая должна иметь формат, похожий на CSV), соответствует допустимому идентификатору слова.
Идентификаторы указаны в последовательном порядке, начиная с num_reserved_ids. Ожидается, что последняя запись в каждой строке будет значением, соответствующим частоте или относительной вероятности. В этот опер нужно передать ровно один из vocab_file или unigrams.
По умолчанию ""
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/cc/struct/tensorflow/ops/fixed-unigram-candidate-sampler/attrs