Spec-Zone.ru › TensorFlow C++ 2.9

tensorflow::ops::FixedUnigramCandidateSampler::Attrs

#include <candidate_sampling_ops.h>

Дополнительные атрибуты для FixedUnigramCandidateSampler.

Краткое описание

Общедоступные атрибуты
distortion_ = 1.0f
float
num_reserved_ids_ = 0
int64
num_shards_ = 1
int64
seed2_ = 0
int64
seed_ = 0
int64
shard_ = 0
int64
unigrams_ = {}
gtl::ArraySlice< float >
vocab_file_ = ""
StringPiece
Общедоступные функции
Distortion(float x)
TF_MUST_USE_RESULT Attrs
Искажение используется для искажения распределения вероятностей униграм.
NumReservedIds(int64 x)
TF_MUST_USE_RESULT Attrs
Пользователь может добавить некоторые зарезервированные идентификаторы в диапазоне [0, ..., num_reserved_ids).
NumShards(int64 x)
TF_MUST_USE_RESULT Attrs
Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.
Seed(int64 x)
TF_MUST_USE_RESULT Attrs
Если либо seed, либо seed2 установлены в ненулевое значение, генератор случайных чисел инициализируется заданным seed.
Seed2(int64 x)
TF_MUST_USE_RESULT Attrs
Дополнительное значение seed для предотвращения коллизий seed.
Shard(int64 x)
TF_MUST_USE_RESULT Attrs
Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.
Unigrams(const gtl::ArraySlice< float > & x)
TF_MUST_USE_RESULT Attrs
Список частот или вероятностей униграм, по одной для каждого ID в последовательном порядке.
VocabFile(StringPiece x)
TF_MUST_USE_RESULT Attrs
Каждая допустимая строка в этом файле (которая должна иметь формат, похожий на CSV), соответствует допустимому идентификатору слова.

Общедоступные атрибуты

distortion_

float tensorflow::ops::FixedUnigramCandidateSampler::Attrs::distortion_ = 1.0f

num_reserved_ids_

int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::num_reserved_ids_ = 0

num_shards_

int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::num_shards_ = 1

seed2_

int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::seed2_ = 0

seed_

int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::seed_ = 0

shard_

int64 tensorflow::ops::FixedUnigramCandidateSampler::Attrs::shard_ = 0

unigrams_

gtl::ArraySlice< float > tensorflow::ops::FixedUnigramCandidateSampler::Attrs::unigrams_ = {}

vocab_file_

StringPiece tensorflow::ops::FixedUnigramCandidateSampler::Attrs::vocab_file_ = ""

Общедоступные функции

Искажение

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Distortion(
  float x
)

Искажение используется для искажения распределения вероятностей униграм.

Каждое значение сначала возводится в степень искажения, прежде чем добавляться к внутреннему распределению униграм. В результате, distortion = 1.0 обеспечивает обычную выборку униграм (как определено в файле vocab), а distortion = 0.0 — равномерное распределение.

По умолчанию 1

Количество зарезервированных идентификаторов

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::NumReservedIds(
  int64 x
)

Пользователь может добавить некоторые зарезервированные IDs в диапазоне [0, ..., num_reserved_ids).

Один из случаев использования - использование специального маркера неизвестного слова с ID 0. У этих ID будет вероятность выборки 0.

По умолчанию 0

Количество фрагментов

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::NumShards(
  int64 x
)

Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.

Этот параметр (вместе с 'shard') указывает количество разделов, используемых в общем вычислении.

По умолчанию 1

Seed

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Seed(
  int64 x
)

Если либо seed, либо seed2 установлены в ненулевое значение, генератор случайных чисел инициализируется заданным seed.

В противном случае он инициализируется случайным seed.

По умолчанию 0

Дополнительный seed

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Seed2(
  int64 x
)

Дополнительное значение seed для предотвращения коллизий seed.

По умолчанию 0

Фрагмент

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Shard(
  int64 x
)

Сэмплер может быть использован для выборки из подмножества исходного диапазона для ускорения вычислений с помощью параллелизма.

Этот параметр (вместе с 'num_shards') указывает номер конкретного раздела оператора сэмплера, когда используется разбиение.

По умолчанию 0

Униграммы

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::Unigrams(
  const gtl::ArraySlice< float > & x
)

Список частот или вероятностей униграм, по одной для каждого ID в последовательном порядке.

В этот опер нужно передать ровно один из vocab_file или unigrams.

По умолчанию []

Файл словаря

TF_MUST_USE_RESULT Attrs tensorflow::ops::FixedUnigramCandidateSampler::Attrs::VocabFile(
  StringPiece x
)

Каждая допустимая строка в этом файле (которая должна иметь формат, похожий на CSV), соответствует допустимому идентификатору слова.

Идентификаторы указаны в последовательном порядке, начиная с num_reserved_ids. Ожидается, что последняя запись в каждой строке будет значением, соответствующим частоте или относительной вероятности. В этот опер нужно передать ровно один из vocab_file или unigrams.

По умолчанию ""

© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/cc/struct/tensorflow/ops/fixed-unigram-candidate-sampler/attrs

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API