tf.raw_ops.CudnnRNNCanonicalToParamsV2
Преобразует параметры CudnnRNN из канонической формы в используемую форму. Поддерживает проекцию в LSTM.
tf.raw_ops.CudnnRNNCanonicalToParamsV2(
num_layers,
num_units,
input_size,
weights,
biases,
rnn_mode='lstm',
input_mode='linear_input',
direction='unidirectional',
dropout=0,
seed=0,
seed2=0,
num_proj=0,
name=None
)
Записывает набор весов в буфер параметров, чтобы их можно было использовать в последующих этапах обучения или вывода.
Обратите внимание, что буфер параметров может быть несовместимым на разных графических процессорах. Поэтому любое сохранение и восстановление должно преобразовываться в/из канонических весов и смещений.
num_layers: Указывает количество слоев в модели RNN. num_units: Указывает размер скрытого состояния. input_size: Указывает размер входного состояния. weights: каноническая форма весов, которые можно использовать для сохранения и восстановления. Они, скорее всего, будут совместимы в разных поколениях. biases: каноническая форма смещений, которые можно использовать для сохранения и восстановления. Они, скорее всего, будут совместимы в разных поколениях. num_params_weights: количество матриц параметров весов для всех слоев. num_params_biases: количество векторов параметров смещений для всех слоев. rnn_mode: Указывает тип модели RNN. input_mode: Указывает, есть ли линейная проекция между входом и фактическим вычислением перед первым слоем. «skip_input» разрешен только тогда, когда input_size == num_units; «auto_select» подразумевает «skip_input», когда input_size == num_units; в противном случае это подразумевает «linear_input». direction: Указывает, будет ли использоваться двунаправленная модель. dir = (direction == bidirectional) ? 2 : 1 dropout: вероятность дропаута. При значении 0. дропаут отключен. seed: первая часть seed для инициализации дропаута. seed2: вторая часть seed для инициализации дропаута. num_proj: размерность вывода для матриц проекции. Если None или 0, проекция не выполняется.
| Аргументы | |
|---|---|
num_layers | A Tensor типа int32. |
num_units | A Tensor типа int32. |
input_size | A Tensor типа int32. |
weights | Список из как минимум 1 объекта Tensor с одинаковым типом в: half, float32, float64. |
biases | Список из как минимум 1 объекта Tensor с типом, как у weights. |
rnn_mode | Необязательный string из: "rnn_relu", "rnn_tanh", "lstm", "gru". По умолчанию "lstm". |
input_mode | Необязательный string из: "linear_input", "skip_input", "auto_select". По умолчанию "linear_input". |
direction | Необязательный string из: "unidirectional", "bidirectional". По умолчанию "unidirectional". |
dropout | Необязательный float. По умолчанию 0. |
seed | Необязательный int. По умолчанию 0. |
seed2 | Необязательный int. По умолчанию 0. |
num_proj | Необязательный int. По умолчанию 0. |
name | Имя операции (необязательно). |
| Возвращаемое значение | |
|---|---|
A Tensor. Имеет тот же тип, что и weights. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/raw_ops/CudnnRNNCanonicalToParamsV2