tf.raw_ops.ResourceApplyRMSProp
Обновление '*var' по алгоритму RMSProp.
tf.raw_ops.ResourceApplyRMSProp(
var, ms, mom, lr, rho, momentum, epsilon, grad, use_locking=False, name=None
)
Обратите внимание, что в плотной реализации этого алгоритма ms и mom будут обновляться, даже если градиент равен нулю, но в этой разреженной реализации ms и mom не будут обновляться в итерациях, в которых градиент равен нулю.
mean_square = decay * mean_square + (1-decay) * gradient ** 2 Delta = learning_rate * gradient / sqrt(mean_square + epsilon)
ms <- rho * mst-1 + (1-rho) * grad * grad mom <- momentum * momt-1 + lr * grad / sqrt(ms + epsilon) var <- var - mom
| Аргументы | |
|---|---|
var | Переменная типа resource. Должна быть из Variable(). |
ms | Переменная типа resource. Должна быть из Variable(). |
mom | Переменная типа resource. Должна быть из Variable(). |
lr | Числовое значение. Должно быть одного из следующих типов: float32, float64, int32, uint8, int16, int8, complex64, int64, qint8, quint8, qint32, bfloat16, uint16, complex128, half, uint32, uint64. Коэффициент масштабирования. Должно быть скаляром. |
rho | Числовое значение. Должно иметь тот же тип, что и lr. Скорость затухания. Должно быть скаляром. |
momentum | Числовое значение. Должно иметь тот же тип, что и lr. |
epsilon | Числовое значение. Должно иметь тот же тип, что и lr. Слагаемое сглаживания. Должно быть скаляром. |
grad | Числовое значение. Должно иметь тот же тип, что и lr. Градиент. |
use_locking | Необязательный объект. По умолчанию False. Если True, обновление тензоров var, ms и mom защищено блокировкой; в противном случае поведение не определено, но может характеризоваться меньшим конфликтом. |
name | Имя операции (необязательно). |
| Возвращаемое значение | |
|---|---|
| Созданная операция. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/raw_ops/ResourceApplyRMSProp