tf.tpu.experimental.AdamParameters
Параметры оптимизации для Adam с TPU-вложениями.
tf.tpu.experimental.AdamParameters(
learning_rate, beta1=0.9, beta2=0.999, epsilon=1e-08, lazy_adam=True,
sum_inside_sqrt=True, use_gradient_accumulation=True, clip_weight_min=None,
clip_weight_max=None
)
Передайте это в tf.estimator.tpu.experimental.EmbeddingConfigSpec через аргумент optimization_parameters, чтобы установить оптимизатор и его параметры. См. документацию для tf.estimator.tpu.experimental.EmbeddingConfigSpec для получения более подробной информации.
estimator = tf.estimator.tpu.TPUEstimator(
...
embedding_config_spec=tf.estimator.tpu.experimental.EmbeddingConfigSpec(
...
optimization_parameters=tf.tpu.experimental.AdamParameters(0.1),
...))
| Аргументы | |
|---|---|
learning_rate | значение с плавающей запятой. Скорость обучения. |
beta1 | Значение с плавающей запятой. Экспоненциальная скорость затухания для оценок первого момента. |
beta2 | Значение с плавающей запятой. Экспоненциальная скорость затухания для оценок второго момента. |
epsilon | Небольшая константа для обеспечения числовой устойчивости. |
lazy_adam | Использовать ленивый Adam вместо Adam. Ленивый Adam обучается быстрее. Подробности см. в optimization_parameters.proto. |
sum_inside_sqrt | Это улучшает скорость обучения. Подробности см. в optimization_parameters.proto. |
use_gradient_accumulation | Установка в значение False делает вычисление градиентов вложений менее точным, но быстрее. Подробности см. в optimization_parameters.proto. |
clip_weight_min | минимальное значение для обрезки; None означает -бесконечность. |
clip_weight_max | максимальное значение для обрезки; None означает +бесконечность. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/tpu/experimental/AdamParameters