tf.keras.dtype_policies.QuantizedFloat8DTypePolicy
Политика типа данных для слоя Keras.
Наследуется от: QuantizedDTypePolicy, DTypePolicy
tf.keras.dtype_policies.QuantizedFloat8DTypePolicy(
name, amax_history_length=1024
)
Политика типа данных определяет типы данных вычислений и переменных слоя. Каждый слой имеет политику. Политики можно передавать в аргумент dtype конструкторов слоев, или глобальную политику можно установить с помощью keras.config.set_dtype_policy.
| Аргументы | |
|---|---|
name | Имя политики, которое определяет типы данных вычислений и переменных. Может быть любым именем типа данных, например, "float32" или "float64", что приводит к тому, что типы данных вычислений и переменных будут этим типом данных. Также может быть строкой "mixed_float16" или "mixed_bfloat16", что приводит к тому, что тип данных вычислений будет float16 или bfloat16, а тип данных переменной — float32. |
Обычно вам нужно взаимодействовать с политиками типов данных только при использовании смешанной точности, что означает использование float16 или bfloat16 для вычислений и float32 для переменных. Именно поэтому термин mixed_precision появляется в имени API. Смешанная точность может быть включена путём передачи "mixed_float16" или "mixed_bfloat16" в keras.mixed_precision.set_dtype_policy().
keras.config.set_dtype_policy("mixed_float16")
layer1 = keras.layers.Dense(10)
layer1.dtype_policy # layer1 will automatically use mixed precision
<DTypePolicy "mixed_float16">
# Can optionally override layer to use float32
# instead of mixed precision.
layer2 = keras.layers.Dense(10, dtype="float32")
layer2.dtype_policy
<DTypePolicy "float32">
# Set policy back to initial float32.
keras.config.set_dtype_policy('float32')В примере выше передача dtype="float32" слою эквивалентна передаче dtype=keras.config.DTypePolicy("float32"). В общем случае передача имени политики типа данных слою эквивалентна передаче соответствующей политики, поэтому явное создание объекта DTypePolicy никогда не требуется.
| Атрибуты | |
|---|---|
amax_history_length | Длина окна истории amax. Этот свойство используется для вычисления коэффициента масштабирования в обучении с плавающей запятой 8-битной. |
compute_dtype | Тип данных вычислений этой политики. Это тип данных, в которых слои будут выполнять свои вычисления. Обычно слои также выдают тензоры с типом данных вычислений. Обратите внимание, что даже если тип данных вычислений float16 или bfloat16, аппаратные устройства могут не выполнять отдельные сложения, умножения и другие фундаментальные операции в float16 или bfloat16, а вместо этого могут выполнять некоторые из них в float32 для повышения числовой устойчивости. Тип данных вычислений — это тип данных входных и выходных данных операций, выполняемых слоем. Внутренне многие операции будут выполнять некоторые внутренние вычисления в float32 или другом формате промежуточных данных устройства с большей точностью, чем float16/bfloat16, чтобы повысить числовую устойчивость. |
name | Возвращает имя этой политики. |
quantization_mode | Режим квантования этой политики. |
variable_dtype | Тип данных переменных этой политики. Это тип данных, в которых слои создают свои переменные, если слой явно не выбирает другой тип данных. Если это отличается от Регуляризаторы переменных выполняются в типе данных переменных, а не в типе данных вычислений. |
Методы
convert_input
convert_input(
x, autocast, dtype
)
from_config
@classmethod
from_config(
config
)
get_config
get_config()
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/api_docs/python/tf/keras/dtype_policies/QuantizedFloat8DTypePolicy