Spec-Zone.ru › TensorFlow 2.9

tf.raw_ops.QuantizedMatMulWithBiasAndRelu

Выполнить квантованное матричное умножение a на матрицу b с смещением

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения более подробной информации.

tf.compat.v1.raw_ops.QuantizedMatMulWithBiasAndRelu

tf.raw_ops.QuantizedMatMulWithBiasAndRelu(
    a,
    b,
    bias,
    min_a,
    max_a,
    min_b,
    max_b,
    Toutput=tf.dtypes.qint32,
    transpose_a=False,
    transpose_b=False,
    input_quant_mode='MIN_FIRST',
    name=None
)

Добавление и слияние relu.

Входы должны быть матрицами размером 2 и вектором смещения размером 1. Внутренняя размерность a (после транспонирования, если transpose_a не равно нулю) должна совпадать с внешней размерностью b (после транспонирования, если transposed_b не равно нулю). Затем выполняется операция сложения со смещением на результат матричного умножения. Размер смещения должен соответствовать внутренней размерности b. Затем выполняется активация relu для получения неотрицательного результата.

Аргументы: a: A Tensor. Должен быть одним из следующих типов: qint8, quint8, qint32, qint16, quint16. Матрица, подлежащая умножению. Должна быть двумерным тензором типа quint8. b: A Tensor. Должен быть одним из следующих типов: qint8, quint8, qint32, qint16, quint16. Матрица, подлежащая умножению, и должна быть двумерным тензором типа qint8. bias: A Tensor типа float32. Тензор смещения размерностью 1, соответствующей внутренней размерности b (после транспонирования, если transposed_b не равно нулю). min_a: A Tensor типа float32. Вещественное значение, которое представляет наименьшее квантованное значение a. max_a: A Tensor типа float32. Вещественное значение, которое представляет наибольшее квантованное значение a. min_b: A Tensor типа float32. Вещественное значение, которое представляет наименьшее квантованное значение b. max_b: A Tensor типа float32. Вещественное значение, которое представляет наибольшее квантованное значение b. Toutput: Необязательный tf.DType из: tf.qint8, tf.quint8, tf.qint32, tf.qint16, tf.quint16. По умолчанию tf.qint32. transpose_a: Необязательный bool. По умолчанию False. Если значение равно true, a транспонируется перед умножением. transpose_b: Необязательный bool. По умолчанию False. Если значение равно true, b транспонируется перед умножением. input_quant_mode: Необязательный string из: "MIN_FIRST", "SCALED". По умолчанию "MIN_FIRST". Режим квантования входных данных. Либо MIN_FIRST(по умолчанию), либо SCALED. name: Название операции (необязательно).

Возвращает: Кортеж объектов Tensor (out, min_out, max_out).

out: A `Tensor` of type `Toutput`.
min_out: A `Tensor` of type `float32`.
max_out: A `Tensor` of type `float32`.

© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/raw_ops/QuantizedMatMulWithBiasAndRelu

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API