tf.raw_ops.QuantizedMatMulWithBiasAndRequantize
tf.raw_ops.QuantizedMatMulWithBiasAndRequantize(
a, b, bias, min_a, max_a, min_b, max_b, min_freezed_output, max_freezed_output,
Toutput=tf.dtypes.quint8, transpose_a=False, transpose_b=False,
input_quant_mode='MIN_FIRST', name=None
)
| Аргументы |
a | A Tensor. Должен быть одним из следующих типов: qint8, quint8, qint32, qint16, quint16. |
b | A Tensor. Должен быть одним из следующих типов: qint8, quint8, qint32, qint16, quint16. |
bias | A Tensor. Должен быть одним из следующих типов: float32, qint32. |
min_a | A Tensor типа float32. |
max_a | A Tensor типа float32. |
min_b | A Tensor типа float32. |
max_b | A Tensor типа float32. |
min_freezed_output | A Tensor типа float32. |
max_freezed_output | A Tensor типа float32. |
Toutput | Необязательный tf.DType из: tf.qint8, tf.quint8, tf.qint32, tf.qint16, tf.quint16. По умолчанию tf.quint8. |
transpose_a | Необязательный bool. По умолчанию False. |
transpose_b | Необязательный bool. По умолчанию False. |
input_quant_mode | Необязательный string из: "MIN_FIRST", "SCALED". По умолчанию "MIN_FIRST". |
name | Имя операции (необязательно). |
| Возвращаемые значения |
Кортеж объектов Tensor (out, min_out, max_out). |
out | A Tensor типа Toutput. |
min_out | A Tensor типа float32. |
max_out | A Tensor типа float32. |