PerChannelMinMaxObserver
-
class torch.ao.quantization.observer.PerChannelMinMaxObserver(ch_axis=0, dtype=torch.quint8, qscheme=torch.per_channel_affine, reduce_range=False, quant_min=None, quant_max=None, factory_kwargs=None, eps=1.1920928955078125e-07, is_dynamic=False, **kwargs)[исходный код] -
Модуль-наблюдатель для вычисления параметров квантования на основе текущих минимальных и максимальных значений по каналам.
Этот наблюдатель использует статистику минимальных и максимальных значений тензора для вычисления параметров квантования по каналам. Модуль записывает текущие минимальные и максимальные значения входящих тензоров и использует эту статистику для вычисления параметров квантования.
- Параметры:
-
- ch_axis – Ось канала
-
dtype – Аргумент dtype узла
quantize, необходимый для реализации спецификации эталонной модели. - qscheme – Используемая схема квантования
- reduce_range – Уменьшает диапазон квантованных данных на 1 бит
- quant_min – Минимальное значение квантования. Если не указано, используется конфигурация для 8 бит.
- quant_max – Максимальное значение квантования. Если не указано, используется конфигурация для 8 бит.
-
eps (Tensor) – Значение эпсилон для float32. По умолчанию —
torch.finfo(torch.float32).eps.
Параметры квантования вычисляются так же, как в
MinMaxObserver, за исключением того, что текущие минимальные и максимальные значения хранятся отдельно для каждого канала. Таким образом, масштабы и нулевые точки также вычисляются отдельно для каждого канала.Примечание
Если текущее минимальное значение равно текущему максимальному значению, масштабы и zero_points устанавливаются равными 1.0 и 0.
-
reset_min_max_vals()[исходный код] -
Сбрасывает минимальные и максимальные значения.
© 2026, PyTorch Contributors
PyTorch has a BSD-style license, as found in the LICENSE file.
https://docs.pytorch.org/docs/2.14/generated/torch.ao.quantization.observer.PerChannelMinMaxObserver.html