tf.nn.conv2d
| Просмотреть исходный код на GitHub |
Вычисляет 2-мерную свёртку, заданную тензорами input и 4-мерными тензорами filters.
tf.nn.conv2d(
input, filters, strides, padding, data_format='NHWC', dilations=None, name=None
)
Тензор input может иметь ранг 4 или выше, где размерности формы [:-3] рассматриваются как размерности пакета (batch_shape).
Учитывая входной тензор формы batch_shape + [in_height, in_width, in_channels] и тензор фильтра/ядра формы [filter_height, filter_width, in_channels, out_channels], этот оператор выполняет следующие действия:
- Сглаживает фильтр в 2-мерную матрицу с формой
[filter_height * filter_width * in_channels, output_channels]. - Извлекает фрагменты изображения из входного тензора, чтобы сформировать виртуальный тензор формы
[batch, out_height, out_width, filter_height * filter_width * in_channels]. - Для каждого фрагмента выполняет правое умножение матрицы фильтра и вектора фрагмента изображения.
Подробнее, с форматом по умолчанию NHWC,
output[b, i, j, k] =
sum_{di, dj, q} input[b, strides[1] * i + di, strides[2] * j + dj, q] *
filter[di, dj, q, k]
Должно выполняться условие strides[0] = strides[3] = 1. В наиболее распространённом случае одинаковых горизонтальных и вертикальных шагов, strides = [1, stride, stride, 1].
Пример использования:
x_in = np.array([[ [[2], [1], [2], [0], [1]], [[1], [3], [2], [2], [3]], [[1], [1], [3], [3], [0]], [[2], [2], [0], [1], [1]], [[0], [0], [3], [1], [2]], ]]) kernel_in = np.array([ [ [[2, 0.1]], [[3, 0.2]] ], [ [[0, 0.3]],[[1, 0.4]] ], ]) x = tf.constant(x_in, dtype=tf.float32) kernel = tf.constant(kernel_in, dtype=tf.float32) tf.nn.conv2d(x, kernel, strides=[1, 1, 1, 1], padding='VALID') <tf.Tensor: shape=(1, 4, 4, 2), dtype=float32, numpy=..., dtype=float32)>
| Аргументы | |
|---|---|
input | A Tensor. Должен быть одним из следующих типов: half, bfloat16, float32, float64. Тензор ранга не менее 4. Порядок размерностей интерпретируется в соответствии со значением data_format; все размерности, кроме трёх внутренних, рассматриваются как размерности пакета. Подробности см. ниже. |
filters | A Tensor. Должен иметь тот же тип, что и input. 4-мерный тензор формы [filter_height, filter_width, in_channels, out_channels] |
strides | Целое число или список ints, имеющий длину 1, 2 или 4. Шаг скользящего окна для каждой размерности input. Если указано единственное значение, оно дублируется в размерностях H и W. По умолчанию размерности N и C устанавливаются в 1. Порядок размерностей определяется значением data_format, см. подробности ниже. |
padding | Либо string "SAME" или "VALID" указывающее тип алгоритма заполнения, либо список, указывающий явное заполнение в начале и конце каждой размерности. При явном использовании заполнения и data_format = "NHWC", это должно быть в форме [[0, 0], [pad_top, pad_bottom], [pad_left, pad_right], [0, 0]]. При явном использовании заполнения и data_format = "NCHW", это должно быть в форме [[0, 0], [0, 0], [pad_top, pad_bottom], [pad_left, pad_right]]. |
data_format | Необязательный string из: "NHWC", "NCHW". По умолчанию "NHWC". Указывает формат данных для входных и выходных данных. С форматом по умолчанию "NHWC" данные хранятся в порядке: batch_shape + [height, width, channels]. В качестве альтернативы, формат может быть "NCHW", порядок хранения данных: batch_shape + [channels, height, width]. |
dilations | Целое число или список ints, имеющий длину 1, 2 или 4, по умолчанию 1. Фактор расширения для каждой размерности input. Если задано единственное значение, оно дублируется в размерностях H и W. По умолчанию размерности N и C устанавливаются в 1. Если задано k > 1, между каждым элементом фильтра по данной размерности будет k-1 пропущенных ячеек. Порядок размерностей определяется значением data_format, см. подробности выше. Расширения по размерностям пакета и глубины для 4-мерного тензора должны быть равны 1. |
name | Название операции (необязательно). |
| Возвращаемые значения | |
|---|---|
A Tensor. Имеет тот же тип, что и input и ту же внешнюю форму пакета. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/nn/conv2d