tf.compat.v1.space_to_depth
SpaceToDepth для тензоров типа T.
tf.compat.v1.space_to_depth(
input, block_size, name=None, data_format='NHWC'
)
Переупорядочивает блоки пространственных данных в глубину. Более конкретно, этот оператор выводит копию входного тензора, где значения из измерений height и width перемещаются в измерение depth. Атрибут block_size указывает размер блока входных данных.
- Непересекающиеся блоки размера
block_size x block sizeпереупорядочиваются в глубину в каждом месте. - Глубина выходного тензора составляет
block_size * block_size * input_depth. - Координаты Y, X внутри каждого блока входных данных становятся старшими разрядами индекса канала выхода.
- Высота и ширина входного тензора должны быть кратны block_size.
Атрибут data_format определяет расположение входного и выходного тензоров со следующими вариантами: "NHWC": [ batch, height, width, channels ] "NCHW": [ batch, channels, height, width ] "NCHW_VECT_C": qint8 [ batch, channels / 4, height, width, 4 ]
Полезно рассматривать операцию как преобразование 6-мерного тензора. Например, для data_format = NHWC каждый элемент в входном тензоре может быть указан с помощью 6 координат, упорядоченных по убыванию значимости в формате памяти: n, oY, bY, oX, bX, iC (где n = индекс партии, oX, oY — координаты X или Y на выходном изображении, bX, bY — координаты внутри входного блока, iC — каналы входных данных). Выход представлял бы собой транспонирование в следующую структуру: n, oY, oX, bY, bX, iC
Этот оператор полезен для изменения размера активаций между свертками (но сохраняя все данные), например, вместо пулинга. Он также полезен для обучения чисто сверточных моделей.
Например, для входных данных размером [1, 2, 2, 1], data_format = "NHWC" и block_size = 2:
x = [[[[1], [2]],
[[3], [4]]]]
Этот оператор выведет тензор размером [1, 1, 1, 4]:
[[[[1, 2, 3, 4]]]]
Здесь вход имеет партию 1, и каждый элемент партии имеет размер [2, 2, 1], соответствующий выход будет иметь единственный элемент (т. е. ширина и высота обе равны 1) и глубину 4 канала (1 * block_size * block_size). Размер элемента выхода [1, 1, 4].
Для входного тензора с большей глубиной, например размером [1, 2, 2, 3],
x = [[[[1, 2, 3], [4, 5, 6]],
[[7, 8, 9], [10, 11, 12]]]]
Этот оператор для block_size 2 вернёт следующий тензор размером [1, 1, 1, 12]
[[[[1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12]]]]
Аналогично, для входных данных размером [1 4 4 1], и размера блока 2:
x = [[[[1], [2], [5], [6]],
[[3], [4], [7], [8]],
[[9], [10], [13], [14]],
[[11], [12], [15], [16]]]]
оператор вернет следующий тензор размером [1 2 2 4]:
x = [[[[1, 2, 3, 4],
[5, 6, 7, 8]],
[[9, 10, 11, 12],
[13, 14, 15, 16]]]]
| Аргументы | |
|---|---|
input | Tensor. |
block_size | int, который равен >= 2. Размер пространственного блока. |
data_format | Необязательный string из: "NHWC", "NCHW", "NCHW_VECT_C". По умолчанию "NHWC". |
name | Название операции (необязательно). |
| Возвращает | |
|---|---|
Tensor. Имеет тот же тип, что и input. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/compat/v1/space_to_depth