pandas.DataFrame.stack
-
DataFrame.stack(self, level=-1, dropna=True)[source] -
Укладывание заданного уровня(ей) из столбцов в индекс.
Возвращает изменённую DataFrame или Series с многоуровневым индексом, имеющим один или несколько новых внутренних уровней по сравнению с текущей DataFrame. Новые внутренние уровни создаются путём поворота столбцов текущей DataFrame:
- если у столбцов один уровень, результат — Series;
- если у столбцов несколько уровней, новый(ые) уровень(и) индекса берутся из указанного уровня(ей), и результат — DataFrame.
Новые уровни индекса отсортированы.
Параметры: -
level : int, str, list, default -1 -
Уровень(и) для укладывания из оси столбцов на ось индекса, определённый как один индекс или метка, или список индексов или меток.
-
dropna : bool, default True -
Удалять ли строки в результирующей Frame/Series с пропущенными значениями. Укладывание уровня столбца на ось индекса может создавать комбинации значений индекса и столбцов, отсутствующих в исходной DataFrame. См. раздел Примеры.
Возвращает: - DataFrame или Series
-
Уложенная DataFrame или Series.
См. также
-
DataFrame.unstack - Разъединение указанного уровня(ей) из оси индекса на ось столбцов.
-
DataFrame.pivot - Преобразование DataFrame из длинного формата в широкий.
-
DataFrame.pivot_table - Создание сводной таблицы в формате электронных таблиц как DataFrame.
Примечания
Функция названа по аналогии с организацией коллекции книг, которые размещаются рядом на горизонтальной позиции (столбцы DataFrame) и укладываются друг на друга вертикально (в индексе DataFrame).
Примеры
Столбцы одного уровня
>>> df_single_level_cols = pd.DataFrame([[0, 1], [2, 3]], ... index=['cat', 'dog'], ... columns=['weight', 'height'])
Укладывание DataFrame со столбцами одного уровня возвращает Series:
>>> df_single_level_cols weight height cat 0 1 dog 2 3 >>> df_single_level_cols.stack() cat weight 0 height 1 dog weight 2 height 3 dtype: int64Столбцы нескольких уровней: простой случай
>>> multicol1 = pd.MultiIndex.from_tuples([('weight', 'kg'), ... ('weight', 'pounds')]) >>> df_multi_level_cols1 = pd.DataFrame([[1, 2], [2, 4]], ... index=['cat', 'dog'], ... columns=multicol1)Укладывание DataFrame со столбцами нескольких уровней:
>>> df_multi_level_cols1 weight kg pounds cat 1 2 dog 2 4 >>> df_multi_level_cols1.stack() weight cat kg 1 pounds 2 dog kg 2 pounds 4Пропущенные значения
>>> multicol2 = pd.MultiIndex.from_tuples([('weight', 'kg'), ... ('height', 'm')]) >>> df_multi_level_cols2 = pd.DataFrame([[1.0, 2.0], [3.0, 4.0]], ... index=['cat', 'dog'], ... columns=multicol2)Часто при укладывании DataFrame с многоуровневыми столбцами встречаются пропущенные значения, так как уложенная DataFrame обычно имеет больше значений, чем исходная. Пропущенные значения заполняются NaNs:
>>> df_multi_level_cols2 weight height kg m cat 1.0 2.0 dog 3.0 4.0 >>> df_multi_level_cols2.stack() height weight cat kg NaN 1.0 m 2.0 NaN dog kg NaN 3.0 m 4.0 NaNУказание уровня(ей) для укладывания
Первый параметр управляет тем, какой уровень или уровни будут уложены:
>>> df_multi_level_cols2.stack(0) kg m cat height NaN 2.0 weight 1.0 NaN dog height NaN 4.0 weight 3.0 NaN >>> df_multi_level_cols2.stack([0, 1]) cat height m 2.0 weight kg 1.0 dog height m 4.0 weight kg 3.0 dtype: float64Удаление пропущенных значений
>>> df_multi_level_cols3 = pd.DataFrame([[None, 1.0], [2.0, 3.0]], ... index=['cat', 'dog'], ... columns=multicol2)
Обратите внимание, что по умолчанию удаляются строки, где все значения отсутствуют, но это поведение можно контролировать с помощью параметра `dropna`:
>>> df_multi_level_cols3 weight height kg m cat NaN 1.0 dog 2.0 3.0 >>> df_multi_level_cols3.stack(dropna=False) height weight cat kg NaN NaN m 1.0 NaN dog kg NaN 2.0 m 3.0 NaN >>> df_multi_level_cols3.stack(dropna=True) height weight cat m 1.0 NaN dog kg NaN 2.0 m 3.0 NaN
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.25.0/reference/api/pandas.DataFrame.stack.html