GroupBy
Объекты GroupBy возвращаются вызовами groupby: pandas.DataFrame.groupby(), pandas.Series.groupby() и т.д.
Индексирование, итерация
Итератор по группам. | |
Словарь {имя группы -> метки группы}. | |
Словарь {имя группы -> индексы группы}. | |
| Создать DataFrame из группы с указанным именем. |
| Объект Grouper позволяет пользователю задать инструкцию groupby для объекта. |
Применение функций
| Применить функцию |
| |
| Агрегировать, используя одну или несколько операций над указанной осью. |
| Агрегировать, используя одну или несколько операций над указанной осью. |
| Вызвать функцию, которая генерирует Series с теми же индексами в каждой группе. |
| Вызвать функцию, которая генерирует DataFrame с теми же индексами в каждой группе. |
| Применить функцию |
Вычисления / описательные статистики
| Возвращает True, если все значения в группе истинны, в противном случае False. |
| Возвращает True, если любое значение в группе истинно, в противном случае False. |
| Заполнение значений методом обратного заполнения. |
| Заполнение значений методом обратного заполнения. |
Вычисление количества элементов в группе, исключая пропущенные значения. | |
| Пронумеровать каждый элемент в каждой группе от 0 до длины этой группы минус 1. |
| Накопленный максимум для каждой группы. |
| Накопленный минимум для каждой группы. |
| Накопленное произведение для каждой группы. |
| Накопленная сумма для каждой группы. |
| Заполнение значений методом прямого заполнения. |
| Вычисление первого не-NULL элемента каждого столбца. |
| Возвращает первые n строк каждой группы. |
| Вычисление последнего не-NULL элемента каждого столбца. |
| Вычисление максимума значений группы. |
| Вычисление среднего арифметического значений группы, исключая пропущенные значения. |
| Вычисление медианы значений группы, исключая пропущенные значения. |
| Вычисление минимума значений группы. |
| Пронумеровать каждую группу от 0 до количества групп минус 1. |
| Взять n-ую строку из каждой группы, если n целое число, иначе подмножество строк. |
Вычисление значений открытие, максимум, минимум и закрытие группы, исключая пропущенные значения. | |
| Заполнение значений методом прямого заполнения. |
| Вычисление произведения значений группы. |
| Предоставление ранга значений в каждой группе. |
| Вычисление процентного изменения каждого значения по отношению к предыдущему в группе. |
Вычисление размеров групп. | |
| Вычисление стандартной ошибки среднего арифметического значений группы, исключая пропущенные значения. |
| Вычисление стандартного отклонения значений группы, исключая пропущенные значения. |
| Вычисление суммы значений группы. |
| Вычисление дисперсии значений группы, исключая пропущенные значения. |
| Возвращает последние n строк каждой группы. |
Следующие методы доступны как в объектах SeriesGroupBy , так и в объектах DataFrameGroupBy, но могут незначительно отличаться, обычно в том, что версия DataFrameGroupBy обычно позволяет указать аргумент оси и часто аргумент, указывающий, следует ли ограничить применение к столбцам определенного типа данных.
| Возвращает True, если все значения в группе истинны, иначе False. |
| Возвращает True, если любое значение в группе истинно, иначе False. |
| Заполняет значения методом обратного заполнения. |
| Заполняет значения методом обратного заполнения. |
Вычисляет парную корреляцию столбцов, исключая значения NA/null. | |
Вычисляет количество элементов в группе, исключая пропущенные значения. | |
Вычисляет парную ковариацию столбцов, исключая значения NA/null. | |
| Присваивает каждому элементу в каждой группе номер от 0 до длины этой группы - 1. |
| Накопительный максимум для каждой группы. |
| Накопительный минимум для каждой группы. |
| Накопительное произведение для каждой группы. |
| Накопительная сумма для каждой группы. |
| Генерация описательной статистики. |
| Первая дискретная разность элемента. |
| Заполняет значения методом прямого заполнения. |
Заполнение пропущенных значений (NA/NaN) указанным методом. | |
| Возвращает копию DataFrame, исключая отфильтрованные элементы. |
Построение гистограммы столбцов DataFrame. | |
| Возвращает индекс первого вхождения максимального значения по указанной оси. |
| Возвращает индекс первого вхождения минимального значения по указанной оси. |
(УСТАРЕЛО) Возвращает среднее абсолютное отклонение значений по указанной оси. | |
| Возвращает DataFrame со счётчиками уникальных элементов в каждой позиции. |
| Заполняет значения методом прямого заполнения. |
| Вычисление процентного изменения каждого значения по отношению к предыдущему в группе. |
Класс, реализующий атрибут .plot для объектов groupby. | |
| Возвращает значения группы в заданном квантиле, аналогично numpy.percentile. |
| Предоставляет ранг значений внутри каждой группы. |
| Предоставляет ресемплирование при использовании TimeGrouper. |
| Возвращает случайную выборку элементов из каждой группы. |
| Смещает каждую группу на периоды наблюдений. |
Вычисляет размеры групп. | |
Возвращает смещенное искажение по указанной оси. | |
Возвращает элементы по заданным позиционным индексам вдоль оси. | |
(УСТАРЕЛО) Смещает временной индекс, используя частоту индекса, если она доступна. | |
| Возвращает Series или DataFrame, содержащий подсчеты уникальных строк. |
Следующие методы доступны только для объектов SeriesGroupBy.
Построение гистограммы входного ряда с использованием matplotlib. | |
| Возвращает n наибольших элементов. |
| Возвращает n наименьших элементов. |
Возвращает уникальные значения объекта Series. | |
Возвращает булево значение, если значения в объекте монотонно возрастают. | |
Возвращает булево значение, если значения в объекте монотонно убывают. |
Следующие методы доступны только для объектов DataFrameGroupBy.
Вычисление парной корреляции. | |
| Построение диаграмм размаха данных из DataFrameGroupBy. |
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/1.5.0/reference/groupby.html