GroupBy
pandas.api.typing.DataFrameGroupBy и pandas.api.typing.SeriesGroupBy экземпляры возвращаются вызовами groupby pandas.DataFrame.groupby() и pandas.Series.groupby() соответственно.
Индексирование, итерация
Итератор groupby. | |
Итератор groupby. | |
Словарь {имя группы -> метки группы}. | |
Словарь {имя группы -> метки группы}. | |
Словарь {имя группы -> индексы группы}. | |
Словарь {имя группы -> индексы группы}. | |
| Создать DataFrame из группы с указанным именем. |
| Создать Series из группы с указанным именем. |
| Grouper позволяет пользователю задать инструкцию groupby для объекта. |
Помощник для применения функций
| Помощник для агрегирования по столбцам с контролем имен выходных столбцов. |
Применение функций
| Применить функцию |
| Применить функцию |
| Агрегировать используя одну или несколько операций по указанной оси. |
| Агрегировать используя одну или несколько операций по указанной оси. |
| Агрегировать используя одну или несколько операций по указанной оси. |
| Агрегировать используя одну или несколько операций по указанной оси. |
| Вызвать функцию, возвращающую Series с теми же индексами для каждой группы. |
| Вызвать функцию, возвращающую DataFrame с теми же индексами для каждой группы. |
| Применить функцию |
| Применить функцию |
| Фильтрует элементы из групп, не удовлетворяющих критерию. |
| Фильтрует элементы из групп, не удовлетворяющих критерию. |
DataFrameGroupBy вычисления / описательные статистики
| Возвращает True, если все значения в группе истинны, иначе False. |
| Возвращает True, если хотя бы одно значение в группе истинно, иначе False. |
| Заполняет значения обратным заполнением. |
| Вычисляет парную корреляцию столбцов, исключая значения NA/null. |
| Вычисляет парную корреляцию. |
Вычисляет количество в группе, исключая пропущенные значения. | |
| Вычисляет парную ковариацию столбцов, исключая значения NA/null. |
| Пронумеруйте каждый элемент в каждой группе от 0 до длины этой группы - 1. |
| Накопительный максимум для каждой группы. |
| Накопительный минимум для каждой группы. |
| Накопительное произведение для каждой группы. |
| Накопительная сумма для каждой группы. |
| Генерирует описательные статистики. |
| Первое дискретное различие элемента. |
| Заполняет значения вперёд. |
| (УСТЕРЕЖДАЕТСЯ) Заполняет пропущенные значения NA/NaN с помощью указанного метода в группах. |
| Вычислить первый элемент каждого столбца в каждой группе. |
Возвращает первые n строк каждой группы. | |
| Возвращает индекс первого появления максимума по запрошенной оси. |
| Возвращает индекс первого появления минимума по запрошенной оси. |
| Вычислить последний элемент каждого столбца в каждой группе. |
| Вычислить максимум значений группы. |
| Вычислить среднее значение групп, исключая пропущенные значения. |
| Вычислить медиану групп, исключая пропущенные значения. |
| Вычислить минимум значений группы. |
| Пронумеруйте каждую группу от 0 до количества групп - 1. |
Взять n-ю строку из каждой группы, если n - целое число, в противном случае подмножество строк. | |
| Возвращает DataFrame со счётчиками уникальных элементов в каждой позиции. |
Вычисляет открытие, максимум, минимум и закрытие группы, исключая пропущенные значения. | |
| Вычисляет процентное изменение каждого значения по предыдущему элементу в группе. |
| Вычислить произведение значений группы. |
| Возвращает значения группы в заданном квантиле, подобно numpy.percentile. |
| Предоставляет ранг значений в каждой группе. |
| Обеспечивает ресемплирование при использовании TimeGrouper. |
| Возвращает скользящий агрегатор, предоставляющий скользящую функциональность по группам. |
| Возвращает случайную выборку элементов из каждой группы. |
| Вычисляет стандартную ошибку среднего арифметического для групп, исключая пропущенные значения. |
| Смещает каждую группу на заданное количество наблюдений. |
Вычисляет размеры групп. | |
| Возвращает несмещённое значение асимметрии внутри групп. |
| Вычисляет стандартное отклонение групп, исключая пропущенные значения. |
| Вычисляет сумму значений в группах. |
| Вычисляет дисперсию групп, исключая пропущенные значения. |
Возвращает последние n строк каждой группы. | |
| Возвращает элементы из заданных позиционных индексов в каждой группе. |
| Возвращает Series или DataFrame, содержащий подсчет уникальных строк. |
SeriesGroupBy вычисления / описательные статистики
| Возвращает True, если все значения в группе истинны, иначе False. |
| Возвращает True, если хотя бы одно значение в группе истинно, иначе False. |
| Заполнение значений методом «обратного заполнения». |
| Вычисление корреляции с серией other, исключая пропущенные значения. |
Вычисление количества элементов в группе, исключая пропущенные значения. | |
| Вычисление ковариации с серией, исключая пропущенные значения. |
| Пронумеровать каждый элемент в каждой группе от 0 до длины этой группы - 1. |
| Накопительный максимум для каждой группы. |
| Накопительный минимум для каждой группы. |
| Накопительное произведение для каждой группы. |
| Накопительная сумма для каждой группы. |
| Генерация описательных статистик. |
| Первая дискретная разность элемента. |
| Заполнение значений методом «вперед заполнить». |
| (УСТАРЕЛО) Заполнение пропущенных значений (NA/NaN) указанным методом внутри групп. |
| Вычисление первого значения каждого столбца в каждой группе. |
| Возвращение первых n строк каждой группы. |
| Вычисление последнего значения каждого столбца в каждой группе. |
| Возвращает метку строки с максимальным значением. |
| Возвращает метку строки с минимальным значением. |
Возвращает, являются ли значения каждой группы монотонно возрастающими. | |
Возвращает, являются ли значения каждой группы монотонно убывающими. | |
| Вычисление максимального значения в группе. |
| Вычисление среднего значения в группах, исключая пропущенные значения. |
| Вычисление медианы в группах, исключая пропущенные значения. |
| Вычисление минимального значения в группе. |
| Пронумеровать каждую группу от 0 до количества групп - 1. |
| Возвращение n наибольших элементов. |
| Возвращение n наименьших элементов. |
Извлечение n-й строки из каждой группы, если n - целое число, в противном случае подмножество строк. | |
| Возвращение количества уникальных элементов в группе. |
Возвращение уникальных значений для каждой группы. | |
Вычисление открытие, максимум, минимум и закрытие значений группы, исключая пропущенные значения. | |
| Вычисление процентного изменения каждого значения по отношению к предыдущему элементу в группе. |
| Вычисление произведения значений в группе. |
| Возвращение значений группы в заданном квантиле, аналогично numpy.percentile. |
| Определяет ранг значений внутри каждой группы. |
| Обеспечивает ресемплирование при использовании TimeGrouper. |
| Возвращает объект для скользящего усреднения, обеспечивая скользящие функции по группам. |
| Возвращает случайную выборку элементов из каждой группы. |
| Вычисляет стандартную ошибку среднего арифметического по группам, исключая пропущенные значения. |
| Смещает каждую группу на указанное количество наблюдений. |
Вычисляет размеры групп. | |
| Возвращает несмещённое значение асимметрии внутри групп. |
| Вычисляет стандартное отклонение по группам, исключая пропущенные значения. |
| Вычисляет сумму значений в группах. |
| Вычисляет дисперсию по группам, исключая пропущенные значения. |
| Возвращает последние n строк каждой группы. |
| Возвращает элементы по указанным позиционным индексам в каждой группе. |
|
Визуализация и построение графиков
| Построение диаграмм размаха для данных DataFrameGroupBy. |
| Построение гистограмм столбцов DataFrame. |
| Построение гистограммы входного ряда с использованием matplotlib. |
Построение графиков для Series или DataFrame. | |
Построение графиков для Series или DataFrame. |
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/2.2.2/reference/groupby.html