Spec-Zone.ru › pandas 0.24

GroupBy

Объекты GroupBy возвращаются вызовами groupby: pandas.DataFrame.groupby(), pandas.Series.groupby() и т. д.

Индексирование, итерация

GroupBy.__iter__() Итератор Groupby.
GroupBy.groups Словарь {имя группы -> метки группы}.
GroupBy.indices Словарь {имя группы -> индексы группы}.
GroupBy.get_group(name[, obj]) Создаёт NDFrame из группы с указанным именем.
Grouper([key, level, freq, axis, sort]) Grouper позволяет пользователю указать инструкцию groupby для целевого объекта

Применение функций

GroupBy.apply(func, *args, **kwargs) Применяет функцию func к каждой группе и объединяет результаты.
GroupBy.agg(func, *args, **kwargs)
GroupBy.aggregate(func, *args, **kwargs)
GroupBy.transform(func, *args, **kwargs)
GroupBy.pipe(func, *args, **kwargs) Применяет функцию func с аргументами к этому объекту GroupBy и возвращает результат функции.

Вычисления / Описательные статистики

GroupBy.all([skipna]) Возвращает True, если все значения в группе истинны, иначе False.
GroupBy.any([skipna]) Возвращает True, если какое-либо значение в группе истинно, иначе False.
GroupBy.bfill([limit]) Заполнение значений путём обратного заполнения.
GroupBy.count() Вычисляет количество элементов в группе, исключая пропущенные значения.
GroupBy.cumcount([ascending]) Нумерует каждый элемент в каждой группе от 0 до длины этой группы минус 1.
GroupBy.ffill([limit]) Заполнение значений путём прямого заполнения.
GroupBy.first(**kwargs) Вычисляет первое значение в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.head([n]) Возвращает первые n строк каждой группы.
GroupBy.last(**kwargs) Вычисляет последнее значение в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.max(**kwargs) Вычисляет максимальное значение в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.mean(*args, **kwargs) Вычисляет среднее значение в группе, исключая пропущенные значения.
GroupBy.median(**kwargs) Вычисляет медианное значение в группе, исключая пропущенные значения.
GroupBy.min(**kwargs) Вычисляет минимальное значение в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.ngroup([ascending]) Нумерует каждую группу от 0 до количества групп минус 1.
GroupBy.nth(n[, dropna]) Возвращает n-ую строку из каждой группы, если n — целое число, или подмножество строк, если n — список целых чисел.
GroupBy.ohlc() Вычисляет сумму значений, исключая пропущенные значения.
GroupBy.prod(**kwargs) Вычисляет произведение значений в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.rank([method, ascending, na_option, …]) Предоставляет ранг значений в каждой группе.
GroupBy.pct_change([periods, fill_method, …]) Вычисляет процентное изменение каждого значения относительно предыдущего значения в группе.
GroupBy.size() Вычисляет размеры групп.
GroupBy.sem([ddof]) Вычисляет стандартную ошибку среднего по группам, исключая пропущенные значения.
GroupBy.std([ddof]) Вычисляет стандартное отклонение по группам, исключая пропущенные значения.
GroupBy.sum(**kwargs) Вычисляет сумму значений в группе. См. также ——– pandas.Series.groupby pandas.DataFrame.groupby pandas.Panel.groupby
GroupBy.var([ddof]) Вычисляет дисперсию по группам, исключая пропущенные значения.
GroupBy.tail([n]) Возвращает последние n строк каждой группы.

Следующие методы доступны как в объектах SeriesGroupBy , так и в DataFrameGroupBy, но могут незначительно отличаться, обычно в том, что версия DataFrameGroupBy обычно допускает указание аргумента axis и часто аргумента, указывающего на ограничение применения к столбцам определённого типа данных.

END_OF_DOCUMENT_MARKER
DataFrameGroupBy.all([skipna]) Возвращает True, если все значения в группе истинны, иначе False.
DataFrameGroupBy.any([skipna]) Возвращает True, если хотя бы одно значение в группе истинно, иначе False.
DataFrameGroupBy.bfill([limit]) Заполняет значения методом "backward fill".
DataFrameGroupBy.corr Вычисляет парную корреляцию столбцов, исключая значения NA/null.
DataFrameGroupBy.count() Вычисляет количество элементов в группе, исключая пропущенные значения.
DataFrameGroupBy.cov Вычисляет парную ковариацию столбцов, исключая значения NA/null.
DataFrameGroupBy.cummax([axis]) Кумуляльный максимум для каждой группы.
DataFrameGroupBy.cummin([axis]) Кумуляльный минимум для каждой группы.
DataFrameGroupBy.cumprod([axis]) Кумуляльное произведение для каждой группы.
DataFrameGroupBy.cumsum([axis]) Кумуляльная сумма для каждой группы.
DataFrameGroupBy.describe(**kwargs) Генерирует описательные статистики, которые суммируют центральную тенденцию, дисперсию и форму распределения набора данных, исключая значения NaN.
DataFrameGroupBy.diff Первая дискретная разность элемента.
DataFrameGroupBy.ffill([limit]) Заполняет значения методом "forward fill".
DataFrameGroupBy.fillna Заполняет значения NA/NaN с помощью указанного метода.
DataFrameGroupBy.filter(func[, dropna]) Возвращает копию DataFrame, исключая элементы из групп, которые не удовлетворяют булевому критерию, заданному функцией func.
DataFrameGroupBy.hist Создает гистограмму данных DataFrame.
DataFrameGroupBy.idxmax Возвращает индекс первого вхождения максимального значения по указанной оси.
DataFrameGroupBy.idxmin Возвращает индекс первого вхождения минимального значения по указанной оси.
DataFrameGroupBy.mad Возвращает среднее абсолютное отклонение значений для указанной оси.
DataFrameGroupBy.pct_change([periods, …]) Вычисляет процентное изменение каждого значения по отношению к предыдущему в группе.
DataFrameGroupBy.plot Класс, реализующий атрибут .plot для объектов groupby.
DataFrameGroupBy.quantile Возвращает значения заданного квантиля по указанной оси.
DataFrameGroupBy.rank([method, ascending, …]) Предоставляет ранг значений внутри каждой группы.
DataFrameGroupBy.resample(rule, *args, **kwargs) Обеспечивает ресемплирование при использовании TimeGrouper.
DataFrameGroupBy.shift([periods, freq, …]) Сдвигает каждую группу на заданное количество наблюдений.
DataFrameGroupBy.size() Вычисляет размеры групп.
DataFrameGroupBy.skew Возвращает несмещенное эксцесс по указанной оси. Нормализованное на N-1.
DataFrameGroupBy.take Возвращает элементы по заданным позиционным индексам вдоль оси.
DataFrameGroupBy.tshift Сдвигает временной индекс, используя частоту индекса, если она доступна.

Следующие методы доступны только для объектов SeriesGroupBy.

SeriesGroupBy.nlargest Возвращает n наибольших элементов.
SeriesGroupBy.nsmallest Возвращает n наименьших элементов.
SeriesGroupBy.nunique([dropna]) Возвращает количество уникальных элементов в группе.
SeriesGroupBy.unique Возвращает уникальные значения объекта Series.
SeriesGroupBy.value_counts([normalize, …])
SeriesGroupBy.is_monotonic_increasing Возвращает булево значение, если значения в объекте монотонно возрастают.
SeriesGroupBy.is_monotonic_decreasing Возвращает булево значение, если значения в объекте монотонно убывают.

Следующие методы доступны только для DataFrameGroupBy объектов.

DataFrameGroupBy.corrwith Вычисляет парную корреляцию между строками или столбцами DataFrame со строками или столбцами Series или DataFrame.
DataFrameGroupBy.boxplot([subplots, column, …]) Создает диаграммы размаха из данных DataFrameGroupBy.

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.24.2/reference/groupby.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API