Spec-Zone.ru › pandas 0.23

pandas.DataFrame.groupby

DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs) [source]

Группировка серии с помощью отображения (словарь или функция ключа, применение заданной функции к группе, возврат результата в виде серии) или по серии столбцов.

Параметры:

by : отображение, функция, метка или список меток

Используется для определения групп для группировки. Если by является функцией, она вызывается для каждого значения индекса объекта. Если передаётся словарь или Series, значения Series или словаря будут использоваться для определения групп (Series сначала выравниваются; см. метод .align()). Если передаётся массив ndarray, значения используются напрямую для определения групп. Метка или список меток могут быть переданы для группировки по столбцам в self. Обратите внимание, что кортеж интерпретируется как (один) ключ.

axis : int, default 0

level : целое число, имя уровня или последовательность таких значений, по умолчанию None

Если ось является многоуровневым индексом (иерархическим), группировка выполняется по определённому уровню или уровням

as_index : булево значение, по умолчанию True

Для агрегированного вывода возвращается объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно соответствует группированному выводу в стиле SQL

sort : булево значение, по умолчанию True

Сортировать ключи групп. Для повышения производительности выключите это. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.

group_keys : булево значение, по умолчанию True

При вызове apply добавлять ключи групп в индекс для идентификации фрагментов

squeeze : булево значение, по умолчанию False

если возможно, уменьшить размерность типа возвращаемого значения, в противном случае вернуть согласованный тип

observed : булево значение, по умолчанию False

Это относится только в том случае, если какие-либо группирующие переменные являются категориальными. Если True: отображать только наблюдаемые значения для категориальных группирующих переменных. Если False: отображать все значения для категориальных группирующих переменных.

Добавлена в версии 0.23.0.

Возвращаемое значение:
Объект GroupBy

См. также

resample
Удобный метод для преобразования частоты и повторной выборки временных рядов.

Примечания

См. руководство пользователя для получения дополнительной информации.

Примеры

Результаты DataFrame

>>> data.groupby(func, axis=0).mean()
>>> data.groupby(['col1', 'col2'])['col3'].mean()

DataFrame с иерархическим индексом

>>> data.groupby(['col1', 'col2']).mean()

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.DataFrame.groupby.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API