Spec-Zone.ru › pandas 0.23

pandas.Series.groupby

Series.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs) [source]

Группировка серии данных с использованием отображения (словаря или функции, применяемой к группам, результат возвращается как серия) или по серии столбцов.

Параметры:

by : отображение, функция, метка или список меток

Используется для определения групп для группировки. Если by является функцией, она вызывается для каждого значения индекса объекта. Если передается словарь или серия, значения серии или словаря будут использованы для определения групп (серия предварительно выравнивается; см. метод .align()). Если передается массив NumPy, значения используются непосредственно для определения групп. Метка или список меток могут быть переданы для группировки по столбцам в self. Обратите внимание, что кортеж интерпретируется как (один) ключ.

axis : int, default 0

level : целое число, имя уровня или последовательность таких, по умолчанию None

Если ось является многоуровневым индексом (иерархическим), группировка выполняется по определённому уровню или уровням.

as_index : булево значение, по умолчанию True

Для агрегированного вывода возвращается объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно соответствует выводу группировки в стиле SQL.

sort : булево значение, по умолчанию True

Сортировать ключи групп. Для лучшей производительности отключите эту опцию. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.

group_keys : булево значение, по умолчанию True

При вызове apply добавлять ключи групп в индекс для идентификации фрагментов

squeeze : булево значение, по умолчанию False

Сжимать размерность возвращаемого типа, если возможно, иначе возвращать согласованный тип

observed : булево значение, по умолчанию False

Это применимо только если какой-либо из группирующих элементов является категориальным. Если True: отображаются только наблюдаемые значения для категориальных группирующих элементов. Если False: отображаются все значения для категориальных группирующих элементов.

Добавлено в версии 0.23.0.

Возвращает:
Объект GroupBy

См. также

resample
Удобный метод для преобразования частоты и ресемплирования временных рядов.

Примечания

Дополнительную информацию см. в руководстве пользователя.

Примеры

Результаты DataFrame

>>> data.groupby(func, axis=0).mean()
>>> data.groupby(['col1', 'col2'])['col3'].mean()

DataFrame с иерархическим индексом

>>> data.groupby(['col1', 'col2']).mean()

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Series.groupby.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API