Spec-Zone.ru › pandas 0.22

pandas.DataFrame.groupby

DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, **kwargs) [source]

Группировка серии данных с помощью отображения (словарь или функция ключа, применение заданной функции к группе, возврат результата в виде серии) или по ряду столбцов.

Параметры:

by : отображение, функция, строка или итерируемый объект

Используется для определения групп для группировки. Если by является функцией, она вызывается для каждого значения индекса объекта. Если передаётся словарь или Series, значения Series или словаря будут использоваться для определения групп (значения Series предварительно выравниваются; см. метод .align()). Если передаётся массив ndarray, значения используются непосредственно для определения групп. Строка или список строк могут быть переданы для группировки по столбцам в self

axis : int, по умолчанию 0

level : int, имя уровня или последовательность таких, по умолчанию None

Если ось является многоуровневым индексом (иерархическим), группировка по конкретному уровню или уровням

as_index : boolean, по умолчанию True

Для агрегированных результатов возвращается объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно соответствует группировке в стиле SQL

sort : boolean, по умолчанию True

Сортировка ключей групп. Для лучшей производительности выключите сортировку. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. Группировка сохраняет порядок строк внутри каждой группы.

group_keys : boolean, по умолчанию True

При вызове apply добавляет ключи групп в индекс для идентификации частей

squeeze : boolean, по умолчанию False

снижает размерность типа возвращаемого значения при возможности, в противном случае возвращает согласованный тип

Возвращаемое значение:

Объект GroupBy

Примеры

Результаты DataFrame

>>> data.groupby(func, axis=0).mean()
>>> data.groupby(['col1', 'col2'])['col3'].mean()

DataFrame с иерархическим индексом

>>> data.groupby(['col1', 'col2']).mean()

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.22.0/generated/pandas.DataFrame.groupby.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API