pandas.DataFrame.groupby
-
DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, **kwargs)[source] -
Группировка серии с помощью отображения (словарь или функция ключа, применение заданной функции к группе, возврат результата в виде серии) или по серии столбцов.
Параметры: by : отображение/список функций, словарь, Series или кортеж /
список имён столбцов. Применяется к каждому элементу индекса объекта для определения групп. Если передан словарь или Series, значения Series или словаря будут использованы для определения групп
axis : int, по умолчанию 0
level : int, имя уровня или последовательность таких, по умолчанию None
Если ось является MultiIndex (иерархической), группировка происходит по определённому уровню или уровням
as_index : boolean, по умолчанию True
Для агрегированных результатов вернуть объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно даёт результат группировки в стиле SQL
sort : boolean, по умолчанию True
Сортировать ключи групп. Для большей производительности отключить. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.
group_keys : boolean, по умолчанию True
При вызове apply добавлять ключи групп к индексу для идентификации фрагментов
squeeze : boolean, по умолчанию False
свести размерность типа возвращаемого значения, если это возможно, в противном случае вернуть согласованный тип
Возвращаемое значение: Объект GroupBy
Примеры
Результаты DataFrame
>>> data.groupby(func, axis=0).mean() >>> data.groupby(['col1', 'col2'])['col3'].mean()
DataFrame с иерархическим индексом
>>> data.groupby(['col1', 'col2']).mean()
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.19.2/generated/pandas.DataFrame.groupby.html