pandas.DataFrame.groupby
-
DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, **kwargs) -
Группировка серии с помощью отображения (словаря или функции ключа, применение заданной функции к группе, возврат результата в виде серии) или по серии столбцов.
Параметры: by : отображение, функция / список функций, словарь, Series или кортеж /
список имён столбцов. Вызывается для каждого элемента индекса объекта, чтобы определить группы. Если передан словарь или Series, значения Series или словаря будут использованы для определения групп
axis : int, по умолчанию 0
level : int, имя уровня или последовательность таких, по умолчанию None
Если ось является MultiIndex (иерархической), группировать по определённому уровню или уровням
as_index : boolean, по умолчанию True
Для агрегированного вывода возвращать объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно обеспечивает вывод, подобный SQL, сгруппированный вывод
sort : boolean, по умолчанию True
Сортировать ключи групп. Для повышения производительности выключите это. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.
group_keys : boolean, по умолчанию True
При вызове apply добавлять ключи групп в индекс для идентификации частей
squeeze : boolean, по умолчанию False
сжать размерность типа возвращаемого значения, если это возможно, иначе вернуть согласованный тип
Возвращает: Объект GroupBy
Примеры
Результаты DataFrame
>>> data.groupby(func, axis=0).mean() >>> data.groupby(['col1', 'col2'])['col3'].mean()
DataFrame с иерархическим индексом
>>> data.groupby(['col1', 'col2']).mean()
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.DataFrame.groupby.html