pandas.DataFrame.groupby
-
DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs)[source] -
Группировка серии с помощью отображения (словарь или функция ключа, применение заданной функции к группе, возврат результата в виде серии) или по серии столбцов.
Параметры: by : отображение, функция, метка или список меток
Используется для определения групп для группировки. Если
byявляется функцией, она вызывается для каждого значения индекса объекта. Если передаётся словарь или Series, значения Series или словаря будут использоваться для определения групп (Series сначала выравниваются; см. метод.align()). Если передаётся массив ndarray, значения используются напрямую для определения групп. Метка или список меток могут быть переданы для группировки по столбцам вself. Обратите внимание, что кортеж интерпретируется как (один) ключ.-
axis : int, default 0
level : целое число, имя уровня или последовательность таких значений, по умолчанию None
Если ось является многоуровневым индексом (иерархическим), группировка выполняется по определённому уровню или уровням
as_index : булево значение, по умолчанию True
Для агрегированного вывода возвращается объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно соответствует группированному выводу в стиле SQL
sort : булево значение, по умолчанию True
Сортировать ключи групп. Для повышения производительности выключите это. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.
group_keys : булево значение, по умолчанию True
При вызове apply добавлять ключи групп в индекс для идентификации фрагментов
squeeze : булево значение, по умолчанию False
если возможно, уменьшить размерность типа возвращаемого значения, в противном случае вернуть согласованный тип
observed : булево значение, по умолчанию False
Это относится только в том случае, если какие-либо группирующие переменные являются категориальными. Если True: отображать только наблюдаемые значения для категориальных группирующих переменных. Если False: отображать все значения для категориальных группирующих переменных.
Добавлена в версии 0.23.0.
Возвращаемое значение: - Объект GroupBy
См. также
-
resample - Удобный метод для преобразования частоты и повторной выборки временных рядов.
Примечания
См. руководство пользователя для получения дополнительной информации.
Примеры
Результаты DataFrame
>>> data.groupby(func, axis=0).mean() >>> data.groupby(['col1', 'col2'])['col3'].mean()
DataFrame с иерархическим индексом
>>> data.groupby(['col1', 'col2']).mean()
-
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.DataFrame.groupby.html