pandas.Series.groupby
-
Series.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs)[source] -
Группировка серии данных с использованием отображения (словаря или функции, применяемой к группам, результат возвращается как серия) или по серии столбцов.
Параметры: by : отображение, функция, метка или список меток
Используется для определения групп для группировки. Если
byявляется функцией, она вызывается для каждого значения индекса объекта. Если передается словарь или серия, значения серии или словаря будут использованы для определения групп (серия предварительно выравнивается; см. метод.align()). Если передается массив NumPy, значения используются непосредственно для определения групп. Метка или список меток могут быть переданы для группировки по столбцам вself. Обратите внимание, что кортеж интерпретируется как (один) ключ.-
axis : int, default 0
level : целое число, имя уровня или последовательность таких, по умолчанию None
Если ось является многоуровневым индексом (иерархическим), группировка выполняется по определённому уровню или уровням.
as_index : булево значение, по умолчанию True
Для агрегированного вывода возвращается объект с метками групп в качестве индекса. Актуально только для входных данных DataFrame. as_index=False эффективно соответствует выводу группировки в стиле SQL.
sort : булево значение, по умолчанию True
Сортировать ключи групп. Для лучшей производительности отключите эту опцию. Обратите внимание, что это не влияет на порядок наблюдений в каждой группе. groupby сохраняет порядок строк внутри каждой группы.
group_keys : булево значение, по умолчанию True
При вызове apply добавлять ключи групп в индекс для идентификации фрагментов
squeeze : булево значение, по умолчанию False
Сжимать размерность возвращаемого типа, если возможно, иначе возвращать согласованный тип
observed : булево значение, по умолчанию False
Это применимо только если какой-либо из группирующих элементов является категориальным. Если True: отображаются только наблюдаемые значения для категориальных группирующих элементов. Если False: отображаются все значения для категориальных группирующих элементов.
Добавлено в версии 0.23.0.
Возвращает: - Объект GroupBy
См. также
-
resample - Удобный метод для преобразования частоты и ресемплирования временных рядов.
Примечания
Дополнительную информацию см. в руководстве пользователя.
Примеры
Результаты DataFrame
>>> data.groupby(func, axis=0).mean() >>> data.groupby(['col1', 'col2'])['col3'].mean()
DataFrame с иерархическим индексом
>>> data.groupby(['col1', 'col2']).mean()
-
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Series.groupby.html