pandas.core.groupby.DataFrameGroupBy.describe
-
DataFrameGroupBy.describe(percentiles=None, include=None, exclude=None) -
Генерирует различные сводные статистические данные, исключая значения NaN.
Параметры: percentiles : array-like, необязательно
Квантили, которые нужно включить в вывод. Все они должны находиться в интервале [0, 1]. По умолчанию
percentiles— это [.25, .5, .75], возвращающие 25-ю, 50-ю и 75-ю квантили.include, exclude : список, ‘all’ или None (по умолчанию)
Укажите формат возвращаемого результата. Либо:
- None — для обоих (по умолчанию). Результат будет включать только числовые типы столбцов или, если таковых нет, только категориальные столбцы.
- Список типов данных или строк, которые нужно включить/исключить. Для выбора всех числовых типов используйте numpy numpy.number. Для выбора категориальных объектов используйте тип object. См. также документацию select_dtypes. Например, df.describe(include=[‘O’])
- Если include — это строка ‘all’, выходной набор столбцов будет соответствовать входному.
Возвращаемое значение: summary: NDFrame сводных статистических данных
См. также
DataFrame.select_dtypesПримечания
Индекс выходного DataFrame зависит от запрошенных типов данных:
Для числовых типов данных он будет включать: count, mean, std, min, max и нижние, 50-е и верхние квантили.
Для типов данных object (например, временные метки или строки) индекс будет включать count, unique, наиболее часто встречающееся значение и частоту самого часто встречающегося значения. Временные метки также включают первые и последние элементы.
Для смешанных типов данных индекс будет представлять собой объединение соответствующих типов выходных данных. Неприменимые записи будут заполнены NaN. Обратите внимание, что результаты для смешанных типов данных могут быть получены только из входных данных смешанных типов и соответствующего использования аргументов include/exclude.
Если несколько значений имеют наибольшее количество, то пара
countиmost commonбудет произвольно выбрана из тех, которые имеют наибольшее количество.Аргументы include, exclude игнорируются для Series.
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.core.groupby.DataFrameGroupBy.describe.html