pandas.core.groupby.DataFrameGroupBy.describe
-
DataFrameGroupBy.describe(percentiles=None, include=None, exclude=None) -
Генерирует различные сводные статистические данные, исключая значения NaN.
Параметры: percentiles : массив-подобный объект, необязательно
Процентили, которые необходимо включить в вывод. Все они должны находиться в интервале [0, 1]. По умолчанию
percentiles— это [.25, .5, .75], возвращающие 25-й, 50-й и 75-й процентили.include, exclude : массив-подобный объект, ‘all’ или None (по умолчанию)
Указывают форму возвращаемого результата. Либо:
- None (по умолчанию). Результат будет содержать только числовые столбцы или, если таковых нет, только категориальные.
- Список типов данных или строк для включения/исключения. Для выбора всех числовых типов используйте numpy numpy.number. Для выбора категориальных объектов используйте тип object. См. также документацию select_dtypes. Например: df.describe(include=[‘O’])
- Если include — это строка ‘all’, выходной набор столбцов будет соответствовать входному.
Возвращает: summary: NDFrame сводных статистических данных
См. также
DataFrame.select_dtypesПримечания
Индекс выходного DataFrame зависит от запрошенных типов данных:
Для числовых типов данных он будет включать: количество, среднее значение, стандартное отклонение, минимум, максимум и нижний, 50-й и верхний процентили.
Для типов данных object (например, временных меток или строк) индекс будет включать количество, уникальные значения, наиболее часто встречающееся значение и частоту наиболее часто встречающегося значения. Временные метки также включают первые и последние элементы.
Для смешанных типов данных индекс будет представлять собой объединение соответствующих типов выходных данных. Неприменимые записи будут заполнены NaN. Обратите внимание, что выходные данные смешанных типов могут быть возвращены только из входных данных смешанных типов и при соответствующем использовании аргументов include/exclude.
Если несколько значений имеют наибольшее количество, то пара
countиmost commonбудет произвольно выбрана из тех, что имеют наибольшее количество.Аргументы include, exclude игнорируются для Series.
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.19.2/generated/pandas.core.groupby.DataFrameGroupBy.describe.html