Spec-Zone.ru › pandas 0.19

pandas.core.groupby.DataFrameGroupBy.describe

DataFrameGroupBy.describe(percentiles=None, include=None, exclude=None)

Генерирует различные сводные статистические данные, исключая значения NaN.

Параметры:

percentiles : массив-подобный объект, необязательно

Процентили, которые необходимо включить в вывод. Все они должны находиться в интервале [0, 1]. По умолчанию percentiles — это [.25, .5, .75], возвращающие 25-й, 50-й и 75-й процентили.

include, exclude : массив-подобный объект, ‘all’ или None (по умолчанию)

Указывают форму возвращаемого результата. Либо:

  • None (по умолчанию). Результат будет содержать только числовые столбцы или, если таковых нет, только категориальные.
  • Список типов данных или строк для включения/исключения. Для выбора всех числовых типов используйте numpy numpy.number. Для выбора категориальных объектов используйте тип object. См. также документацию select_dtypes. Например: df.describe(include=[‘O’])
  • Если include — это строка ‘all’, выходной набор столбцов будет соответствовать входному.
Возвращает:

summary: NDFrame сводных статистических данных

См. также

DataFrame.select_dtypes

Примечания

Индекс выходного DataFrame зависит от запрошенных типов данных:

Для числовых типов данных он будет включать: количество, среднее значение, стандартное отклонение, минимум, максимум и нижний, 50-й и верхний процентили.

Для типов данных object (например, временных меток или строк) индекс будет включать количество, уникальные значения, наиболее часто встречающееся значение и частоту наиболее часто встречающегося значения. Временные метки также включают первые и последние элементы.

Для смешанных типов данных индекс будет представлять собой объединение соответствующих типов выходных данных. Неприменимые записи будут заполнены NaN. Обратите внимание, что выходные данные смешанных типов могут быть возвращены только из входных данных смешанных типов и при соответствующем использовании аргументов include/exclude.

Если несколько значений имеют наибольшее количество, то пара count и most common будет произвольно выбрана из тех, что имеют наибольшее количество.

Аргументы include, exclude игнорируются для Series.

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.19.2/generated/pandas.core.groupby.DataFrameGroupBy.describe.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API