Spec-Zone.ru › pandas 0.18

pandas.crosstab

pandas.crosstab(index, columns, values=None, rownames=None, colnames=None, aggfunc=None, margins=False, dropna=True, normalize=False)

Вычислить простую сводную таблицу двух (или более) факторов. По умолчанию вычисляет таблицу частот факторов, если не переданы массив значений и функция агрегирования

Параметры:

index : массив-подобный объект, Series или список массивов/Series

Значения для группировки по строкам

columns : массив-подобный объект, Series или список массивов/Series

Значения для группировки по столбцам

values : массив-подобный объект, необязательно

Массив значений для агрегирования в соответствии с факторами. Требуется aggfunc.

aggfunc : функция, необязательно

Если указано, требует values также.

rownames : последовательность, по умолчанию None

Если передано, должно соответствовать количеству переданных массивов строк

colnames : последовательность, по умолчанию None

Если передано, должно соответствовать количеству переданных массивов столбцов

margins : булево значение, по умолчанию False

Добавить поля итогов строк/столбцов (подсчёты)

dropna : булево значение, по умолчанию True

Не включать столбцы, чьи значения — все NaN

normalize : булево значение, {'all', 'index', 'columns'} или {0,1}, по умолчанию False

Нормализовать, разделив все значения на сумму значений.

  • Если передано 'all' или True, будет нормализовано по всем значениям.
  • Если передано 'index' будет нормализовано по каждой строке.
  • Если передано 'columns' будет нормализовано по каждому столбцу.
  • Если margins равно True, также будут нормализованы значения итогов.

Новое в версии 0.18.1.

Возвращаемое значение:

crosstab : DataFrame

Примечания

Любые Series, переданные в функцию, будут использовать свои атрибуты имён, если не указаны имена строк или столбцов для сводной таблицы

В случае отсутствия перекрывающихся индексов будет возвращена пустая DataFrame.

Примеры

>>> a
array([foo, foo, foo, foo, bar, bar,
       bar, bar, foo, foo, foo], dtype=object)
>>> b
array([one, one, one, two, one, one,
       one, two, two, two, one], dtype=object)
>>> c
array([dull, dull, shiny, dull, dull, shiny,
       shiny, dull, shiny, shiny, shiny], dtype=object)
>>> crosstab(a, [b, c], rownames=['a'], colnames=['b', 'c'])
b    one          two
c    dull  shiny  dull  shiny
a
bar  1     2      1     0
foo  2     2      1     2

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.crosstab.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API