pandas.Index.value_counts
-
Index.value_counts(self, normalize=False, sort=True, ascending=False, bins=None, dropna=True)[source] -
Возвращает Series, содержащую количество уникальных значений.
Результат будет отсортирован в порядке убывания, так что первый элемент — это наиболее часто встречающееся значение. По умолчанию значения NA исключаются.
Параметры: -
normalize : boolean, default False -
Если True, возвращаемый объект будет содержать относительные частоты уникальных значений.
-
sort : boolean, default True -
Сортировать по частотам.
-
ascending : boolean, default False -
Сортировать в порядке возрастания.
-
bins : integer, optional -
Вместо подсчёта значений, сгруппировать их в полуоткрытые интервалы, удобно для
pd.cut, работает только с числовыми данными. -
dropna : boolean, default True -
Не включать счёт NaN.
Возвращает: - Series
См. также
-
Series.count - Количество элементов, отличных от NaN, в Series.
-
DataFrame.count - Количество элементов, отличных от NaN, в DataFrame.
Примеры
>>> index = pd.Index([3, 1, 2, 3, 4, np.nan]) >>> index.value_counts() 3.0 2 4.0 1 2.0 1 1.0 1 dtype: int64
При
normalizeравномTrue, возвращает относительную частоту, деля все значения на сумму значений.>>> s = pd.Series([3, 1, 2, 3, 4, np.nan]) >>> s.value_counts(normalize=True) 3.0 0.4 4.0 0.2 2.0 0.2 1.0 0.2 dtype: float64
bins
Интервалы могут быть полезны для перехода от непрерывной переменной к категориальной; вместо подсчёта уникальных появлений значений, разделите индекс на указанное количество полуоткрытых интервалов.
>>> s.value_counts(bins=3) (2.0, 3.0] 2 (0.996, 2.0] 2 (3.0, 4.0] 1 dtype: int64
dropna
При
dropnaравномFalse, мы также можем увидеть значения NaN в индексе.>>> s.value_counts(dropna=False) 3.0 2 NaN 1 4.0 1 2.0 1 1.0 1 dtype: int64
-
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.25.0/reference/api/pandas.Index.value_counts.html