Spec-Zone.ru › pandas 0.22

pandas.cut

pandas.cut(x, bins, right=True, labels=None, retbins=False, precision=3, include_lowest=False) [source]

Возвращает индексы полуоткрытых интервалов, к которым относится каждое значение x.

Параметры:

x : массив-подобный объект

Входной массив для разбиения. Он должен быть одномерным.

bins : целое число, последовательность скаляров или IntervalIndex

Если bins является целым числом, оно определяет количество равномерно широких интервалов в диапазоне x. Однако в этом случае диапазон x расширяется на 0,1% с каждой стороны, чтобы включить минимальное и максимальное значения x. Если bins является последовательностью, она определяет границы интервалов, что позволяет использовать неравномерную ширину интервалов. В этом случае диапазон x не расширяется.

right : bool, необязательно

Указывает, включает ли интервал правую границу или нет. Если right == True (по умолчанию), то интервалы [1,2,3,4] указывают на (1,2], (2,3], (3,4].

labels : массив или булево значение, по умолчанию None

Используется в качестве меток для результирующих интервалов. Должен иметь такую же длину, как и результирующие интервалы. Если False, возвращаются только целочисленные индикаторы интервалов.

retbins : bool, необязательно

Возвращать интервалы или нет. Может быть полезно, если bins задано как скаляр.

precision : int, необязательно

Точность хранения и отображения меток интервалов

include_lowest : bool, необязательно

Первый интервал должен быть включительно слева или нет.

Возвращаемое значение:

out : Categorical или Series или массив целых чисел, если labels равно False

Тип возвращаемого значения (Categorical или Series) зависит от входных данных: Series типа category, если входной параметр — Series, иначе Categorical. Интервалы представлены в виде категорий, когда возвращаются категориальные данные.

bins : массив float

Возвращается только если retbins равно True.

Примечания

Функция cut может быть полезна для перехода от непрерывной переменной к категориальной переменной. Например, cut может преобразовать возраста в группы возрастных диапазонов.

Любые значения NA будут NA в результате. Значения вне диапазона будут NA в результирующем объекте Categorical.

Примеры

>>> pd.cut(np.array([.2, 1.4, 2.5, 6.2, 9.7, 2.1]), 3, retbins=True)
... 
([(0.19, 3.367], (0.19, 3.367], (0.19, 3.367], (3.367, 6.533], ...
Categories (3, interval[float64]): [(0.19, 3.367] < (3.367, 6.533] ...
>>> pd.cut(np.array([.2, 1.4, 2.5, 6.2, 9.7, 2.1]),
...        3, labels=["good", "medium", "bad"])
... 
[good, good, good, medium, bad, good]
Categories (3, object): [good < medium < bad]
>>> pd.cut(np.ones(5), 4, labels=False)
array([1, 1, 1, 1, 1])

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.22.0/generated/pandas.cut.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API