pandas.Index.duplicated
-
Index.duplicated(keep='first')[source] -
Указывает дублирующие значения индекса.
Дублирующие значения указываются как
Trueзначения в результирующем массиве. Можно указать все дубликаты, все, кроме первого, или все, кроме последнего вхождения дубликатов.Параметры: keep : {‘first’, ‘last’, False}, по умолчанию ‘first’
Значение или значения в наборе дубликатов, которые нужно пометить как отсутствующие.
- ‘first’ : Пометить дубликаты как
Trueза исключением первого вхождения. - ‘last’ : Пометить дубликаты как
Trueза исключением последнего вхождения. -
False: Пометить все дубликаты какTrue.
Возвращает: - numpy.ndarray
См. также
-
pandas.Series.duplicated - Эквивалентный метод для pandas.Series
-
pandas.DataFrame.duplicated - Эквивалентный метод для pandas.DataFrame
-
pandas.Index.drop_duplicates - Удалить дублирующие значения из индекса
Примеры
По умолчанию для каждого набора дубликатов первое вхождение устанавливается в False, а все остальные — в True:
>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama']) >>> idx.duplicated() array([False, False, True, False, True])
что эквивалентно
>>> idx.duplicated(keep='first') array([False, False, True, False, True])
Используя ‘last’, последнее вхождение каждого набора дубликатов устанавливается в False, а все остальные — в True:
>>> idx.duplicated(keep='last') array([ True, False, True, False, False])
Установив keep на
False, все дубликаты устанавливаются в True:>>> idx.duplicated(keep=False) array([ True, False, True, False, True])
- ‘first’ : Пометить дубликаты как
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Index.duplicated.html