pandas.Index.duplicated
- Index.duplicated(keep='first')[source]
-
Указывает дублирующиеся значения индекса.
Дублирующиеся значения указываются как
Trueзначения в результирующем массиве. Можно указать все дубликаты, все дубликаты кроме первого или все дубликаты кроме последнего.- Параметры:
-
- keep:{‘first’, ‘last’, False}, по умолчанию ‘first’
-
Значение или значения в наборе дубликатов, которые нужно пометить как отсутствующие.
‘first’ : Помечает дубликаты как
Trueза исключением первого вхождения.‘last’ : Помечает дубликаты как
Trueза исключением последнего вхождения.False : Помечает все дубликаты как
True.
- Возвращает:
-
- np.ndarray[bool]
См. также
Series.duplicated-
Эквивалентный метод для pandas.Series.
DataFrame.duplicated-
Эквивалентный метод для pandas.DataFrame.
Index.drop_duplicates-
Удаление дублирующих значений из Index.
Примеры
По умолчанию для каждого набора дублирующихся значений первое вхождение устанавливается в False, а все остальные — в True:
>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama']) >>> idx.duplicated() array([False, False, True, False, True])
что эквивалентно
>>> idx.duplicated(keep='first') array([False, False, True, False, True])
Используя ‘last’, последнее вхождение каждого набора дублирующихся значений устанавливается в False, а все остальные — в True:
>>> idx.duplicated(keep='last') array([ True, False, True, False, False])
Установив keep на
False, все дубликаты будут True:>>> idx.duplicated(keep=False) array([ True, False, True, False, True])
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/2.2.2/reference/api/pandas.Index.duplicated.html