Spec-Zone.ru › pandas 0.23

pandas.Index.duplicated

Index.duplicated(keep='first') [source]

Указывает дублирующие значения индекса.

Дублирующие значения указываются как True значения в результирующем массиве. Можно указать все дубликаты, все, кроме первого, или все, кроме последнего вхождения дубликатов.

Параметры:

keep : {‘first’, ‘last’, False}, по умолчанию ‘first’

Значение или значения в наборе дубликатов, которые нужно пометить как отсутствующие.

  • ‘first’ : Пометить дубликаты как True за исключением первого вхождения.
  • ‘last’ : Пометить дубликаты как True за исключением последнего вхождения.
  • False : Пометить все дубликаты как True.
Возвращает:
numpy.ndarray

См. также

pandas.Series.duplicated
Эквивалентный метод для pandas.Series
pandas.DataFrame.duplicated
Эквивалентный метод для pandas.DataFrame
pandas.Index.drop_duplicates
Удалить дублирующие значения из индекса

Примеры

По умолчанию для каждого набора дубликатов первое вхождение устанавливается в False, а все остальные — в True:

>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama'])
>>> idx.duplicated()
array([False, False,  True, False,  True])

что эквивалентно

>>> idx.duplicated(keep='first')
array([False, False,  True, False,  True])

Используя ‘last’, последнее вхождение каждого набора дубликатов устанавливается в False, а все остальные — в True:

>>> idx.duplicated(keep='last')
array([ True, False,  True, False, False])

Установив keep на False, все дубликаты устанавливаются в True:

>>> idx.duplicated(keep=False)
array([ True, False,  True, False,  True])

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Index.duplicated.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API