Spec-Zone.ru › pandas 1

pandas.Series.duplicated

Series.duplicated(keep='first')[source]

Указывает дубликаты значений Series.

Дубликаты значений указываются как значения True в результирующем Series. Можно указать все дубликаты, все, кроме первого, или все, кроме последнего появления дубликатов.

Параметры
keep:{‘first’, ‘last’, False}, по умолчанию ‘first’

Метод обработки удаления дубликатов:

  • ‘first’ : Отмечает дубликаты как True за исключением первого появления.

  • ‘last’ : Отмечает дубликаты как True за исключением последнего появления.

  • False : Отмечает все дубликаты как True.

Возвращает
Series[bool]

Series, указывающие, появилось ли каждое значение в предыдущих значениях.

См. также

Index.duplicated

Эквивалентный метод для pandas.Index.

DataFrame.duplicated

Эквивалентный метод для pandas.DataFrame.

Series.drop_duplicates

Удаляет дубликаты значений из Series.

Примеры

По умолчанию для каждого набора дубликатов первое вхождение устанавливается в False, а все остальные — в True:

>>> animals = pd.Series(['lama', 'cow', 'lama', 'beetle', 'lama'])
>>> animals.duplicated()
0    False
1    False
2     True
3    False
4     True
dtype: bool

что эквивалентно

>>> animals.duplicated(keep='first')
0    False
1    False
2     True
3    False
4     True
dtype: bool

Используя ‘last’, последнее вхождение каждого набора дубликатов устанавливается в False, а все остальные — в True:

>>> animals.duplicated(keep='last')
0     True
1    False
2     True
3    False
4    False
dtype: bool

Установив keep на False, все дубликаты устанавливаются в True:

>>> animals.duplicated(keep=False)
0     True
1    False
2     True
3    False
4     True
dtype: bool

© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/1.5.0/reference/api/pandas.Series.duplicated.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API