pandas.Series.duplicated
- Series.duplicated(keep='first')[source]
-
Указывает дублированные значения Series.
Дублированные значения указываются как
Trueзначения в результирующем Series. Можно указать все дубликаты, все дубликаты, кроме первого или все дубликаты, кроме последнего.- Параметры:
-
- keep:{‘first’, ‘last’, False}, по умолчанию ‘first’
-
Метод обработки удаления дубликатов:
‘first’ : Помечает дубликаты как
Trueза исключением первого вхождения.‘last’ : Помечает дубликаты как
Trueза исключением последнего вхождения.False: Помечает все дубликаты какTrue.
- Возвращает:
-
- Series[bool]
-
Series, указывающий, встречалось ли каждое значение в предыдущих значениях.
См. также
Index.duplicated-
Эквивалентный метод для pandas.Index.
DataFrame.duplicated-
Эквивалентный метод для pandas.DataFrame.
Series.drop_duplicates-
Удаление дублированных значений из Series.
Примеры
По умолчанию для каждого набора дублированных значений первое вхождение устанавливается в False, а все остальные — в True:
>>> animals = pd.Series(['llama', 'cow', 'llama', 'beetle', 'llama']) >>> animals.duplicated() 0 False 1 False 2 True 3 False 4 True dtype: bool
что эквивалентно
>>> animals.duplicated(keep='first') 0 False 1 False 2 True 3 False 4 True dtype: bool
Используя ‘last’, последнее вхождение каждого набора дублированных значений устанавливается в False, а все остальные — в True:
>>> animals.duplicated(keep='last') 0 True 1 False 2 True 3 False 4 False dtype: bool
Установив keep на
False, все дубликаты будут True:>>> animals.duplicated(keep=False) 0 True 1 False 2 True 3 False 4 True dtype: bool
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/2.2.2/reference/api/pandas.Series.duplicated.html