pandas.Series.duplicated
-
Series.duplicated(keep='first')[source] -
Указывает дублирующиеся значения Series.
Дублирующиеся значения указываются как
Trueзначения в результирующем Series. Можно указать все дубликаты, все дубликаты, кроме первого или все дубликаты, кроме последнего.Параметры: keep : {‘first’, ‘last’, False}, по умолчанию ‘first’
- ‘first’ : Отметить дубликаты как
Trueза исключением первого вхождения. - ‘last’ : Отметить дубликаты как
Trueза исключением последнего вхождения. -
False: Отметить все дубликаты какTrue.
Возвращает: - pandas.core.series.Series
См. также
-
pandas.Index.duplicated - Эквивалентный метод для pandas.Index
-
pandas.DataFrame.duplicated - Эквивалентный метод для pandas.DataFrame
-
pandas.Series.drop_duplicates - Удалить дублирующие значения из Series
Примеры
По умолчанию для каждого набора дублирующих значений первое вхождение устанавливается в False, а все остальные — в True:
>>> animals = pd.Series(['lama', 'cow', 'lama', 'beetle', 'lama']) >>> animals.duplicated() 0 False 1 False 2 True 3 False 4 True dtype: bool
что эквивалентно
>>> animals.duplicated(keep='first') 0 False 1 False 2 True 3 False 4 True dtype: bool
Используя ‘last’, последнее вхождение каждого набора дублирующих значений устанавливается в False, а все остальные — в True:
>>> animals.duplicated(keep='last') 0 True 1 False 2 True 3 False 4 False dtype: bool
Установив keep на
False, все дубликаты устанавливаются в True:>>> animals.duplicated(keep=False) 0 True 1 False 2 True 3 False 4 True dtype: bool
- ‘first’ : Отметить дубликаты как
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Series.duplicated.html