Spec-Zone.ru › pandas 0.23

pandas.Series.duplicated

Series.duplicated(keep='first') [source]

Указывает дублирующиеся значения Series.

Дублирующиеся значения указываются как True значения в результирующем Series. Можно указать все дубликаты, все дубликаты, кроме первого или все дубликаты, кроме последнего.

Параметры:

keep : {‘first’, ‘last’, False}, по умолчанию ‘first’

  • ‘first’ : Отметить дубликаты как True за исключением первого вхождения.
  • ‘last’ : Отметить дубликаты как True за исключением последнего вхождения.
  • False : Отметить все дубликаты как True.
Возвращает:
pandas.core.series.Series

См. также

pandas.Index.duplicated
Эквивалентный метод для pandas.Index
pandas.DataFrame.duplicated
Эквивалентный метод для pandas.DataFrame
pandas.Series.drop_duplicates
Удалить дублирующие значения из Series

Примеры

По умолчанию для каждого набора дублирующих значений первое вхождение устанавливается в False, а все остальные — в True:

>>> animals = pd.Series(['lama', 'cow', 'lama', 'beetle', 'lama'])
>>> animals.duplicated()
0    False
1    False
2     True
3    False
4     True
dtype: bool

что эквивалентно

>>> animals.duplicated(keep='first')
0    False
1    False
2     True
3    False
4     True
dtype: bool

Используя ‘last’, последнее вхождение каждого набора дублирующих значений устанавливается в False, а все остальные — в True:

>>> animals.duplicated(keep='last')
0     True
1    False
2     True
3    False
4    False
dtype: bool

Установив keep на False, все дубликаты устанавливаются в True:

>>> animals.duplicated(keep=False)
0     True
1    False
2     True
3    False
4     True
dtype: bool

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.Series.duplicated.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API