Spec-Zone.ru › pandas 0.25

pandas.Index.drop_duplicates

Index.drop_duplicates(self, keep='first') [source]

Возвращает индекс со удаленными дублирующимися значениями.

Параметры:
keep : {‘first’, ‘last’, False}, default ‘first’
  • ‘first’ : Удаляет дубликаты, оставляя только первое вхождение.
  • ‘last’ : Удаляет дубликаты, оставляя только последнее вхождение.
  • False : Удаляет все дубликаты.
Возвращает:
deduplicated : Index

См. также

Series.drop_duplicates
Эквивалентный метод для Series.
DataFrame.drop_duplicates
Эквивалентный метод для DataFrame.
Index.duplicated
Связанный метод для Index, указывающий на дубликаты значений Index.

Примеры

Создать pandas.Index с дублирующимися значениями.

>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama', 'hippo'])

Параметр keep управляет тем, какие дубликаты будут удалены. Значение ‘first’ сохраняет первое вхождение для каждого набора дублирующихся элементов. Значение по умолчанию параметра keep — ‘first’.

>>> idx.drop_duplicates(keep='first')
Index(['lama', 'cow', 'beetle', 'hippo'], dtype='object')

Значение ‘last’ сохраняет последнее вхождение для каждого набора дублирующихся элементов.

>>> idx.drop_duplicates(keep='last')
Index(['cow', 'beetle', 'lama', 'hippo'], dtype='object')

Значение False отбрасывает все наборы дублирующихся элементов.

>>> idx.drop_duplicates(keep=False)
Index(['cow', 'beetle', 'hippo'], dtype='object')

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.25.0/reference/api/pandas.Index.drop_duplicates.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API