pandas.Index.drop_duplicates
-
Index.drop_duplicates(self, keep='first')[source] -
Возвращает индекс со удаленными дублирующимися значениями.
Параметры: -
keep : {‘first’, ‘last’, False}, default ‘first’ -
- ‘first’ : Удаляет дубликаты, оставляя только первое вхождение.
- ‘last’ : Удаляет дубликаты, оставляя только последнее вхождение.
-
False: Удаляет все дубликаты.
Возвращает: -
deduplicated : Index
См. также
-
Series.drop_duplicates - Эквивалентный метод для Series.
-
DataFrame.drop_duplicates - Эквивалентный метод для DataFrame.
-
Index.duplicated - Связанный метод для Index, указывающий на дубликаты значений Index.
Примеры
Создать pandas.Index с дублирующимися значениями.
>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama', 'hippo'])
Параметр
keepуправляет тем, какие дубликаты будут удалены. Значение ‘first’ сохраняет первое вхождение для каждого набора дублирующихся элементов. Значение по умолчанию параметра keep — ‘first’.>>> idx.drop_duplicates(keep='first') Index(['lama', 'cow', 'beetle', 'hippo'], dtype='object')
Значение ‘last’ сохраняет последнее вхождение для каждого набора дублирующихся элементов.
>>> idx.drop_duplicates(keep='last') Index(['cow', 'beetle', 'lama', 'hippo'], dtype='object')
Значение
Falseотбрасывает все наборы дублирующихся элементов.>>> idx.drop_duplicates(keep=False) Index(['cow', 'beetle', 'hippo'], dtype='object')
-
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.25.0/reference/api/pandas.Index.drop_duplicates.html