pandas.Index.drop_duplicates
- Index.drop_duplicates(*, keep='first')[source]
-
Возвращает индекс со значениями, удаленными дубликатами.
- Параметры:
-
- keep:{‘first’, ‘last’, False}, по умолчанию ‘first’
-
‘first’ : Удаляет дубликаты, за исключением первого вхождения.
‘last’ : Удаляет дубликаты, за исключением последнего вхождения.
False: Удаляет все дубликаты.
- Возвращает:
-
- Index
См. также
Series.drop_duplicates-
Эквивалентный метод для Series.
DataFrame.drop_duplicates-
Эквивалентный метод для DataFrame.
Index.duplicated-
Соответствующий метод для Index, указывающий дублирующие значения Index.
Примеры
Создайте pandas.Index со значениями-дубликатами.
>>> idx = pd.Index(['lama', 'cow', 'lama', 'beetle', 'lama', 'hippo'])
Параметр keep управляет тем, какие значения-дубликаты будут удалены. Значение ‘first’ сохраняет первое вхождение для каждого набора дублирующихся записей. Значение по умолчанию для keep равно ‘first’.
>>> idx.drop_duplicates(keep='first') Index(['lama', 'cow', 'beetle', 'hippo'], dtype='object')
Значение ‘last’ сохраняет последнее вхождение для каждого набора дублирующихся записей.
>>> idx.drop_duplicates(keep='last') Index(['cow', 'beetle', 'lama', 'hippo'], dtype='object')
Значение
Falseотбрасывает все наборы дублирующихся записей.>>> idx.drop_duplicates(keep=False) Index(['cow', 'beetle', 'hippo'], dtype='object')
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/2.2.2/reference/api/pandas.Index.drop_duplicates.html