Spec-Zone.ru › pandas 0.24

pandas.DataFrame.drop_duplicates

DataFrame.drop_duplicates(subset=None, keep='first', inplace=False) [source]

Возвращает DataFrame с удалёнными дублирующими строками, необязательно учитывая только определённые столбцы.

Параметры:
subset : column label or sequence of labels, optional

Учитывать только определённые столбцы для определения дубликатов, по умолчанию используются все столбцы

keep : {‘first’, ‘last’, False}, default ‘first’
  • first : Удалить дубликаты, за исключением первого вхождения.
  • last : Удалить дубликаты, за исключением последнего вхождения.
  • False : Удалить все дубликаты.
inplace : boolean, default False

Необходимо ли удалять дубликаты на месте или возвращать копию

Возвращает:
deduplicated : DataFrame

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.24.2/reference/api/pandas.DataFrame.drop_duplicates.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API