Spec-Zone.ru › pandas 0.21

pandas.DataFrame.drop_duplicates

DataFrame.drop_duplicates(subset=None, keep='first', inplace=False) [source]

Возвращает DataFrame с удалёнными дублирующими строками, необязательно учитывая только определённые столбцы

Параметры:

subset : имя столбца или последовательность имён столбцов, необязательно

Учитывать только определённые столбцы для определения дубликатов, по умолчанию используются все столбцы

keep : {‘first’, ‘last’, False}, по умолчанию ‘first’

  • first : Удалить дубликаты, кроме первого вхождения.
  • last : Удалить дубликаты, кроме последнего вхождения.
  • False : Удалить все дубликаты.

inplace : булево, по умолчанию False

Выполнить удаление дубликатов непосредственно или вернуть копию

Возвращаемое значение:

deduplicated : DataFrame

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.21.1/generated/pandas.DataFrame.drop_duplicates.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API