Spec-Zone.ru › pandas 1

pandas.DataFrame.update

DataFrame.update(other, join='left', overwrite=True, filter_func=None, errors='ignore')[source]

Изменение на месте с использованием значений, отличных от NaN, из другой DataFrame.

Выравнивание по индексам. Значение не возвращается.

Параметры
other:DataFrame или объект, преобразуемый в DataFrame

Должен иметь по крайней мере одну совпадающую метку индекса/столбца с исходной DataFrame. Если передается Series, атрибут name должен быть установлен, и он будет использован в качестве имени столбца для выравнивания с исходной DataFrame.

join:{‘left’}, по умолчанию ‘left’

Реализовано только левое соединение, сохраняя индекс и столбцы исходного объекта.

overwrite:bool, по умолчанию True

Как обрабатывать значения, отличные от NaN, для перекрывающихся ключей:

  • True: перезаписывает значения исходной DataFrame значениями из other.

  • False: обновляет только значения, которые равны NaN в исходной DataFrame.

filter_func:callable(1d-массив) -> bool 1d-массив, необязательно

Можно выбрать замену значений, отличных от NaN. Вернуть True для значений, которые должны быть обновлены.

errors:{‘raise’, ‘ignore’}, по умолчанию ‘ignore’

Если ‘raise’, будет вызвано исключение ValueError, если DataFrame и other оба содержат данные, отличные от NaN, в одном и том же месте.

Возвращает
None:метод непосредственно изменяет вызываемый объект
Возбуждает
ValueError
  • Когда errors=’raise’ и есть перекрывающиеся данные, отличные от NaN.

  • Когда errors не равно ‘ignore’ или ‘raise’

NotImplementedError
  • Если join != ‘left’

См. также

dict.update

Аналогичный метод для словарей.

DataFrame.merge

Для операций со столбцами по столбцам.

Примеры

>>> df = pd.DataFrame({'A': [1, 2, 3],
...                    'B': [400, 500, 600]})
>>> new_df = pd.DataFrame({'B': [4, 5, 6],
...                        'C': [7, 8, 9]})
>>> df.update(new_df)
>>> df
   A  B
0  1  4
1  2  5
2  3  6

Длина DataFrame не увеличивается в результате обновления, обновляются только значения по совпадающим меткам индекса/столбца.

>>> df = pd.DataFrame({'A': ['a', 'b', 'c'],
...                    'B': ['x', 'y', 'z']})
>>> new_df = pd.DataFrame({'B': ['d', 'e', 'f', 'g', 'h', 'i']})
>>> df.update(new_df)
>>> df
   A  B
0  a  d
1  b  e
2  c  f

Для Series, атрибут name должен быть установлен.

>>> df = pd.DataFrame({'A': ['a', 'b', 'c'],
...                    'B': ['x', 'y', 'z']})
>>> new_column = pd.Series(['d', 'e'], name='B', index=[0, 2])
>>> df.update(new_column)
>>> df
   A  B
0  a  d
1  b  y
2  c  e
>>> df = pd.DataFrame({'A': ['a', 'b', 'c'],
...                    'B': ['x', 'y', 'z']})
>>> new_df = pd.DataFrame({'B': ['d', 'e']}, index=[1, 2])
>>> df.update(new_df)
>>> df
   A  B
0  a  x
1  b  d
2  c  e

Если other содержит NaN, соответствующие значения не обновляются в исходной DataFrame.

>>> df = pd.DataFrame({'A': [1, 2, 3],
...                    'B': [400, 500, 600]})
>>> new_df = pd.DataFrame({'B': [4, np.nan, 6]})
>>> df.update(new_df)
>>> df
   A      B
0  1    4.0
1  2  500.0
2  3    6.0

© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/1.5.0/reference/api/pandas.DataFrame.update.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API