pandas.DataFrame.to_parquet
-
DataFrame.to_parquet(fname, engine='auto', compression='snappy', **kwargs)[source] -
Запись DataFrame в двоичный формат parquet.
Новая в версии 0.21.0.
Эта функция записывает DataFrame в виде файла parquet. Вы можете выбрать различные бэкэнды parquet и указать сжатие. Подробнее см. руководство пользователя.
Параметры: fname : str
Путь к файлу.
engine : {‘auto’, ‘pyarrow’, ‘fastparquet’}, default ‘auto’
Библиотека parquet для использования. Если ‘auto’, то используется параметр
io.parquet.engine. По умолчаниюio.parquet.engineповедение заключается в попытке использовать ‘pyarrow’, возвращаясь к ‘fastparquet’, если ‘pyarrow’ недоступен.compression : {‘snappy’, ‘gzip’, ‘brotli’, None}, default ‘snappy’
Имя используемого метода сжатия. Используйте
Noneдля отсутствия сжатия.**kwargs
Дополнительные параметры, передаваемые библиотеке parquet. Подробнее см. pandas io.
См. также
-
read_parquet - Чтение файла parquet.
-
DataFrame.to_csv - Запись файла csv.
-
DataFrame.to_sql - Запись в sql таблицу.
-
DataFrame.to_hdf - Запись в hdf.
Примечания
Для этой функции требуется библиотека fastparquet или pyarrow.
Примеры
>>> df = pd.DataFrame(data={'col1': [1, 2], 'col2': [3, 4]}) >>> df.to_parquet('df.parquet.gzip', compression='gzip') >>> pd.read_parquet('df.parquet.gzip') col1 col2 0 1 3 1 2 4 -
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.DataFrame.to_parquet.html