polars.read_ods
-
Читает данные электронной таблицы OpenOffice (ODS) в DataFrame.
- Параметры:
-
- source
-
Путь к файлу или файловому объекту (под «файловым объектом» подразумеваются объекты, у которых есть метод
read(), например файловый дескриптор, созданный встроенной функциейopen, или экземплярBytesIO). Для файловых объектов позиция в потоке после чтения может обновиться некорректно. - sheet_id
-
Номер или номера листов для преобразования, начиная с 1 (задайте
0, чтобы загрузить все листы как DataFrame) и вернуть словарь{sheetname:frame,}. (По умолчанию используется1, если не задан ни этот параметр, ниsheet_name). Также можно указать последовательность номеров листов. - sheet_name
-
Название или названия листов для преобразования; нельзя использовать вместе с
sheet_id. Если указано больше одного названия, возвращается словарь{sheetname:frame,}. - has_header
-
Указывает, является ли первая строка данных таблицы заголовком. Если значение равно False, имена столбцов будут сгенерированы в следующем формате:
column_x, гдеx— нумерация всех столбцов набора данных, начиная с 1. - columns
-
Столбцы, считываемые с листа; если параметр не задан, считываются все столбцы. Можно указать последовательность названий или индексов столбцов.
- schema_overrides
-
Позволяет указать типы или переопределить типы одного или нескольких столбцов.
- infer_schema_length
-
Максимальное количество строк для анализа при определении схемы. Если задано
None, для определения типов данных сканируется весь набор данных, что может замедлить разбор больших книг. - include_file_paths
-
Добавляет путь к исходному файлу или файлам в виде столбца с указанным названием.
- drop_empty_rows
-
Указывает, следует ли пропускать пустые строки при чтении данных в DataFrame.
- drop_empty_cols
-
Указывает, следует ли пропускать пустые столбцы (без заголовков) при чтении данных в DataFrame (обратите внимание, что способ определения пустых столбцов может различаться в зависимости от используемого движка).
- raise_if_empty
-
Если на листе нет данных, возникает исключение `NoDataError`. Если для этого параметра задано значение False, вместо этого возвращается пустой DataFrame (без столбцов).
- Возвращает:
-
-
DataFrame, or a {sheetname: DataFrame, ...} dict if reading multiple sheets.
-
См. также
Примеры
Чтение листа «data» из электронной таблицы OpenOffice в DataFrame.
>>> pl.read_ods( ... source="test.ods", ... sheet_name="data", ... )
Если не удаётся определить правильные типы данных, используйте параметр
schema_overrides, чтобы указать их, или увеличьте длину анализа с помощьюinfer_schema_length.>>> pl.read_ods( ... source="test.ods", ... sheet_id=3, ... schema_overrides={"dt": pl.Date}, ... raise_if_empty=False, ... )
polars.read_ods(
source: FileSource,
*,
sheet_id: int | Sequence[int] | None = None,
sheet_name: str | list[str] | tuple[str,
...] | None = None,
has_header: bool = True,
columns: Sequence[int] | Sequence[str] | None = None,
schema_overrides: SchemaDict | None = None,
infer_schema_length: int | None = 100,
include_file_paths: str | None = None,
drop_empty_rows: bool = True,
drop_empty_cols: bool = True,
raise_if_empty: bool = True,
) → DataFrame | dict[str, DataFrame]
© 2020 Ritchie Vink
© 2022 Polars contributors
Licensed under the MIT License.
https://docs.pola.rs/api/python/stable/reference/api/polars.read_ods.html