Spec-Zone.ru › Polars

polars.read_ods

polars.read_ods(
    source: FileSource,
    *,
    sheet_id: int | Sequence[int] | None = None,
    sheet_name: str | list[str] | tuple[str,
    ...] | None = None,
    has_header: bool = True,
    columns: Sequence[int] | Sequence[str] | None = None,
    schema_overrides: SchemaDict | None = None,
    infer_schema_length: int | None = 100,
    include_file_paths: str | None = None,
    drop_empty_rows: bool = True,
    drop_empty_cols: bool = True,
    raise_if_empty: bool = True,
) → DataFrame | dict[str, DataFrame]

Читает данные электронной таблицы OpenOffice (ODS) в DataFrame.

Параметры:
source

Путь к файлу или файловому объекту (под «файловым объектом» подразумеваются объекты, у которых есть метод read(), например файловый дескриптор, созданный встроенной функцией open, или экземпляр BytesIO). Для файловых объектов позиция в потоке после чтения может обновиться некорректно.

sheet_id

Номер или номера листов для преобразования, начиная с 1 (задайте 0, чтобы загрузить все листы как DataFrame) и вернуть словарь {sheetname:frame,}. (По умолчанию используется 1, если не задан ни этот параметр, ни sheet_name). Также можно указать последовательность номеров листов.

sheet_name

Название или названия листов для преобразования; нельзя использовать вместе с sheet_id. Если указано больше одного названия, возвращается словарь {sheetname:frame,}.

has_header

Указывает, является ли первая строка данных таблицы заголовком. Если значение равно False, имена столбцов будут сгенерированы в следующем формате: column_x, где x — нумерация всех столбцов набора данных, начиная с 1.

columns

Столбцы, считываемые с листа; если параметр не задан, считываются все столбцы. Можно указать последовательность названий или индексов столбцов.

schema_overrides

Позволяет указать типы или переопределить типы одного или нескольких столбцов.

infer_schema_length

Максимальное количество строк для анализа при определении схемы. Если задано None, для определения типов данных сканируется весь набор данных, что может замедлить разбор больших книг.

include_file_paths

Добавляет путь к исходному файлу или файлам в виде столбца с указанным названием.

drop_empty_rows

Указывает, следует ли пропускать пустые строки при чтении данных в DataFrame.

drop_empty_cols

Указывает, следует ли пропускать пустые столбцы (без заголовков) при чтении данных в DataFrame (обратите внимание, что способ определения пустых столбцов может различаться в зависимости от используемого движка).

raise_if_empty

Если на листе нет данных, возникает исключение `NoDataError`. Если для этого параметра задано значение False, вместо этого возвращается пустой DataFrame (без столбцов).

Возвращает:
DataFrame, or a {sheetname: DataFrame, ...} dict if reading multiple sheets.

См. также

read_excel

Примеры

Чтение листа «data» из электронной таблицы OpenOffice в DataFrame.

>>> pl.read_ods(
...     source="test.ods",
...     sheet_name="data",
... )  

Если не удаётся определить правильные типы данных, используйте параметр schema_overrides, чтобы указать их, или увеличьте длину анализа с помощью infer_schema_length.

>>> pl.read_ods(
...     source="test.ods",
...     sheet_id=3,
...     schema_overrides={"dt": pl.Date},
...     raise_if_empty=False,
... )  

© 2020 Ritchie Vink
© 2022 Polars contributors
Licensed under the MIT License.
https://docs.pola.rs/api/python/stable/reference/api/polars.read_ods.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API