Spec-Zone.ru › pandas 0.18

pandas.read_excel

pandas.read_excel(io, sheetname=0, header=0, skiprows=None, skip_footer=0, index_col=None, names=None, parse_cols=None, parse_dates=False, date_parser=None, na_values=None, thousands=None, convert_float=True, has_index_names=None, converters=None, engine=None, squeeze=False, **kwds)

Чтение таблицы Excel в pandas DataFrame

Параметры:

io : строка, объект пути (pathlib.Path или py._path.local.LocalPath),

объект типа file-like, pandas ExcelFile или рабочая книга xlrd. Строка может быть URL-адресом. Допустимые схемы URL включают http, ftp, s3 и file. Для URL-адресов файлов ожидается хост. Например, локальный файл может быть file://localhost/path/to/workbook.xlsx

sheetname : строка, целое число, смешанный список строк/целых чисел или None, по умолчанию 0

Строки используются для имен листов, целые числа — для позиций листов с нумерацией с нуля.

Списки строк/целых чисел используются для запроса нескольких листов.

Укажите None, чтобы получить все листы.

str|int -> Возвращается DataFrame. list|None -> Возвращается словарь DataFrame с ключами, представляющими листы.

Доступные варианты

  • По умолчанию 0 -> 1-й лист в виде DataFrame
  • 1 -> 2-й лист в виде DataFrame
  • “Sheet1” -> 1-й лист в виде DataFrame
  • [0,1,”Sheet5”] -> 1-й, 2-й и 5-й листы в виде словаря DataFrame
  • None -> Все листы в виде словаря DataFrame

header : целое число, список целых чисел, по умолчанию 0

Строка (с индексом 0) для использования в качестве меток столбцов анализируемого DataFrame. Если передан список целых чисел, эти позиции строк будут объединены в MultiIndex

skiprows : список

Строки, которые нужно пропустить в начале (с нумерацией с нуля)

skip_footer : целое число, по умолчанию 0

Строки в конце, которые нужно пропустить (с нумерацией с нуля)

index_col : целое число, список целых чисел, по умолчанию None

Столбец (с индексом 0) для использования в качестве меток строк DataFrame. Передайте None, если такого столбца нет. Если передан список, эти столбцы будут объединены в MultiIndex

names : массив-подобный объект, по умолчанию None

Список имен столбцов для использования. Если файл не содержит заголовка строки, необходимо явно передать header=None

converters : словарь, по умолчанию None

Словарь функций для преобразования значений в определенных столбцах. Ключи могут быть целыми числами или метками столбцов, значения — функциями, принимающими один входной аргумент (содержимое ячейки Excel) и возвращающими преобразованное содержимое.

parse_cols : целое число или список, по умолчанию None

  • Если None, то анализируются все столбцы,
  • Если целое число, то указывает последний анализируемый столбец,
  • Если список целых чисел, то указывает список номеров столбцов для анализа,
  • Если строка, то указывает список имен столбцов и диапазонов столбцов, разделенных запятыми (например, “A:E” или “A,C,E:F”)

squeeze : логическое значение, по умолчанию False

Если анализируемые данные содержат только один столбец, то возвращается Series

na_values : список, по умолчанию None

Список дополнительных строк, распознаваемых как NA/NaN

thousands : строка, по умолчанию None

Разделитель тысяч для анализа столбцов строк до числовых значений. Обратите внимание, что этот параметр необходим только для столбцов, хранящихся в Excel как TEXT, любые числовые столбцы будут автоматически анализироваться независимо от формата отображения.

keep_default_na : логическое значение, по умолчанию True

Если значения na_values указаны, а keep_default_na False, значения NaN по умолчанию переопределяются; в противном случае они добавляются

verbose : логическое значение, по умолчанию False

Указывает количество значений NA, помещенных в нечисловые столбцы

engine: строка, по умолчанию None

Если io не буфер или путь, это значение должно быть установлено для идентификации io. Допустимые значения — None или xlrd

convert_float : логическое значение, по умолчанию True

преобразует целые числа с плавающей точкой в целые числа (например, 1.0 –> 1). Если False, все числовые данные будут читаться как числа с плавающей точкой: Excel хранит все числа как числа с плавающей точкой в виде внутренней структуры

has_index_names : логическое значение, по умолчанию None

УСТАРЕЛО: начиная с версии 0.17+, имена индексов будут автоматически вычисляться на основе index_col. Чтобы читать вывод Excel из версии 0.16.2 и более ранних версий, которые сохраняли имена индексов, используйте True.

Возвращаемое значение:

parsed : DataFrame или словарь DataFrame

DataFrame из переданного файла Excel. См. примечания в аргументе sheetname для получения дополнительной информации о том, когда возвращается словарь DataFrame.

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.read_excel.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API