pandas.read_stata
-
pandas.read_stata(filepath_or_buffer, convert_dates=True, convert_categoricals=True, encoding=None, index_col=None, convert_missing=False, preserve_dtypes=True, columns=None, order_categoricals=True, chunksize=None, iterator=False)[source] -
Чтение файла Stata в DataFrame.
Параметры: filepath_or_buffer : строка или объект-подобный файлу
Путь к файлу .dta или объект, реализующий двоичную функцию read().
convert_dates : булево значение, по умолчанию True
Преобразование переменных даты в значения времени DataFrame.
convert_categoricals : булево значение, по умолчанию True
Чтение меток значений и преобразование столбцов в категориальные/факторные переменные.
encoding : строка, None или кодировка
Кодировка, используемая для парсинга файлов. None по умолчанию – latin-1.
index_col : строка, необязательно, по умолчанию: None
Столбец для установки в качестве индекса.
convert_missing : булево значение, по умолчанию False
Флаг, указывающий, следует ли преобразовывать пропущенные значения в их представления Stata. Если False, пропущенные значения заменяются на nan. Если True, столбцы, содержащие пропущенные значения, возвращаются с типами данных object, а пропущенные значения представлены объектами StataMissingValue.
preserve_dtypes : булево значение, по умолчанию True
Сохранение типов данных Stata. Если False, числовые данные повышаются до стандартных типов pandas для внешних данных (float64 или int64).
columns : список или None
Столбцы для сохранения. Столбцы будут возвращены в заданном порядке. None возвращает все столбцы.
order_categoricals : булево значение, по умолчанию True
Флаг, указывающий, являются ли преобразованные категориальные данные упорядоченными.
chunksize : целое число, по умолчанию None
Возвращает объект StataReader для итераций, возвращает куски с заданным количеством строк.
iterator : булево значение, по умолчанию False
Возвращает объект StataReader.
Возвращает: - DataFrame или StataReader
См. также
-
pandas.io.stata.StataReader - низкоуровневый читатель для файлов данных Stata
-
pandas.DataFrame.to_stata - экспорт файлов данных Stata
Примеры
Чтение файла Stata dta:
>>> import pandas as pd >>> df = pd.read_stata('filename.dta')Чтение файла Stata dta в кусках по 10 000 строк:
>>> itr = pd.read_stata('filename.dta', chunksize=10000) >>> for chunk in itr: ... do_something(chunk)
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.23.4/generated/pandas.read_stata.html