pandas.read_stata
-
pandas.read_stata(filepath_or_buffer, convert_dates=True, convert_categoricals=True, encoding=None, index_col=None, convert_missing=False, preserve_dtypes=True, columns=None, order_categoricals=True, chunksize=None, iterator=False)[source] -
Чтение файла Stata в DataFrame.
Параметры: -
filepath_or_buffer : string or file-like object -
Путь к файлу .dta или объект, реализующий функции двоичного чтения.
-
convert_dates : boolean, defaults to True -
Преобразовать переменные даты в значения времени DataFrame.
-
convert_categoricals : boolean, defaults to True -
Читать метки значений и преобразовать столбцы в категориальные/факторные переменные.
-
encoding : string, None or encoding -
Кодировка, используемая для анализа файлов. По умолчанию latin-1.
-
index_col : string, optional, default: None -
Столбец, который нужно установить в качестве индекса.
-
convert_missing : boolean, defaults to False -
Флаг, указывающий, нужно ли преобразовывать пропущенные значения в их представления Stata. Если False, пропущенные значения заменяются на nan. Если True, столбцы, содержащие пропущенные значения, возвращаются с типами данных object, а пропущенные значения представлены объектами StataMissingValue.
-
preserve_dtypes : boolean, defaults to True -
Сохранить типы данных Stata. Если False, числовые данные повышаются до типов pandas по умолчанию для внешних данных (float64 или int64).
-
columns : list or None -
Столбцы для сохранения. Столбцы будут возвращены в заданном порядке. None возвращает все столбцы.
-
order_categoricals : boolean, defaults to True -
Флаг, указывающий, отсортированы ли преобразованные категориальные данные.
-
chunksize : int, default None -
Возвратить объект StataReader для итераций, возвращает фрагменты с заданным количеством строк.
-
iterator : boolean, default False -
Возвращает объект StataReader.
Возвращаемое значение: - DataFrame или StataReader
См. также
-
pandas.io.stata.StataReader - Модуль низкого уровня для чтения файлов данных Stata.
-
pandas.DataFrame.to_stata - Экспорт файлов данных Stata.
Примеры
Чтение файла Stata dta:
>>> df = pd.read_stata('filename.dta')Чтение файла Stata dta частями по 10 000 строк:
>>> itr = pd.read_stata('filename.dta', chunksize=10000) >>> for chunk in itr: ... do_something(chunk) -
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.24.2/reference/api/pandas.read_stata.html