Spec-Zone.ru › pandas 0.19

pandas.read_stata

pandas.read_stata(filepath_or_buffer, convert_dates=True, convert_categoricals=True, encoding=None, index=None, convert_missing=False, preserve_dtypes=True, columns=None, order_categoricals=True, chunksize=None, iterator=False) [source]

Чтение файла Stata в DataFrame

Параметры:

filepath_or_buffer : строка или файлоподобный объект

Путь к файлу .dta или объект, реализующий функции двоичного чтения()

convert_dates : логическое значение, по умолчанию True

Преобразование переменных даты в значения времени DataFrame

convert_categoricals : логическое значение, по умолчанию True

Чтение меток значений и преобразование столбцов в категориальные/факторные переменные

encoding : строка, None или кодировка

Кодировка, используемая для разбора файлов. None по умолчанию равен iso-8859-1.

index : идентификатор столбца индекса

Идентификатор столбца, который должен использоваться в качестве индекса DataFrame

convert_missing : логическое значение, по умолчанию False

Флаг, указывающий, следует ли преобразовывать пропущенные значения в их представления Stata. Если False, пропущенные значения заменяются на nans. Если True, столбцы, содержащие пропущенные значения, возвращаются с типами данных object, а пропущенные значения представлены объектами StataMissingValue.

preserve_dtypes : логическое значение, по умолчанию True

Сохранение типов данных Stata. Если False, числовые данные повышаются до стандартных типов pandas для внешних данных (float64 или int64)

columns : список или None

Столбцы для сохранения. Столбцы будут возвращены в заданном порядке. None возвращает все столбцы

order_categoricals : логическое значение, по умолчанию True

Флаг, указывающий, являются ли преобразованные категориальные данные упорядоченными.

chunksize : целое число, по умолчанию None

Возврат объекта StataReader для итераций, возвращает фрагменты с заданным количеством строк

iterator : логическое значение, по умолчанию False

Возврат объекта StataReader

Возвращает:

DataFrame или StataReader

Примеры

Чтение файла Stata dta:

>>> df = pandas.read_stata('filename.dta')

Чтение файла Stata dta фрагментами по 10 000 строк:

>>> itr = pandas.read_stata('filename.dta', chunksize=10000)
>>> for chunk in itr:
>>>     do_something(chunk)

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.19.2/generated/pandas.read_stata.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API