Spec-Zone.ru › pandas 0.19
Справочник API Вход/Выход Запись в двоичный формат
read_pickle (path) Загрузка сериализованного объекта pandas (или любого другого сериализованного объекта) из указанного
Файл с плоской структурой
read_table (filepath_or_buffer[, sep, ...]) Чтение файла с разделителями в DataFrame
read_csv (filepath_or_buffer[, sep, ...]) Чтение CSV-файла (с разделителем запятая) в DataFrame
read_fwf (filepath_or_buffer[, colspecs, widths]) Чтение таблицы с фиксированной шириной строк в DataFrame
read_msgpack (path_or_buf[, encoding, iterator]) Загрузка объекта pandas в формате msgpack из указанного
Буфер обмена
read_clipboard (\*\*kwargs) Чтение текста из буфера обмена и передача его в read_table.
Excel
read_excel (io[, sheetname, header, ...]) Чтение таблицы Excel в DataFrame pandas
ExcelFile.parse ([sheetname, header, ...]) Обработка указанного(ых) листа(ов) в DataFrame
JSON
read_json ([path_or_buf, orient, typ, dtype, ...]) Преобразование JSON-строки в объект pandas
json_normalize (data[, record_path, meta, ...]) «Нормализация» полуструктурированных JSON-данных в плоскую таблицу
HTML
read_html (io[, match, flavor, header, ...]) Чтение HTML-таблиц в list из DataFrame объектов.
HDFStore: PyTables (HDF5)
read_hdf (path_or_buf[, key]) чтение из хранилища, закрытие, если мы его открыли
HDFStore.put (key, value[, format, append]) Хранение объекта в HDFStore
HDFStore.append (key, value[, format, ...]) Добавление в таблицу в файле.
HDFStore.get (key) Извлечение объекта pandas, сохраненного в файле
HDFStore.select (key[, where, start, stop, ...]) Извлечение объекта pandas, сохраненного в файле, необязательно на основе where
SAS
read_sas (filepath_or_buffer[, format, ...]) Чтение SAS-файлов в формате XPORT или SAS7BDAT.
SQL
read_sql_table (table_name, con[, schema, ...]) Чтение таблицы SQL-базы данных в DataFrame.
read_sql_query (sql, con[, index_col, ...]) Чтение SQL-запроса в DataFrame.
read_sql (sql, con[, index_col, ...]) Чтение SQL-запроса или таблицы базы данных в DataFrame.
Google BigQuery
read_gbq (query[, project_id, index_col, ...]) Загрузка данных из Google BigQuery.
to_gbq (dataframe, destination_table, project_id) Запись DataFrame в таблицу Google BigQuery.
STATA
read_stata (filepath_or_buffer[, ...]) Чтение файла Stata в DataFrame
Общие функции Обработка данных
melt (frame[, id_vars, value_vars, var_name, ...]) «Преобразует» DataFrame из широкого формата в длинный, необязательно оставляя
pivot (index, columns, values) Создание сводной таблицы на основе 3 столбцов этого DataFrame.
pivot_table (data[, values, index, columns, ...]) Создание сводной таблицы в стиле электронной таблицы в виде DataFrame.
crosstab (index, columns[, values, rownames, ...]) Вычисление простой сводной таблицы для двух (или более) факторов.
cut (x, bins[, right, labels, retbins, ...]) Возвращает индексы полуоткрытых интервалов, к которым принадлежит каждое значение x.
qcut (x, q[, labels, retbins, precision]) Функция дискретизации на основе квантилей.
merge (left, right[, how, on, left_on, ...]) Объединение объектов DataFrame с помощью операции присоединения в стиле базы данных по столбцам или индексам.
merge_ordered (left, right[, on, left_on, ...]) Выполнение объединения с необязательным заполнением/интерполированием, предназначенным для упорядоченных данных, таких как временные ряды.
merge_asof (left, right[, on, left_on, ...]) Выполнение объединения asof.
concat (objs[, axis, join, join_axes, ...]) Конкатенация объектов pandas по определённой оси с необязательной логикой множеств по другим осям.
get_dummies (data[, prefix, prefix_sep, ...]) Преобразование категориальной переменной в фиктивные/индикаторные переменные
factorize (values[, sort, order, ...]) Кодирование входных значений как перечислимого типа или категориальной переменной
Глобальная обработка пропущенных данных
isnull (obj) Определяет пропущенные значения (NaN в числовых массивах, None/NaN в массивах объектов)
notnull (obj) Замена для numpy.isfinite / -numpy.isnan, подходящая для использования с массивами объектов.
Преобразования верхнего уровня
to_numeric (arg[, errors, downcast]) Преобразование аргумента к числовому типу.
Обработка типов datetimelike верхнего уровня
to_datetime (\*args, \*\*kwargs) Преобразование аргумента в тип datetime.
to_timedelta (\*args, \*\*kwargs) Преобразование аргумента в тип timedelta
date_range ([start, end, periods, freq, tz, ...]) Возвращает индекс дат с фиксированной частотой, по умолчанию — день (календарный)
bdate_range ([start, end, periods, freq, tz, ...]) Возвращает индекс дат с фиксированной частотой, по умолчанию — рабочий день
period_range ([start, end, periods, freq, name]) Возвращает индекс дат с фиксированной частотой, по умолчанию — день (календарный)
timedelta_range ([start, end, periods, freq, ...]) Возвращает индекс временных интервалов с фиксированной частотой, по умолчанию — день
infer_freq (index[, warn]) Определение наиболее вероятной частоты на основе входного индекса.
Оценки верхнего уровня
eval (expr[, parser, engine, truediv, ...]) Вычисление строкового выражения Python с использованием различных бэкэндов.
Тестирование
test Выполнение тестов модуля с использованием nose.
Серия (Series) Конструктор
Series ([data, index, dtype, name, copy, ...]) Одномерный массив ndarray с метками осей (включая временные ряды).
Атрибуты Оси
Преобразование
Series.astype (dtype[, copy, raise_on_error]) Преобразование объекта к входному numpy.dtype
Series.copy ([deep]) Создает копию данных этого объекта.
Series.isnull () Возвращает объект того же размера, что и булево значение, указывающее, являются ли значения нулевыми.
Series.notnull () Возвращает объект того же размера, что и булево значение, указывающее, не являются ли значения нулевыми.
Индексирование, итерация
Series.get (key[, default]) Получение элемента из объекта для заданного ключа (столбец DataFrame, срез Panel и т. д.).
Series.at Быстрый скалярный аксессор на основе меток.
Series.iat Быстрый скалярный аксессор по целочисленной позиции.
Series.ix Индексатор, главным образом, на основе меток и позиций с целочисленным положением по умолчанию.
Series.loc Индексатор, основанный исключительно на метках, для выбора по метке.
Series.iloc Индексатор, основанный исключительно на целочисленных позициях, для выбора по позиции.
Series.__iter__ () Обеспечивает итерацию по значениям Series
Series.iteritems () Ленивая итерация по кортежам (индекс, значение)
Для получения дополнительной информации о .at, .iat, .ix, .loc, и .iloc, см. документацию по индексированию .
Функции бинарных операторов
Series.add (other[, level, fill_value, axis]) Сложение рядов и других элементов попарно (бинарная операция add).
Series.sub (other[, level, fill_value, axis]) Вычитание рядов и других элементов попарно (бинарная операция sub).
Series.mul (other[, level, fill_value, axis]) Умножение рядов и других элементов попарно (бинарная операция mul).
Series.div (other[, level, fill_value, axis]) Деление с плавающей запятой рядов и других элементов попарно (бинарная операция truediv).
Series.truediv (other[, level, fill_value, axis]) Деление с плавающей запятой рядов и других элементов попарно (бинарная операция truediv).
Series.floordiv (other[, level, fill_value, axis]) Целочисленное деление рядов и других элементов попарно (бинарная операция floordiv).
Series.mod (other[, level, fill_value, axis]) Остаток от деления рядов и других элементов попарно (бинарная операция mod).
Series.pow (other[, level, fill_value, axis]) Возведение в степень рядов и других элементов попарно (бинарная операция pow).
Series.radd (other[, level, fill_value, axis]) Сложение рядов и других элементов попарно (бинарная операция radd).
Series.rsub (other[, level, fill_value, axis]) Вычитание рядов и других элементов попарно (бинарная операция rsub).
Series.rmul (other[, level, fill_value, axis]) Умножение рядов и других элементов попарно (бинарная операция rmul).
Series.rdiv (other[, level, fill_value, axis]) Деление с плавающей запятой рядов и других элементов попарно (бинарная операция rtruediv).
Series.rtruediv (other[, level, fill_value, axis]) Деление с плавающей запятой рядов и других элементов попарно (бинарная операция rtruediv).
Series.rfloordiv (other[, level, fill_value, ...]) Целочисленное деление рядов и других элементов попарно (бинарная операция rfloordiv).
Series.rmod (other[, level, fill_value, axis]) Остаток от деления рядов и других элементов попарно (бинарная операция rmod).
Series.rpow (other[, level, fill_value, axis]) Возведение в степень рядов и других элементов попарно (бинарная операция rpow).
Series.combine (other, func[, fill_value]) Выполнение бинарной операции по элементам двух рядов с использованием заданной функции
Series.combine_first (other) Объединение значений рядов, выбирая сначала значения вызываемого ряда.
Series.round ([decimals]) Округление каждого значения в ряду до заданного числа десятичных знаков.
Series.lt (other[, level, fill_value, axis]) Меньше, чем ряды и другие элементы попарно (бинарная операция lt).
Series.gt (other[, level, fill_value, axis]) Больше, чем ряды и другие элементы попарно (бинарная операция gt).
Series.le (other[, level, fill_value, axis]) Меньше или равно рядам и другим элементам попарно (бинарная операция le).
Series.ge (other[, level, fill_value, axis]) Больше или равно рядам и другим элементам попарно (бинарная операция ge).
Series.ne (other[, level, fill_value, axis]) Не равно рядам и другим элементам попарно (бинарная операция ne).
Series.eq (other[, level, fill_value, axis]) Равно рядам и другим элементам попарно (бинарная операция eq).
Применение функций, GroupBy & Окно
Series.apply (func[, convert_dtype, args]) Вызов функции для значений Series.
Series.map (arg[, na_action]) Преобразование значений Series с использованием соответствия (которое может быть
Series.groupby ([by, axis, level, as_index, ...]) Группировка ряда с помощью отображения (словаря или функции ключа, применение заданной функции к группе, возврат результата как ряда) или по серии столбцов.
Series.rolling (window[, min_periods, freq, ...]) Предоставляет вычисления скользящего окна.
Series.expanding ([min_periods, freq, ...]) Предоставляет расширяющие преобразования.
Series.ewm ([com, span, halflife, alpha, ...]) Предоставляет функции экспоненциального взвешивания
Вычисления/описательные статистики
Series.abs () Возвращает объект со значениями абсолютного значения – применима только к объектам, которые все являются числовыми.
Series.all ([axis, bool_only, skipna, level]) Возвращает значение, указывающее, все ли элементы равны True по указанной оси
Series.any ([axis, bool_only, skipna, level]) Возвращает значение, указывающее, является ли какой-либо элемент равным True по указанной оси
Series.autocorr ([lag]) Автокорреляция с лагом N
Series.between (left, right[, inclusive]) Возвращает булевый Series, эквивалентный left <= series <= right.
Series.clip ([lower, upper, axis]) Обрезает значения по входному порогу(ам).
Series.clip_lower (threshold[, axis]) Возвращает копию входных данных со значениями ниже заданного значения(й), усечёнными.
Series.clip_upper (threshold[, axis]) Возвращает копию входных данных со значениями выше заданного значения(й), усечёнными.
Series.corr (other[, method, min_periods]) Вычисление корреляции с other Series, исключая пропущенные значения
Series.count ([level]) Возвращает количество наблюдений без NaN/null в Series
Series.cov (other[, min_periods]) Вычисление ковариации с Series, исключая пропущенные значения
Series.cummax ([axis, skipna]) Возвращает кумулятивный максимум по указанной оси.
Series.cummin ([axis, skipna]) Возвращает кумуляльный минимум по указанной оси.
Series.cumprod ([axis, skipna]) Возвращает кумулятивное произведение по указанной оси.
Series.cumsum ([axis, skipna]) Возвращает кумулятивную сумму по указанной оси.
Series.describe ([percentiles, include, exclude]) Генерирует различные сводные статистические данные, исключая значения NaN.
Series.diff ([periods]) Первое дискретное различие объекта
Series.factorize ([sort, na_sentinel]) Кодирует объект как перечислимый тип или категориальную переменную
Series.kurt ([axis, skipna, level, numeric_only]) Возвращает несмещённую эксцесс по указанной оси, используя определение эксцесса Фишера (эксцесс нормального == 0,0).
Series.mad ([axis, skipna, level]) Возвращает среднее абсолютное отклонение значений для указанной оси.
Series.max ([axis, skipna, level, numeric_only]) Этот метод возвращает максимальное значение в объекте.
Series.mean ([axis, skipna, level, numeric_only]) Возвращает среднее значение значений для указанной оси
Series.median ([axis, skipna, level, ...]) Возвращает медиану значений для указанной оси
Series.min ([axis, skipna, level, numeric_only]) Этот метод возвращает минимальное значение в объекте.
Series.mode () Возвращает моду(и) набора данных.
Series.nlargest (\*args, \*\*kwargs) Возвращает самые большие n элементы.
Series.nsmallest (\*args, \*\*kwargs) Возвращает самые маленькие n элементы.
Series.pct_change ([periods, fill_method, ...]) Процентное изменение за заданное количество периодов.
Series.prod ([axis, skipna, level, numeric_only]) Возвращает произведение значений по запрошенной оси.
Series.quantile ([q, interpolation]) Возвращает значение в заданном квантиле, подобно numpy.percentile.
Series.rank ([axis, method, numeric_only, ...]) Вычисление числовых рангов (от 1 до n) по оси.
Series.sem ([axis, skipna, level, ddof, ...]) Возвращает несмещённую стандартную ошибку среднего по указанной оси.
Series.skew ([axis, skipna, level, numeric_only]) Возвращает несмещённое искажение по указанной оси.
Series.std ([axis, skipna, level, ddof, ...]) Возвращает выборочное стандартное отклонение по указанной оси.
Series.sum ([axis, skipna, level, numeric_only]) Возвращает сумму значений по указанной оси
Series.var ([axis, skipna, level, ddof, ...]) Возвращает несмещённую дисперсию по указанной оси.
Series.unique () Возвращает массив NumPy из уникальных значений в объекте.
Series.nunique ([dropna]) Возвращает количество уникальных элементов в объекте.
Series.is_unique Возвращает булевое значение, если значения в объекте уникальны
Series.is_monotonic Возвращает булевое значение, если значения в объекте монотонно возрастают
Series.is_monotonic_increasing Возвращает булевое значение, если значения в объекте монотонно возрастают
Series.is_monotonic_decreasing Возвращает булевое значение, если значения в объекте монотонно убывают
Series.value_counts ([normalize, sort, ...]) Возвращает объект, содержащий подсчеты уникальных значений.
Переиндексация / Выбор / Манипуляции с метками
Series.align (other[, join, axis, level, ...]) Выровнять два объекта по их осям с помощью
Series.drop (labels[, axis, level, inplace, ...]) Возвращает новый объект с удаленными метками на указанной оси.
Series.drop_duplicates (\*args, \*\*kwargs) Возвращает Series с удаленными дублирующими значениями
Series.duplicated (\*args, \*\*kwargs) Возвращает булеву Series, обозначающую дублирующиеся значения
Series.equals (other) Определяет, содержат ли два объекта NDFrame одинаковые элементы.
Series.first (offset) Удобный метод для выделения начальных периодов временных рядов данных на основе временного сдвига.
Series.head ([n]) Возвращает первые n строк
Series.idxmax ([axis, skipna]) Индекс первого вхождения максимального значения.
Series.idxmin ([axis, skipna]) Индекс первого вхождения минимального значения.
Series.isin (values) Возвращает булеву Series показывающую, содержится ли каждый элемент в Series точно в переданной последовательности values.
Series.last (offset) Удобный метод для выделения конечных периодов временных рядов данных на основе временного сдвига.
Series.reindex ([index]) Согласование Series с новым индексом с дополнительной логикой заполнения, помещающей NA/NaN в места, не имеющие значения в предыдущем индексе.
Series.reindex_like (other[, method, copy, ...]) Возвращает объект с соответствующими индексами мне.
Series.rename ([index]) Изменение входных функций или функций осей.
Series.rename_axis (mapper[, axis, copy, inplace]) Изменение индекса и/или столбцов с использованием входной функции или функций.
Series.reset_index ([level, drop, name, inplace]) Аналогично функции pandas.DataFrame.reset_index() , см. строку документации там.
Series.sample ([n, frac, replace, weights, ...]) Возвращает случайную выборку элементов из оси объекта.
Series.select (crit[, axis]) Возвращает данные, соответствующие меткам осей, которые соответствуют критериям
Series.take (indices[, axis, convert, is_copy]) возвращает Series, соответствующие запрошенным индексам
Series.tail ([n]) Возвращает последние n строк
Series.truncate ([before, after, axis, copy]) Обрезает отсортированный NDFrame перед и/или после некоторого конкретного значения индекса.
Series.where (cond[, other, inplace, axis, ...]) Возвращает объект той же формы, что и self, чьи соответствующие записи берутся из self, где cond равно True, а в противном случае — из other.
Series.mask (cond[, other, inplace, axis, ...]) Возвращает объект той же формы, что и self, чьи соответствующие записи берутся из self, где cond равно False, а в противном случае — из other.
Обработка пропущенных данных
Series.dropna ([axis, inplace]) Возвращает Series без нулевых значений
Series.fillna ([value, method, axis, ...]) Заполнить пропущенные значения NA/NaN указанным методом
Series.interpolate ([method, axis, limit, ...]) Интерполяция значений по различным методам.
Перестройка, сортировка
Series.argsort ([axis, kind, order]) Переопределяет ndarray.argsort.
Series.reorder_levels (order) Переупорядочить уровни индексов с использованием входного порядка.
Series.sort_values ([axis, ascending, ...]) Сортировка по значениям вдоль любой оси
Series.sort_index ([axis, level, ascending, ...]) Сортировка объекта по меткам (по оси)
Series.sortlevel ([level, ascending, ...]) Сортировка Series с MultiIndex по выбранному уровню.
Series.swaplevel ([i, j, copy]) Перемена уровней i и j в MultiIndex
Series.unstack ([level, fill_value]) Разворачивание, иначе
Series.searchsorted (v[, side, sorter]) Найти индексы, где элементы должны быть вставлены для сохранения порядка.
Объединение / соединение / слияние
Series.append (to_append[, ignore_index, ...]) Конкатенация двух или более Series.
Series.replace ([to_replace, value, inplace, ...]) Замена значений, указанных в ‘to_replace’, на ‘value’.
Series.update (other) Изменение Series на месте с использованием ненулевых значений из переданной Series.
Series.asfreq (freq[, method, how, normalize]) Преобразовать временной ряд к заданной частоте.
Series.asof (where[, subset]) Берется последняя строка без значений NaN (или последняя строка без
Series.shift ([periods, freq, axis]) Сдвинуть индекс на заданное количество периодов с опциональной временной частотой.
Series.first_valid_index () Возвращает метку первого ненулевого/не-NA значения.
Series.last_valid_index () Возвращает метку последнего ненулевого/не-NA значения.
Series.resample (rule[, how, axis, ...]) Удобный метод для преобразования частоты и ресемплирования временных рядов.
Series.tz_convert (tz[, axis, level, copy]) Преобразование временного ряда с часовым поясом в целевой часовой пояс.
Series.tz_localize (\*args, \*\*kwargs) Локализация временного ряда без часового пояса в целевой часовой пояс.
Свойства DateTimelike Series.dt могут использоваться для доступа к значениям ряда как datetimelike и возвращают различные свойства. К ним можно обратиться как Series.dt.<property>.
Свойства даты и времени
Series.dt.date Возвращает массив numpy объектов python datetime.date (в частности, часть даты Timestamp без информации о часовом поясе).
Series.dt.time Возвращает массив numpy объектов datetime.time.
Series.dt.year Год даты и времени.
Series.dt.month Месяц, где январь=1, декабрь=12.
Series.dt.day День даты и времени.
Series.dt.hour Часы даты и времени.
Series.dt.minute Минуты даты и времени.
Series.dt.second Секунды даты и времени.
Series.dt.microsecond Микросекунды даты и времени.
Series.dt.nanosecond Наносекунды даты и времени.
Series.dt.week Номер недели в году.
Series.dt.weekofyear Номер недели в году.
Series.dt.dayofweek День недели (понедельник=0, воскресенье=6).
Series.dt.weekday День недели (понедельник=0, воскресенье=6).
Series.dt.weekday_name Название дня недели (например, Пятница).
Series.dt.dayofyear Порядковый номер дня в году.
Series.dt.quarter Квартал года.
Series.dt.is_month_start Логическое значение, указывающее, является ли день началом месяца (определяется частотой).
Series.dt.is_month_end Логическое значение, указывающее, является ли день концом месяца (определяется частотой).
Series.dt.is_quarter_start Логическое значение, указывающее, является ли день началом квартала (определяется частотой).
Series.dt.is_quarter_end Логическое значение, указывающее, является ли день концом квартала (определяется частотой).
Series.dt.is_year_start Логическое значение, указывающее, является ли день началом года (определяется частотой).
Series.dt.is_year_end Логическое значение, указывающее, является ли день концом года (определяется частотой).
Series.dt.is_leap_year Логическое значение, указывающее, является ли год високосным.
Series.dt.daysinmonth Количество дней в месяце.
Series.dt.days_in_month Количество дней в месяце.
Series.dt.tz
Series.dt.freq Получение/установка частоты индекса.
Методы даты и времени
Series.dt.to_period (\*args, \*\*kwargs) Преобразование к PeriodIndex с заданной частотой.
Series.dt.to_pydatetime ()
Series.dt.tz_localize (\*args, \*\*kwargs) Локализация DatetimeIndex без часового пояса в заданный часовой пояс (используя
Series.dt.tz_convert (\*args, \*\*kwargs) Преобразование DatetimeIndex с часовым поясом из одного часового пояса в другой (используя
Series.dt.normalize (\*args, \*\*kwargs) Возвращает DatetimeIndex с временем, установленным на полночь.
Series.dt.strftime (\*args, \*\*kwargs) Возвращает массив отформатированных строк, заданных форматом даты, который поддерживает тот же формат строк, что и стандартная библиотека Python.
Series.dt.round (\*args, \*\*kwargs) округление индекса до указанной частоты
Series.dt.floor (\*args, \*\*kwargs) опускание индекса до указанной частоты
Series.dt.ceil (\*args, \*\*kwargs) округляем индекс до указанной частоты
Свойства Timedelta
Методы Timedelta
Обработка строк Series.str можно использовать для доступа к значениям серии в виде строк и применения к ним нескольких методов. К ним можно обратиться, как к Series.str.<function/property>.
Series.str.capitalize () Преобразовать строки в Series/Index в верхний регистр первой буквы.
Series.str.cat ([others, sep, na_rep]) Конкатенировать строки в Series/Index с заданным разделителем.
Series.str.center (width[, fillchar]) Заполнение левой и правой сторон строк в Series/Index дополнительным символом.
Series.str.contains (pat[, case, flags, na, ...]) Возвращает булеву Series/array , указывая, содержится ли заданный шаблон/регулярное выражение в каждой строке Series/Index.
Series.str.count (pat[, flags]) Подсчитать вхождения шаблона в каждой строке Series/Index.
Series.str.decode (encoding[, errors]) Декодировать строку символов в Series/Index с использованием указанной кодировки.
Series.str.encode (encoding[, errors]) Кодировать строку символов в Series/Index с использованием указанной кодировки.
Series.str.endswith (pat[, na]) Возвращает булеву Series, указывающую, заканчивается ли каждая строка в Series/Index заданным шаблоном.
Series.str.extract (pat[, flags, expand]) Для каждой строки-субъекта в Series извлечь группы из первого совпадения регулярного выражения pat.
Series.str.extractall (pat[, flags]) Для каждой строки-субъекта в Series извлечь группы из всех совпадений регулярного выражения pat.
Series.str.find (sub[, start, end]) Возвращает минимальные индексы в каждой строке в Series/Index, где подстрока полностью содержится между [start:end].
Series.str.findall (pat[, flags]) Найти все вхождения шаблона или регулярного выражения в Series/Index.
Series.str.get (i) Извлечь элемент из списков, кортежей или строк в каждом элементе в Series/Index.
Series.str.index (sub[, start, end]) Возвращает минимальные индексы в каждой строке, где подстрока полностью содержится между [start:end].
Series.str.join (sep) Объединить списки, содержащиеся как элементы в Series/Index, с указанным разделителем.
Series.str.len () Вычислить длину каждой строки в Series/Index.
Series.str.ljust (width[, fillchar]) Заполнение правой стороны строк в Series/Index дополнительным символом.
Series.str.lower () Преобразовать строки в Series/Index в нижний регистр.
Series.str.lstrip ([to_strip]) Удалить пробелы (включая новые строки) из каждой строки в Series/Index с левой стороны.
Series.str.match (pat[, case, flags, na, ...]) Устарело: Найти группы в каждой строке в Series/Index, используя указанное регулярное выражение.
Series.str.normalize (form) Возвращает нормальную форму Unicode для строк в Series/Index.
Series.str.pad (width[, side, fillchar]) Заполнить строки в Series/Index дополнительным символом со стороны, указанной в параметре side.
Series.str.partition ([pat, expand]) Разделить строку по первому вхождению sep, и вернуть 3 элемента, содержащие часть до разделителя, сам разделитель и часть после разделителя.
Series.str.repeat (repeats) Дублировать каждую строку в Series/Index указанное количество раз.
Series.str.replace (pat, repl[, n, case, flags]) Заменить вхождения шаблона/регулярного выражения в Series/Index другой строкой.
Series.str.rfind (sub[, start, end]) Возвращает максимальные индексы в каждой строке в Series/Index, где подстрока полностью содержится между [start:end].
Series.str.rindex (sub[, start, end]) Возвращает максимальные индексы в каждой строке, где подстрока полностью содержится между [start:end].
Series.str.rjust (width[, fillchar]) Заполнение левой стороны строк в Series/Index дополнительным символом.
Series.str.rpartition ([pat, expand]) Разделить строку по последнему вхождению sep, и вернуть 3 элемента, содержащие часть до разделителя, сам разделитель и часть после разделителя.
Series.str.rstrip ([to_strip]) Удалить пробелы (включая новые строки) из каждой строки в Series/Index с правой стороны.
Series.str.slice ([start, stop, step]) Вырезать подстроки из каждого элемента в Series/Index
Series.str.slice_replace ([start, stop, repl]) Заменить срез каждой строки в Series/Index другой строкой.
Series.str.split ([pat, n, expand]) Разделить каждую строку (аналогично re.split) в Series/Index по заданному шаблону, передавая значения NA.
Series.str.rsplit ([pat, n, expand]) Разделить каждую строку в Series/Index по заданному разделителю, начиная с конца строки и двигаясь к началу.
Series.str.startswith (pat[, na]) Возвращает булеву Series/array , указывающую, начинается ли каждая строка в Series/Index с заданного шаблона.
Series.str.strip ([to_strip]) Удалить пробелы (включая новые строки) из каждой строки в Series/Index с левой и правой сторон.
Series.str.swapcase () Преобразовать строки в Series/Index в регистр с чередованием верхнего и нижнего регистров.
Series.str.title () Преобразовать строки в Series/Index в заголовок.
Series.str.translate (table[, deletechars]) Картировать все символы в строке через заданную таблицу преобразований.
Series.str.upper () Преобразовать строки в Series/Index в верхний регистр.
Series.str.wrap (width, \*\*kwargs) Обёртка длинных строк в Series/Index для форматирования в абзацы длиной меньше заданной ширины.
Series.str.zfill (width) Заполнение левой стороны строк в Series/Index нулями.
Series.str.isalnum () Проверка, являются ли все символы в каждой строке в Series/Index буквенно-цифровыми.
Series.str.isalpha () Проверка, являются ли все символы в каждой строке в Series/Index буквенными.
Series.str.isdigit () Проверка, являются ли все символы в каждой строке в Series/Index цифрами.
Series.str.isspace () Проверка, являются ли все символы в каждой строке в Series/Index пробелами.
Series.str.islower () Проверка, являются ли все символы в каждой строке в Series/Index строчными.
Series.str.isupper () Проверка, являются ли все символы в каждой строке в Series/Index заглавными.
Series.str.istitle () Проверка, являются ли все символы в каждой строке в Series/Index строчными с заглавной первой буквой.
Series.str.isnumeric () Проверка, являются ли все символы в каждой строке в Series/Index числовыми.
Series.str.isdecimal () Проверка, являются ли все символы в каждой строке в Series/Index десятичными.
Series.str.get_dummies ([sep]) Разделение каждой строки в Series по sep и возвращение фрейма фиктивных/индикаторных переменных.
Категориальные Если Series имеет тип category, Series.cat может быть использован для изменения категориальных данных. Этот аксессор похож на Series.dt или Series.str и имеет следующие методы и свойства:
Для создания Series типа category, используйте cat = s.astype("category").
Следующие два Categorical конструктора считаются частью API, но должны использоваться только при добавлении информации об упорядоченности или специальных категорий при создании категориальных данных:
Categorical (values[, categories, ordered, ...]) Представляет категориальную переменную в стиле классического R/S-plus.
np.asarray(categorical) работает, реализуя интерфейс массива. Обратите внимание, что это преобразует Categorical обратно в массив numpy, поэтому информация об уровнях и порядке не сохраняется!
Отображение Series.plot — это как вызываемый метод, так и пространство имён для конкретных методов отображения в формате Series.plot.<kind>.
Series.plot ([kind, ax, figsize, ....]) Аксессор и метод отображения Series.
Series.hist ([by, ax, grid, xlabelsize, ...]) Построение гистограммы входного ряда с использованием matplotlib.
Сериализация/Ввод/Вывод/Преобразование
Series.from_csv (path[, sep, parse_dates, ...]) Чтение CSV-файла (НЕ РЕКОМЕНДУЕТСЯ, используйте pandas.read_csv() вместо этого).
Series.to_pickle (path) Запись объекта в файл с помощью протокола Pickle (сериализация).
Series.to_csv ([path, index, sep, na_rep, ...]) Запись Series в файл CSV (с разделителем запятая).
Series.to_dict () Преобразование Series в словарь {метка -> значение}.
Series.to_frame ([name]) Преобразование Series в DataFrame.
Series.to_xarray () Возвращает объект xarray из объекта pandas.
Series.to_hdf (path_or_buf, key, \*\*kwargs) Запись данных в HDF5-файл с помощью HDFStore.
Series.to_sql (name, con[, flavor, schema, ...]) Запись записей, хранящихся в DataFrame, в базу данных SQL.
Series.to_msgpack ([path_or_buf, encoding]) Запись объекта с помощью протокола msgpack (сериализация) в указанный путь к файлу.
Series.to_json ([path_or_buf, orient, ...]) Преобразование объекта в строку JSON.
Series.to_sparse ([kind, fill_value]) Преобразование Series в SparseSeries.
Series.to_dense () Возвращение плотной (в отличие от разреженной) представления NDFrame.
Series.to_string ([buf, na_rep, ...]) Вывод строкового представления Series.
Series.to_clipboard ([excel, sep]) Попытка записать текстовое представление объекта в буфер обмена системы. Это можно вставить, например, в Excel.
Методы разреженных объектов
SparseSeries.to_coo ([row_levels, ...]) Создание матрицы scipy.sparse.coo_matrix из SparseSeries с MultiIndex.
SparseSeries.from_coo (A[, dense_index]) Создание SparseSeries из матрицы scipy.sparse.coo_matrix.
DataFrame Конструктор
DataFrame ([data, index, columns, dtype, copy]) Двумерная изменяемая по размеру, потенциально разнородная таблица данных с маркированными осями (строки и столбцы).
Атрибуты и данные Оси
index : метки строк
columns : метки столбцов Преобразование
DataFrame.astype (dtype[, copy, raise_on_error]) Преобразование объекта к указанному типу numpy.dtype.
DataFrame.convert_objects ([convert_dates, ...]) Устарело.
DataFrame.copy ([deep]) Создание копии данных этого объекта.
DataFrame.isnull () Возвращение логического объекта того же размера, указывающего, являются ли значения NULL.
DataFrame.notnull () Возвращение логического объекта того же размера, указывающего, не являются ли значения NULL.
Индексация, итерация
DataFrame.head ([n]) Возвращает первые n строк
DataFrame.at Быстрый скалярный аксессор на основе меток
DataFrame.iat Быстрый скалярный аксессор по целочисленному местоположению.
DataFrame.ix Индексатор, в основном основанный на метках и местоположении, с использованием целочисленной позиции по умолчанию.
DataFrame.loc Индексатор, основанный исключительно на метках и местоположении для выбора по метке.
DataFrame.iloc Индексация только на основе целочисленного местоположения для выбора по позиции.
DataFrame.insert (loc, column, value[, ...]) Вставить столбец в DataFrame в указанном месте.
DataFrame.__iter__ () Итерирование по оси infor
DataFrame.iteritems () Итератор по парам (имя столбца, Series).
DataFrame.iterrows () Итерация по строкам DataFrame как пары (индекс, Series).
DataFrame.itertuples ([index, name]) Итерация по строкам DataFrame как namedtuples, с значением индекса как первым элементом кортежа.
DataFrame.lookup (row_labels, col_labels) Функция «fancy indexing» на основе меток для DataFrame.
DataFrame.pop (item) Возвращает элемент и удаляет его из фрейма.
DataFrame.tail ([n]) Возвращает последние n строк
DataFrame.xs (key[, axis, level, drop_level]) Возвращает поперечное сечение (строку(и) или столбец(ы)) из Series/DataFrame.
DataFrame.isin (values) Возвращает булеву DataFrame, показывающую, содержится ли каждый элемент в DataFrame в значениях.
DataFrame.where (cond[, other, inplace, ...]) Возвращает объект той же формы, что и self, чьи соответствующие элементы взяты из self, где cond истинно, а в противном случае из other.
DataFrame.mask (cond[, other, inplace, axis, ...]) Возвращает объект той же формы, что и self, чьи соответствующие элементы взяты из self, где cond ложно, а в противном случае из other.
DataFrame.query (expr[, inplace]) Запрос столбцов фрейма с помощью булева выражения.
Для получения дополнительной информации о .at, .iat, .ix, .loc, и .iloc, см. документацию по индексации .
Функции бинарных операторов
DataFrame.add (other[, axis, level, fill_value]) Сложение DataFrame и other, поэлементное (бинарная операция add).
DataFrame.sub (other[, axis, level, fill_value]) Вычитание DataFrame и other, поэлементное (бинарная операция sub).
DataFrame.mul (other[, axis, level, fill_value]) Умножение DataFrame и other, поэлементное (бинарная операция mul).
DataFrame.div (other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция truediv).
DataFrame.truediv (other[, axis, level, ...]) Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция truediv).
DataFrame.floordiv (other[, axis, level, ...]) Целочисленное деление DataFrame и other, поэлементное (бинарная операция floordiv).
DataFrame.mod (other[, axis, level, fill_value]) Остаток от деления DataFrame и other, поэлементное (бинарная операция mod).
DataFrame.pow (other[, axis, level, fill_value]) Возведение в степень DataFrame и other, поэлементное (бинарная операция pow).
DataFrame.radd (other[, axis, level, fill_value]) Сложение DataFrame и other, поэлементное (бинарная операция radd).
DataFrame.rsub (other[, axis, level, fill_value]) Вычитание DataFrame и other, поэлементное (бинарная операция rsub).
DataFrame.rmul (other[, axis, level, fill_value]) Умножение DataFrame и other, поэлементное (бинарная операция rmul).
DataFrame.rdiv (other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция rtruediv).
DataFrame.rtruediv (other[, axis, level, ...]) Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция rtruediv).
DataFrame.rfloordiv (other[, axis, level, ...]) Целочисленное деление DataFrame и other, поэлементное (бинарная операция rfloordiv).
DataFrame.rmod (other[, axis, level, fill_value]) Остаток от деления DataFrame и other, поэлементное (бинарная операция rmod).
DataFrame.rpow (other[, axis, level, fill_value]) Возведение в степень DataFrame и other, поэлементное (бинарная операция rpow).
DataFrame.lt (other[, axis, level]) Обёртка для гибких методов сравнения lt
DataFrame.gt (other[, axis, level]) Обёртка для гибких методов сравнения gt
DataFrame.le (other[, axis, level]) Обёртка для гибких методов сравнения le
DataFrame.ge (other[, axis, level]) Обёртка для гибких методов сравнения ge
DataFrame.ne (other[, axis, level]) Обёртка для гибких методов сравнения ne
DataFrame.eq (other[, axis, level]) Обёртка для гибких методов сравнения eq
DataFrame.combine (other, func[, fill_value, ...]) Добавление двух объектов DataFrame и не распространение значений NaN, поэтому если для
DataFrame.combine_first (other) Объединение двух объектов DataFrame и по умолчанию не нулевые значения в вызывающей метод рамке.
Применение функций, GroupBy & Window
DataFrame.apply (func[, axis, broadcast, ...]) Применяет функцию вдоль входной оси DataFrame.
DataFrame.applymap (func) Применяет функцию к DataFrame, которая предназначена для работы с элементами, т.е.
DataFrame.groupby ([by, axis, level, ...]) Группировка серии с помощью отображения (словарь или функция ключа, применение данной функции к группе, возврат результата в виде серии) или по серии столбцов.
DataFrame.rolling (window[, min_periods, ...]) Обеспечивает вычисления скользящего окна.
DataFrame.expanding ([min_periods, freq, ...]) Обеспечивает расширяющие преобразования.
DataFrame.ewm ([com, span, halflife, alpha, ...]) Обеспечивает экспоненциально взвешенные функции
Вычисления/описательные статистики
DataFrame.abs () Возвращает объект с абсолютными значениями — применима только к объектам, которые все являются числовыми.
DataFrame.all ([axis, bool_only, skipna, level]) Возвращает True, если все элементы по запрошенной оси равны True
DataFrame.any ([axis, bool_only, skipna, level]) Возвращает True, если любой элемент по запрошенной оси равен True
DataFrame.clip ([lower, upper, axis]) Обрезает значения по входным порогам.
DataFrame.clip_lower (threshold[, axis]) Возвращает копию входных данных с обрезанными значениями ниже заданного значения(й).
DataFrame.clip_upper (threshold[, axis]) Возвращает копию входных данных с обрезанными значениями выше заданного значения(й).
DataFrame.corr ([method, min_periods]) Вычисляет парную корреляцию столбцов, исключая значения NA/null.
DataFrame.corrwith (other[, axis, drop]) Вычисляет парную корреляцию между строками или столбцами двух объектов DataFrame.
DataFrame.count ([axis, level, numeric_only]) Возвращает Series с количеством наблюдений без NA/null по запрошенной оси.
DataFrame.cov ([min_periods]) Вычисляет парную ковариацию столбцов, исключая значения NA/null.
DataFrame.cummax ([axis, skipna]) Возвращает кумулятивный максимум по запрошенной оси.
DataFrame.cummin ([axis, skipna]) Возвращает кумуляльный минимум по запрошенной оси.
DataFrame.cumprod ([axis, skipna]) Возвращает кумулятивное произведение по запрошенной оси.
DataFrame.cumsum ([axis, skipna]) Возвращает кумулятивную сумму по запрошенной оси.
DataFrame.describe ([percentiles, include, ...]) Генерирует различные сводные статистические данные, исключая NaN значения.
DataFrame.diff ([periods, axis]) Первая дискретная разница объекта
DataFrame.eval (expr[, inplace]) Вычисляет выражение в контексте вызываемого экземпляра DataFrame.
DataFrame.kurt ([axis, skipna, level, ...]) Возвращает смещённую эксцесс по запрошенной оси, используя определение эксцесса Фишера (эксцесс нормального распределения == 0.0).
DataFrame.mad ([axis, skipna, level]) Возвращает среднее абсолютное отклонение значений для запрошенной оси
DataFrame.max ([axis, skipna, level, ...]) Этот метод возвращает максимальное значение в объекте.
DataFrame.mean ([axis, skipna, level, ...]) Возвращает среднее значение значений для запрошенной оси
DataFrame.median ([axis, skipna, level, ...]) Возвращает медиану значений для запрошенной оси
DataFrame.min ([axis, skipna, level, ...]) Этот метод возвращает минимальное значение в объекте.
DataFrame.mode ([axis, numeric_only]) Получает моду(и) каждого элемента по выбранной оси.
DataFrame.pct_change ([periods, fill_method, ...]) Процентное изменение за заданное количество периодов.
DataFrame.prod ([axis, skipna, level, ...]) Возвращает произведение значений для запрошенной оси
DataFrame.quantile ([q, axis, numeric_only, ...]) Возвращает значения в заданном квантиле по запрошенной оси, подобно numpy.percentile.
DataFrame.rank ([axis, method, numeric_only, ...]) Вычисляет числовые ранги (от 1 до n) по оси.
DataFrame.round ([decimals]) Округляет DataFrame до заданного количества десятичных знаков.
DataFrame.sem ([axis, skipna, level, ddof, ...]) Возвращает смещённую стандартную ошибку среднего по запрошенной оси.
DataFrame.skew ([axis, skipna, level, ...]) Возвращает смещённый коэффициент асимметрии по запрошенной оси.
DataFrame.sum ([axis, skipna, level, ...]) Возвращает сумму значений по запрошенной оси.
DataFrame.std ([axis, skipna, level, ddof, ...]) Возвращает выборочное стандартное отклонение по запрошенной оси.
DataFrame.var ([axis, skipna, level, ddof, ...]) Возвращает смещённую дисперсию по запрошенной оси.
Переиндексация / Выбор / Работа с метками
DataFrame.add_prefix (prefix) Конкатенация префиксной строки с именами элементов панели.
DataFrame.add_suffix (suffix) Конкатенация суффиксной строки с именами элементов панели.
DataFrame.align (other[, join, axis, level, ...]) Выравнивание двух объектов по их осям с
DataFrame.drop (labels[, axis, level, ...]) Возвращает новый объект с удалёнными метками на запрошенной оси.
DataFrame.drop_duplicates (\*args, \*\*kwargs) Возвращает DataFrame с удалёнными дублирующими строками, необязательно только
DataFrame.duplicated (\*args, \*\*kwargs) Возвращает булевый Series, обозначающий дублирующие строки, необязательно только
DataFrame.equals (other) Определяет, содержат ли два объекта NDFrame одинаковые элементы.
DataFrame.filter ([items, like, regex, axis]) Подмножество строк или столбцов DataFrame в соответствии с метками в указанном индексе.
DataFrame.first (offset) Удобный метод для выделения начальных периодов временных рядов данных на основе смещения даты.
DataFrame.head ([n]) Возвращает первые n строк
DataFrame.idxmax ([axis, skipna]) Возвращает индекс первого вхождения максимума по запрошенной оси.
DataFrame.idxmin ([axis, skipna]) Возвращает индекс первого вхождения минимума по запрошенной оси.
DataFrame.last (offset) Удобный метод для выделения конечных периодов временных рядов данных на основе смещения даты.
DataFrame.reindex ([index, columns]) Приведение DataFrame к новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, не имеющих значения в предыдущем индексе.
DataFrame.reindex_axis (labels[, axis, ...]) Приведение входного объекта к новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, не имеющих значения в предыдущем индексе.
DataFrame.reindex_like (other[, method, ...]) Возвращает объект с соответствующими индексами мне.
DataFrame.rename ([index, columns]) Изменение входной функции или функций осей.
DataFrame.rename_axis (mapper[, axis, copy, ...]) Изменение индекса и/или столбцов с использованием входной функции или функций.
DataFrame.reset_index ([level, drop, ...]) Для DataFrame с многоуровневым индексом возвращает новый DataFrame с информацией о метках в столбцах под именами индексов, по умолчанию — ‘level_0’, ‘level_1’ и т. д.
DataFrame.sample ([n, frac, replace, ...]) Возвращает случайную выборку элементов из оси объекта.
DataFrame.select (crit[, axis]) Возвращает данные, соответствующие меткам оси, соответствующим критериям
DataFrame.set_index (keys[, drop, append, ...]) Установка индекса DataFrame (метки строк) с использованием одного или нескольких существующих столбцов.
DataFrame.tail ([n]) Возвращает последние n строк
DataFrame.take (indices[, axis, convert, is_copy]) Аналогично ndarray.take
DataFrame.truncate ([before, after, axis, copy]) Усекает отсортированный NDFrame перед и/или после некоторого значения индекса.
Обработка пропущенных данных
DataFrame.dropna ([axis, how, thresh, ...]) Возвращает объект с удалёнными метками на заданной оси, где поочерёдно любые
DataFrame.fillna ([value, method, axis, ...]) Заполнение значений NA/NaN указанным методом
DataFrame.replace ([to_replace, value, ...]) Замена значений, указанных в ‘to_replace’, на ‘value’.
Переформатирование, сортировка, транспонирование
DataFrame.pivot ([index, columns, values]) Переформатировать данные (создать сводную таблицу) на основе значений столбцов.
DataFrame.reorder_levels (order[, axis]) Переупорядочить уровни индекса с использованием входного порядка.
DataFrame.sort_values (by[, axis, ascending, ...]) Сортировка по значениям вдоль любой оси.
DataFrame.sort_index ([axis, level, ...]) Сортировка объекта по меткам (вдоль оси).
DataFrame.sortlevel ([level, axis, ...]) Сортировка многоуровневого индекса по выбранной оси и первичному уровню.
DataFrame.nlargest (n, columns[, keep]) Получить строки DataFrame, отсортированные по n наибольшим значениям columns.
DataFrame.nsmallest (n, columns[, keep]) Получить строки DataFrame, отсортированные по n наименьшим значениям columns.
DataFrame.swaplevel ([i, j, axis]) Поменять местами уровни i и j в многоуровневом индексе на определенной оси.
DataFrame.stack ([level, dropna]) Поворачивать уровень (возможно иерархических) меток столбцов, возвращая DataFrame (или Series в случае объекта с одним уровнем меток столбцов), имеющий иерархический индекс с новым внутренним уровнем меток строк.
DataFrame.unstack ([level, fill_value]) Поворачивать уровень (обязательно иерархических) меток индекса, возвращая DataFrame, имеющий новый уровень меток столбцов, внутренний уровень которого состоит из повернутых меток индекса.
DataFrame.T Транспонировать индекс и столбцы
DataFrame.to_panel () Преобразовать длинный (складываемый) формат (DataFrame) в широкий (3D, Panel) формат.
DataFrame.to_xarray () Возвращает объект xarray из pandas-объекта.
DataFrame.transpose (\*args, \*\*kwargs) Транспонировать индекс и столбцы
Объединение / соединение / слияние
DataFrame.append (other[, ignore_index, ...]) Добавить строки other в конец этой таблицы, вернув новый объект.
DataFrame.assign (\*\*kwargs) Присвоить новые столбцы DataFrame, вернув новый объект (копию) со всеми исходными столбцами в дополнение к новым.
DataFrame.join (other[, on, how, lsuffix, ...]) Объединить столбцы с другим DataFrame, либо по индексу, либо по ключевому столбцу.
DataFrame.merge (right[, how, on, left_on, ...]) Объединить объекты DataFrame, выполнив операцию соединения по столбцам или индексам в стиле баз данных.
DataFrame.update (other[, join, overwrite, ...]) Изменить DataFrame на месте, используя значения, отличные от NaN, из переданного DataFrame.
Связанные с временными рядами
DataFrame.asfreq (freq[, method, how, normalize]) Преобразовать временной ряд в заданную частоту.
DataFrame.asof (where[, subset]) Берется последняя строка без NaN (или последняя строка без
DataFrame.shift ([periods, freq, axis]) Сдвинуть индекс на нужное количество периодов с необязательной частотой времени.
DataFrame.first_valid_index () Возвращает метку первой строки без NA/null значения.
DataFrame.last_valid_index () Возвращает метку последней строки без NA/null значения.
DataFrame.resample (rule[, how, axis, ...]) Удобный метод для преобразования частоты и ресемплирования временных рядов.
DataFrame.to_period ([freq, axis, copy]) Преобразовать DataFrame из DatetimeIndex в PeriodIndex с желаемой
DataFrame.to_timestamp ([freq, how, axis, copy]) Преобразование в DatetimeIndex временных меток, в начале периода.
DataFrame.tz_convert (tz[, axis, level, copy]) Преобразовать временную ось с учетом часового пояса в целевой часовой пояс.
DataFrame.tz_localize (\*args, \*\*kwargs) Локализовать временную ось без часового пояса в целевом часовом поясе.
Отображение DataFrame.plot — это метод вызова и атрибут пространства имен для специфических методов отображения вида DataFrame.plot.<kind>.
DataFrame.plot ([x, y, kind, ax, ....]) Доступ и метод для построения графиков DataFrame
DataFrame.plot.area ([x, y]) График областей
DataFrame.plot.bar ([x, y]) Вертикальная гистограмма
DataFrame.plot.barh ([x, y]) Горизонтальная гистограмма
DataFrame.plot.box ([by]) Диаграмма размаха
DataFrame.plot.density (\*\*kwds) График оценки плотности ядра
DataFrame.plot.hexbin (x, y[, C, ...]) Гексагональный график
DataFrame.plot.hist ([by, bins]) Гистограмма
DataFrame.plot.kde (\*\*kwds) График оценки плотности ядра
DataFrame.plot.line ([x, y]) Линейный график
DataFrame.plot.pie ([y]) Круговая диаграмма
DataFrame.plot.scatter (x, y[, s, c]) Точечный график
DataFrame.boxplot ([column, by, ax, ...]) Создать диаграмму размаха (box plot) из столбца DataFrame, необязательно с группировкой по некоторым столбцам или
DataFrame.hist (data[, column, by, grid, ...]) Построение гистограммы рядов DataFrame с использованием matplotlib/pylab.
Сериализация/Ввод-вывод/Преобразование
DataFrame.from_csv (path[, header, sep, ...]) Чтение CSV-файла (НЕ РЕКОМЕНДУЕТСЯ, используйте pandas.read_csv() вместо этого).
DataFrame.from_dict (data[, orient, dtype]) Построение DataFrame из словаря массивоподобных объектов или словарей
DataFrame.from_items (items[, columns, orient]) Преобразование пар (ключ, значение) в DataFrame.
DataFrame.from_records (data[, index, ...]) Преобразование структурированного или массива записей в DataFrame
DataFrame.info ([verbose, buf, max_cols, ...]) Краткий вывод DataFrame.
DataFrame.to_pickle (path) Сохранение объекта в двоичный файл (сериализация) в указанный путь.
DataFrame.to_csv ([path_or_buf, sep, na_rep, ...]) Запись DataFrame в файл с разделителями (csv).
DataFrame.to_hdf (path_or_buf, key, \*\*kwargs) Запись данных в файл HDF5 с использованием HDFStore.
DataFrame.to_sql (name, con[, flavor, ...]) Запись записей из DataFrame в базу данных SQL.
DataFrame.to_dict ([orient]) Преобразование DataFrame в словарь.
DataFrame.to_excel (excel_writer[, ...]) Запись DataFrame в лист Excel.
DataFrame.to_json ([path_or_buf, orient, ...]) Преобразование объекта в строку JSON.
DataFrame.to_html ([buf, columns, col_space, ...]) Отображение DataFrame как HTML-таблицы.
DataFrame.to_latex ([buf, columns, ...]) Вывод DataFrame в таблицу среды LaTeX.
DataFrame.to_stata (fname[, convert_dates, ...]) Класс для записи двоичных файлов Stata (.dta) из массивоподобных объектов.
DataFrame.to_msgpack ([path_or_buf, encoding]) Сохранение объекта в файл msgpack (сериализация).
DataFrame.to_gbq (destination_table, project_id) Запись DataFrame в таблицу Google BigQuery.
DataFrame.to_records ([index, convert_datetime64]) Преобразование DataFrame в массив записей.
DataFrame.to_sparse ([fill_value, kind]) Преобразование в SparseDataFrame.
DataFrame.to_dense () Возвращает плотное представление NDFrame (в отличие от разреженного).
DataFrame.to_string ([buf, columns, ...]) Вывод DataFrame в удобочитаемом для консоли табличном формате.
DataFrame.to_clipboard ([excel, sep]) Попытка записать текстовое представление объекта в буфер обмена системы. Это можно вставить, например, в Excel.
Панель (Panel) Конструктор
Panel ([data, items, major_axis, minor_axis, ...]) Представление панельных данных в широком формате, хранящихся в виде 3-мерного массива
Атрибуты и базовые данные Оси (Axes)
items : ось 0; каждый элемент соответствует DataFrame, содержащемуся внутри
major_axis : ось 1; индекс (строки) каждого из DataFrame
minor_axis : ось 2; столбцы каждого из DataFrame Преобразование
Panel.astype (dtype[, copy, raise_on_error]) Преобразовать объект в указанный тип numpy.dtype
Panel.copy ([deep]) Создать копию данных этого объекта.
Panel.isnull () Возвращает булевский объект того же размера, указывающий, являются ли значения пустым (null).
Panel.notnull () Возвращает булевский объект того же размера, указывающий, являются ли значения непустым (не null).
Получение и установка
Panel.get_value (\*args, \*\*kwargs) Быстрое получение одиночного значения по местоположению (элемент, большая ось, малая ось)
Panel.set_value (\*args, \*\*kwargs) Быстрое установка одиночного значения по местоположению (элемент, большая ось, малая ось)
Индексирование, итерирование, срезы
Panel.at Быстрый скалярный аксессор на основе меток
Panel.iat Быстрый скалярный аксессор по целочисленной позиции.
Panel.ix Индексатор, в основном, на основе меток и позиций; используется целочисленная позиция в качестве резерва.
Panel.loc Чисто метко-позиционный индексатор для выбора по меткам.
Panel.iloc Чисто целочисленно-позиционный индексатор для выбора по позиции.
Panel.__iter__ () Итерироваться по оси информации
Panel.iteritems () Итерироваться по (метке, значениям) на оси информации
Panel.pop (item) Возвращает элемент и удаляет его из фрейма.
Panel.xs (key[, axis]) Возвращает срез панели по выбранной оси
Panel.major_xs (key) Возвращает срез панели по основной оси
Panel.minor_xs (key) Возвращает срез панели по вспомогательной оси
Для получения дополнительной информации о .at, .iat, .ix, .loc, и .iloc, см. документацию по индексированию .
Функции бинарных операций
Panel.add (other[, axis]) Сложение рядов и других элементов по элементам (бинарная операция add).
Panel.sub (other[, axis]) Вычитание рядов и других элементов по элементам (бинарная операция sub).
Panel.mul (other[, axis]) Умножение рядов и других элементов по элементам (бинарная операция mul).
Panel.div (other[, axis]) Деление с плавающей запятой рядов и других элементов по элементам (бинарная операция truediv).
Panel.truediv (other[, axis]) Деление с плавающей запятой рядов и других элементов по элементам (бинарная операция truediv).
Panel.floordiv (other[, axis]) Целочисленное деление рядов и других элементов по элементам (бинарная операция floordiv).
Panel.mod (other[, axis]) Остаток от деления рядов и других элементов по элементам (бинарная операция mod).
Panel.pow (other[, axis]) Возведение в степень рядов и других элементов по элементам (бинарная операция pow).
Panel.radd (other[, axis]) Сложение рядов и других элементов по элементам (бинарная операция radd).
Panel.rsub (other[, axis]) Вычитание рядов и других элементов по элементам (бинарная операция rsub).
Panel.rmul (other[, axis]) Умножение рядов и других элементов по элементам (бинарная операция rmul).
Panel.rdiv (other[, axis]) Деление с плавающей запятой рядов и других элементов по элементам (бинарная операция rtruediv).
Panel.rtruediv (other[, axis]) Деление с плавающей запятой рядов и других элементов по элементам (бинарная операция rtruediv).
Panel.rfloordiv (other[, axis]) Целочисленное деление рядов и других элементов по элементам (бинарная операция rfloordiv).
Panel.rmod (other[, axis]) Остаток от деления рядов и других элементов по элементам (бинарная операция rmod).
Panel.rpow (other[, axis]) Возведение в степень рядов и других элементов по элементам (бинарная операция rpow).
Panel.lt (other[, axis]) Обёртка для метода сравнения lt
Panel.gt (other[, axis]) Обёртка для метода сравнения gt
Panel.le (other[, axis]) Обёртка для метода сравнения le
Panel.ge (other[, axis]) Обёртка для метода сравнения ge
Panel.ne (other[, axis]) Обёртка для метода сравнения ne
Panel.eq (other[, axis]) Обёртка для метода сравнения eq
Применение функций, GroupBy
Panel.apply (func[, axis]) Применяет функцию вдоль оси (или осей) панели
Panel.groupby (function[, axis]) Группирует данные по заданной оси, возвращая объект GroupBy
Вычисления/описательные статистики
Panel.abs () Возвращает объект с абсолютными значениями — применимо только к объектам, все значения которых являются числовыми.
Panel.clip ([lower, upper, axis]) Обрезает значения по заданному порогу.
Panel.clip_lower (threshold[, axis]) Возвращает копию входных данных с усеченными значениями, меньшими заданного значения.
Panel.clip_upper (threshold[, axis]) Возвращает копию входных данных с усеченными значениями, большими заданного значения.
Panel.count ([axis]) Возвращает количество наблюдений по указанной оси.
Panel.cummax ([axis, skipna]) Возвращает накопительный максимум по указанной оси.
Panel.cummin ([axis, skipna]) Возвращает накопительный минимум по указанной оси.
Panel.cumprod ([axis, skipna]) Возвращает накопительное произведение по указанной оси.
Panel.cumsum ([axis, skipna]) Возвращает накопительную сумму по указанной оси.
Panel.max ([axis, skipna, level, numeric_only]) Этот метод возвращает максимальное значение в объекте.
Panel.mean ([axis, skipna, level, numeric_only]) Возвращает среднее значение по указанной оси.
Panel.median ([axis, skipna, level, numeric_only]) Возвращает медиану значений по указанной оси.
Panel.min ([axis, skipna, level, numeric_only]) Этот метод возвращает минимальное значение в объекте.
Panel.pct_change ([periods, fill_method, ...]) Процентное изменение за заданное количество периодов.
Panel.prod ([axis, skipna, level, numeric_only]) Возвращает произведение значений по указанной оси.
Panel.sem ([axis, skipna, level, ddof, ...]) Возвращает среднеквадратичную ошибку среднего по указанной оси.
Panel.skew ([axis, skipna, level, numeric_only]) Возвращает несмещённое значение асимметрии по указанной оси.
Panel.sum ([axis, skipna, level, numeric_only]) Возвращает сумму значений по указанной оси.
Panel.std ([axis, skipna, level, ddof, ...]) Возвращает выборочное стандартное отклонение по указанной оси.
Panel.var ([axis, skipna, level, ddof, ...]) Возвращает несмещённую дисперсию по указанной оси.
Переиндексация / Выбор / Работа с метками
Panel.add_prefix (prefix) Добавить префикс к именам элементов панели.
Panel.add_suffix (suffix) Добавить суффикс к именам элементов панели.
Panel.drop (labels[, axis, level, inplace, ...]) Возвращает новый объект с удалёнными метками на указанной оси.
Panel.equals (other) Определяет, содержат ли два объекта NDFrame одинаковые элементы.
Panel.filter ([items, like, regex, axis]) Подмножество строк или столбцов DataFrame в соответствии с метками в указанном индексе.
Panel.first (offset) Удобный метод для выделения начальных периодов временных рядов на основе временного сдвига.
Panel.last (offset) Удобный метод для выделения конечных периодов временных рядов на основе временного сдвига.
Panel.reindex ([items, major_axis, minor_axis]) Приведение Panel к новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, не имеющих значения в предыдущем индексе.
Panel.reindex_axis (labels[, axis, method, ...]) Приведение входного объекта к новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, не имеющих значения в предыдущем индексе.
Panel.reindex_like (other[, method, copy, ...]) Возвращает объект с соответствующими индексами к себе.
Panel.rename ([items, major_axis, minor_axis]) Изменение входной функции или функций осей.
Panel.sample ([n, frac, replace, weights, ...]) Возвращает случайную выборку элементов из оси объекта.
Panel.select (crit[, axis]) Возвращает данные, соответствующие меткам оси, удовлетворяющим критериям.
Panel.take (indices[, axis, convert, is_copy]) Аналог ndarray.take
Panel.truncate ([before, after, axis, copy]) Усекает отсортированный NDFrame перед и/или после определённого значения индекса.
Обработка пропущенных данных
Panel.dropna ([axis, how, inplace]) Удаляет 2D из панели, сохраняя постоянной указанную ось.
Panel.fillna ([value, method, axis, inplace, ...]) Заполняет значения NA/NaN заданным методом.
Перестройка, сортировка, транспонирование
Panel.sort_index ([axis, level, ascending, ...]) Сортирует объект по меткам (по оси).
Panel.swaplevel ([i, j, axis]) Меняет местами уровни i и j в MultiIndex на определённой оси.
Panel.transpose (\*args, \*\*kwargs) Переупорядочивает размерности Panel.
Panel.swapaxes (axis1, axis2[, copy]) Меняет местами оси и соответствующим образом меняет местами значения осей.
Panel.conform (frame[, axis]) Приводит входной DataFrame к соответствию с выбранной парой осей.
Объединение / объединение / слияние
Panel.join (other[, how, lsuffix, rsuffix]) Объединяет элементы с другим Panel по столбцам главных и второстепенных осей.
Panel.update (other[, join, overwrite, ...]) Изменяет Panel на месте, используя не-NA значения из переданного Panel или объекта, преобразуемого в Panel.
Связанные с временными рядами
Panel.asfreq (freq[, method, how, normalize]) Преобразовать временной ряд к указанной частоте.
Panel.shift ([periods, freq, axis]) Смещение индекса на нужное количество периодов с необязательной временной частотой.
Panel.resample (rule[, how, axis, ...]) Удобный метод для преобразования частоты и ресемплирования временных рядов.
Panel.tz_convert (tz[, axis, level, copy]) Преобразование временной оси с учетом часового пояса в целевой часовой пояс.
Panel.tz_localize (\*args, \*\*kwargs) Локализация временного ряда без учета часового пояса в целевой часовой пояс.
Сериализация / Ввод/вывод / Преобразование
Panel.from_dict (data[, intersect, orient, dtype]) Построение панели из словаря объектов DataFrame
Panel.to_pickle (path) Сериализация объекта в файл с помощью протокола pickle.
Panel.to_excel (path[, na_rep, engine]) Запись каждого DataFrame в панели в отдельный лист Excel
Panel.to_hdf (path_or_buf, key, \*\*kwargs) Запись данных в файл HDF5 с помощью HDFStore.
Panel.to_sparse (\*args, \*\*kwargs) НЕ РЕАЛИЗОВАНО: не вызывайте этот метод, так как сжатие не поддерживается для объектов Panel и приведет к ошибке.
Panel.to_frame ([filter_observations]) Преобразование широкого формата в длинный (складываемый) формат в DataFrame, столбцы которого являются элементами панели, а индекс — многоуровневый индекс, образованный главными и второстепенными осями панели.
Panel.to_xarray () Возвращает объект xarray из объекта pandas.
Panel.to_clipboard ([excel, sep]) Попытка записи текстового представления объекта в буфер обмена системы. Это можно вставить, например, в Excel.
Panel4D Конструктор
Panel4D ([data, labels, items, major_axis, ...]) Panel4D — это 4-мерный именованный контейнер, очень похожий на панель, но имеющий 4 именованных измерения.
Сериализация / Ввод/вывод / Преобразование Атрибуты и данные Оси
labels : ось 1; каждый метка соответствует панели, содержащейся внутри
items : ось 2; каждый элемент соответствует DataFrame, содержащемуся внутри
major_axis : ось 3; индекс (строки) каждого из DataFrame
minor_axis : ось 4; столбцы каждого из DataFrame Преобразование
Panel4D.astype (dtype[, copy, raise_on_error]) Преобразование объекта в указанный тип numpy.
Panel4D.copy ([deep]) Создает копию данных этого объекта.
Panel4D.isnull () Возвращает объект того же размера, что и исходный, содержащий булевы значения, указывающие, являются ли значения пустыми.
Panel4D.notnull () Возвращает булевый объект тех же размеров, что и исходный, указывающий, не являются ли значения пустыми.
Индекс Многие из этих методов или их варианты доступны для объектов, содержащих индекс (Series/DataFrame), и их следует использовать, скорее всего, прежде чем вызывать эти методы напрямую.
Index Неизменяемый ndarray, реализующий упорядоченное, разделяемое множество.
Атрибуты Изменение и вычисления
Index.all (\*args, \*\*kwargs) Возвращает True, если все элементы равны True
Index.any (\*args, \*\*kwargs) Возвращает True, если хотя бы один элемент равен True
Index.argmin ([axis]) возвращает индексатор аргумента минимума в виде массива ndarray
Index.argmax ([axis]) возвращает индексатор аргумента максимума в виде массива ndarray
Index.copy ([name, deep, dtype]) Создаёт копию этого объекта.
Index.delete (loc) Создаёт новый Index, удаляя указанные позиции
Index.drop (labels[, errors]) Создаёт новый Index, удаляя указанные метки
Index.drop_duplicates (\*args, \*\*kwargs) Возвращает Index с удалёнными дубликатами значений
Index.duplicated (\*args, \*\*kwargs) Возвращает булевый массив np.ndarray, обозначающий дубликаты значений
Index.equals (other) Определяет, содержат ли два объекта Index одинаковые элементы.
Index.factorize ([sort, na_sentinel]) Кодирует объект как перечисление или категориальную переменную
Index.identical (other) Аналогично equals, но проверяет, что другие сравниваемые атрибуты
Index.insert (loc, item) Создаёт новый Index, вставляя новый элемент в указанную позицию.
Index.min () Минимальное значение объекта.
Index.max () Максимальное значение объекта.
Index.reindex (target[, method, level, ...]) Создаёт индекс со значениями целевого объекта (перемещает/добавляет/удаляет значения при необходимости)
Index.repeat (n, \*args, \*\*kwargs) Повторяет элементы Index.
Index.where (cond[, other])
Index.take (indices[, axis, allow_fill, ...]) возвращает новый %(klass)s с выбранными значениями по индексам
Index.putmask (mask, value) возвращает новый Index со значениями, установленными по маске
Index.set_names (names[, level, inplace]) Устанавливает новые имена для индекса.
Index.unique () Возвращает Index уникальных значений в объекте.
Index.nunique ([dropna]) Возвращает количество уникальных элементов в объекте.
Index.value_counts ([normalize, sort, ...]) Возвращает объект, содержащий количество уникальных значений.
Index.fillna ([value, downcast]) Заполняет пропущенные значения (NA/NaN) указанным значением
Index.dropna ([how]) Возвращает Index без значений NA/NaN
Преобразование Сортировка
Index.argsort (\*args, \*\*kwargs) Возвращает индексы, которые отсортируют индекс и его основанные данные.
Index.sort_values ([return_indexer, ascending]) Возвращает отсортированную копию индекса
Операции, специфичные для времени
Index.shift ([periods, freq]) Сдвигает индекс, содержащий объекты datetime, на указанное число периодов и
Объединение/соединение/операции с множествами
Index.append (other) Присоединяет коллекцию вариантов Index вместе
Index.join (other[, how, level, return_indexers]) это внутренний непубличный метод
Index.intersection (other) Формирует пересечение двух объектов Index.
Index.union (other) Формирует объединение двух объектов Index и сортирует, если возможно.
Index.difference (other) Возвращает новый индекс с элементами из индекса, которые не содержатся в other.
Index.symmetric_difference (other[, result_name]) Вычисляет симметричную разность двух объектов Index.
Выбор
Index.get_indexer (target[, method, limit, ...]) Вычисляет индексатор и маску для нового индекса, учитывая текущий индекс.
Index.get_indexer_non_unique (target) возвращает индексатор, подходящий для извлечения из неуникального индекса
Index.get_level_values (level) Возвращает вектор значений меток для запрошенного уровня, равный длине
Index.get_loc (key[, method, tolerance]) Получение целочисленной позиции для запрошенной метки
Index.get_value (series, key) Быстрый поиск значения из одномерного массива ndarray.
Index.isin (values[, level]) Вычисляет булеву массив, указывающий, найдено ли каждое значение индекса в переданном множестве значений.
Index.slice_indexer ([start, end, step, kind]) Для упорядоченного индекса вычислите индексатор среза для входных меток и
Index.slice_locs ([start, end, step, kind]) Вычисление позиций среза для входных меток.
CategoricalIndex
CategoricalIndex Неизменяемый индекс, реализующий упорядоченное, нарезное множество.
Компоненты категорий MultiIndex
MultiIndex Многоуровневый или иерархический объект индекса для объектов pandas
Компоненты MultiIndex
MultiIndex.from_arrays (arrays[, sortorder, ...]) Преобразовать массивы в MultiIndex
MultiIndex.from_tuples (tuples[, sortorder, ...]) Преобразовать список кортежей в MultiIndex
MultiIndex.from_product (iterables[, ...]) Создать MultiIndex из декартова произведения нескольких итерируемых объектов
MultiIndex.set_levels (levels[, level, ...]) Установить новые уровни в MultiIndex.
MultiIndex.set_labels (labels[, level, ...]) Установить новые метки в MultiIndex.
MultiIndex.to_hierarchical (n_repeat[, n_shuffle]) Возвращает MultiIndex, преобразованный для соответствия формам, заданным n_repeat и n_shuffle.
MultiIndex.is_lexsorted () Возвращает True, если метки отсортированы лексикографически
MultiIndex.droplevel ([level]) Возвращает индекс со удаленным запрошенным уровнем.
MultiIndex.swaplevel ([i, j]) Поменять местами уровень i с уровнем j.
MultiIndex.reorder_levels (order) Переупорядочить уровни с использованием входного порядка.
DatetimeIndex
DatetimeIndex Неизменяемый массив ndarray типа datetime64, представленный внутри как int64, и который может быть упакован в объекты Timestamp, которые являются подклассами datetime и содержат метаданные, такие как информация о частоте.
Компоненты времени/даты
DatetimeIndex.year Год даты и времени
DatetimeIndex.month Месяц, где Январь=1, Декабрь=12
DatetimeIndex.day День даты и времени
DatetimeIndex.hour Часы даты и времени
DatetimeIndex.minute Минуты даты и времени
DatetimeIndex.second Секунды даты и времени
DatetimeIndex.microsecond Микросекунды даты и времени
DatetimeIndex.nanosecond Наносекунды даты и времени
DatetimeIndex.date Возвращает массив NumPy объектов Python datetime.date (то есть, часть даты в Timestamp без информации о часовом поясе).
DatetimeIndex.time Возвращает массив объектов datetime.time.
DatetimeIndex.dayofyear Порядковый номер дня в году
DatetimeIndex.weekofyear Порядковый номер недели в году
DatetimeIndex.week Порядковый номер недели в году
DatetimeIndex.dayofweek День недели, где понедельник=0, воскресенье=6
DatetimeIndex.weekday День недели, где понедельник=0, воскресенье=6
DatetimeIndex.weekday_name Название дня недели (например, Пятница)
DatetimeIndex.quarter Квартал года
DatetimeIndex.tz
DatetimeIndex.freq получить/установить частоту индекса
DatetimeIndex.freqstr Возвращает строковое представление объекта частоты, если он установлен, в противном случае None
DatetimeIndex.is_month_start Логическое значение, указывающее, является ли день началом месяца (определяется частотой)
DatetimeIndex.is_month_end Логическое значение, указывающее, является ли день концом месяца (определяется частотой)
DatetimeIndex.is_quarter_start Логическое значение, указывающее, является ли день началом квартала (определяется частотой)
DatetimeIndex.is_quarter_end Логическое значение, указывающее, является ли день концом квартала (определяется частотой)
DatetimeIndex.is_year_start Логическое значение, указывающее, является ли день началом года (определяется частотой)
DatetimeIndex.is_year_end Логическое значение, указывающее, является ли день концом года (определяется частотой)
DatetimeIndex.is_leap_year Логическое значение, указывающее, является ли год високосным
DatetimeIndex.inferred_freq
Выбор элементов Операции, специфичные для времени Преобразование TimedeltaIndex
TimedeltaIndex Неизменяемый массив ndarray данных типа timedelta64, представленный внутри как int64, и
Составные части Преобразование Окно Объекты Rolling возвращаются вызовами .rolling: pandas.DataFrame.rolling() , pandas.Series.rolling() и т.д. Объекты Expanding возвращаются вызовами .expanding: pandas.DataFrame.expanding() , pandas.Series.expanding() и т.д. Объекты EWM возвращаются вызовами .ewm: pandas.DataFrame.ewm() , pandas.Series.ewm() и т.д.
Стандартные функции скользящего окна
Rolling.count () Подсчёт элементов, отличных от NaN, в скользящем окне
Rolling.sum (\*args, \*\*kwargs) сумма в скользящем окне
Rolling.mean (\*args, \*\*kwargs) среднее значение в скользящем окне
Rolling.median (\*\*kwargs) медиана в скользящем окне
Rolling.var ([ddof]) дисперсия в скользящем окне
Rolling.std ([ddof]) стандартное отклонение в скользящем окне
Rolling.min (\*args, \*\*kwargs) минимальное значение в скользящем окне
Rolling.max (\*args, \*\*kwargs) максимальное значение в скользящем окне
Rolling.corr ([other, pairwise]) выборочная корреляция в скользящем окне
Rolling.cov ([other, pairwise, ddof]) выборочная ковариация в скользящем окне
Rolling.skew (\*\*kwargs) несмещённая скользящая асимметрия
Rolling.kurt (\*\*kwargs) несмещённый скользящий эксцесс
Rolling.apply (func[, args, kwargs]) применение функции к скользящему окну
Rolling.quantile (quantile, \*\*kwargs) скользящий квантиль
Window.mean (\*args, \*\*kwargs) среднее значение в окне
Window.sum (\*args, \*\*kwargs) сумма в окне
Стандартные функции расширяющегося окна
Expanding.count (\*\*kwargs) расширяющееся подсчёт количества значений, отличных от NaN
Expanding.sum (\*args, \*\*kwargs) расширяющаяся сумма
Expanding.mean (\*args, \*\*kwargs) расширяющееся среднее значение
Expanding.median (\*\*kwargs) расширяющаяся медиана
Expanding.var ([ddof]) расширяющаяся дисперсия
Expanding.std ([ddof]) расширяющееся стандартное отклонение
Expanding.min (\*args, \*\*kwargs) расширяющееся минимальное значение
Expanding.max (\*args, \*\*kwargs) расширяющееся максимальное значение
Expanding.corr ([other, pairwise]) расширяющаяся выборочная корреляция
Expanding.cov ([other, pairwise, ddof]) расширяющаяся выборочная ковариация
Expanding.skew (\*\*kwargs) Несмещённый расширяющийся коэффициент асимметрии
Expanding.kurt (\*\*kwargs) Несмещённый расширяющийся эксцесс
Expanding.apply (func[, args, kwargs]) расширяющееся применение функции
Expanding.quantile (quantile, \*\*kwargs) расширяющаяся квантиль
Экспоненциально взвешенные функции скользящего окна
EWM.mean (\*args, \*\*kwargs) экспоненциально взвешенное скользящее среднее
EWM.std ([bias]) экспоненциально взвешенное скользящее стандартное отклонение
EWM.var ([bias]) экспоненциально взвешенное скользящее среднеквадратическое отклонение
EWM.corr ([other, pairwise]) экспоненциально взвешенная выборочная корреляция
EWM.cov ([other, pairwise, bias]) экспоненциально взвешенная выборочная ковариация
Группировка Объекты GroupBy возвращаются вызовами groupby: pandas.DataFrame.groupby() , pandas.Series.groupby() и т. д.
Индексирование, итерация
Grouper ([key, level, freq, axis, sort]) Grouper позволяет пользователю указать инструкцию groupby для целевого объекта
Применение функций Вычисления/описательные статистики
GroupBy.count () Вычисление количества элементов в группе, исключая пропущенные значения
GroupBy.cumcount ([ascending]) Присваивание номера каждому элементу в каждой группе от 0 до длины группы - 1.
GroupBy.first () Вычисление первого значения в группе
GroupBy.head ([n]) Возвращает первые n строк каждой группы.
GroupBy.last () Вычисление последнего значения в группе
GroupBy.max () Вычисление максимального значения в группе
GroupBy.mean (\*args, \*\*kwargs) Вычисление среднего значения в группах, исключая пропущенные значения
GroupBy.median () Вычисление медианы в группах, исключая пропущенные значения
GroupBy.min () Вычисление минимального значения в группе
GroupBy.nth (n[, dropna]) Возвращает n-ю строку из каждой группы, если n – целое число, или подмножество строк, если n – список целых чисел.
GroupBy.ohlc () Вычисление суммы значений, исключая пропущенные значения
GroupBy.prod () Вычисление произведения значений в группе
GroupBy.size () Вычисление размеров групп
GroupBy.sem ([ddof]) Вычисление стандартной ошибки среднего значения в группах, исключая пропущенные значения
GroupBy.std ([ddof]) Вычисление стандартного отклонения групп, исключая пропущенные значения
GroupBy.sum () Вычисление суммы значений в группе
GroupBy.var ([ddof]) Вычисление дисперсии групп, исключая пропущенные значения
GroupBy.tail ([n]) Возвращает последние n строк каждой группы
Следующие методы доступны в обоих объектах SeriesGroupBy и DataFrameGroupBy, но могут незначительно отличаться, обычно в том, что версия DataFrameGroupBy обычно позволяет указать аргумент axis и часто аргумент, указывающий, следует ли ограничить применение к столбцам определённого типа данных.
DataFrameGroupBy.agg (arg, \*args, \*\*kwargs) Агрегирование с использованием входной функции или словаря {столбец ->
DataFrameGroupBy.all ([axis, bool_only, ...]) Возвращает значение True, если все элементы по указанной оси равны True
DataFrameGroupBy.any ([axis, bool_only, ...]) Возвращает значение True, если хотя бы один элемент по указанной оси равен True
DataFrameGroupBy.bfill ([limit]) Заполняет значения по принципу обратного заполнения
DataFrameGroupBy.corr ([method, min_periods]) Вычисляет парную корреляцию столбцов, исключая значения NA/null
DataFrameGroupBy.count () Вычисляет количество элементов в группе, исключая пропущенные значения
DataFrameGroupBy.cov ([min_periods]) Вычисляет парную ковариацию столбцов, исключая значения NA/null
DataFrameGroupBy.cummax ([axis, skipna]) Возвращает накопительный максимум по указанной оси.
DataFrameGroupBy.cummin ([axis, skipna]) Возвращает накопительный минимум по указанной оси.
DataFrameGroupBy.cumprod ([axis]) Накопительное произведение для каждой группы
DataFrameGroupBy.cumsum ([axis]) Накопительная сумма для каждой группы
DataFrameGroupBy.describe ([percentiles, ...]) Генерирует различные сводные статистические данные, исключая значения NaN.
DataFrameGroupBy.diff ([periods, axis]) Первое дискретное различие объекта
DataFrameGroupBy.ffill ([limit]) Заполняет значения по принципу прямого заполнения
DataFrameGroupBy.fillna ([value, method, ...]) Заполняет пропущенные значения NA/NaN указанным методом
DataFrameGroupBy.hist (data[, column, by, ...]) Строит гистограмму серии DataFrame с использованием matplotlib / pylab.
DataFrameGroupBy.idxmax ([axis, skipna]) Возвращает индекс первого вхождения максимального значения по указанной оси.
DataFrameGroupBy.idxmin ([axis, skipna]) Возвращает индекс первого вхождения минимального значения по указанной оси.
DataFrameGroupBy.mad ([axis, skipna, level]) Возвращает среднее абсолютное отклонение значений по указанной оси
DataFrameGroupBy.pct_change ([periods, ...]) Процентное изменение за заданное количество периодов.
DataFrameGroupBy.plot Класс, реализующий атрибут .plot для объектов groupby
DataFrameGroupBy.quantile ([q, axis, ...]) Возвращает значения в заданном квантиле по указанной оси, аналогично numpy.percentile.
DataFrameGroupBy.rank ([axis, method, ...]) Вычисляет числовые ранги данных (от 1 до n) по оси.
DataFrameGroupBy.resample (rule, \*args, \*\*kwargs) Предоставляет ресемплирование при использовании TimeGrouper
DataFrameGroupBy.shift ([periods, freq, axis]) Смещает каждую группу на periods наблюдений
DataFrameGroupBy.size () Вычисляет размер каждой группы
DataFrameGroupBy.skew ([axis, skipna, level, ...]) Возвращает несмещенное искажение по указанной оси
DataFrameGroupBy.take (indices[, axis, ...]) Аналогично ndarray.take
DataFrameGroupBy.tshift ([periods, freq, axis]) Смещает временной индекс, используя частоту индекса, если она доступна.
Следующие методы доступны только для объектов SeriesGroupBy.
Следующие методы доступны только для объектов DataFrameGroupBy.
Ресемплирование Объекты Resampler возвращаются вызовами resample: pandas.DataFrame.resample() , pandas.Series.resample() .
Индексирование, итерация Применение функций
Resampler.apply (arg, \*args, \*\*kwargs) Применение агрегирующей функции или функций к ресемплированным группам, возвращает
Resampler.aggregate (arg, \*args, \*\*kwargs) Применение агрегирующей функции или функций к ресемплированным группам, возвращает
Resampler.transform (arg, \*args, \*\*kwargs) Вызов функции, которая генерирует Series с аналогичным индексом для каждой группы и возвращает
Увеличение частоты выборки (Upsampling) Вычисления/Дескриптивные статистики
Resampler.count ([_method]) Вычисление количества элементов в группе, исключая пропущенные значения
Resampler.nunique ([_method]) Возвращает количество уникальных элементов в группе
Resampler.first ([_method]) Вычисление первого значения в группе
Resampler.last ([_method]) Вычисление последнего значения в группе
Resampler.max ([_method]) Вычисление максимального значения в группе
Resampler.mean ([_method]) Вычисление среднего значения в группах, исключая пропущенные значения
Resampler.median ([_method]) Вычисление медианы в группах, исключая пропущенные значения
Resampler.min ([_method]) Вычисление минимального значения в группе
Resampler.ohlc ([_method]) Вычисление суммы значений, исключая пропущенные значения
Resampler.prod ([_method]) Вычисление произведения значений в группе
Resampler.size ([_method]) Вычисление размеров групп
Resampler.sem ([_method]) Вычисление стандартной ошибки среднего в группах, исключая пропущенные значения
Resampler.std ([ddof]) Вычисление стандартного отклонения в группах, исключая пропущенные значения
Resampler.sum ([_method]) Вычисление суммы значений в группе
Resampler.var ([ddof]) Вычисление дисперсии в группах, исключая пропущенные значения
Стиль Styler объекты возвращаются методом pandas.DataFrame.style .
Конструктор
Styler (data[, precision, table_styles, ...]) Помогает стилизовать DataFrame или Series в соответствии с данными с помощью HTML и CSS.
Применение стиля
Styler.apply (func[, axis, subset]) Применить функцию по столбцам, строкам или всей таблице, обновляя HTML-представление результатом.
Styler.applymap (func[, subset]) Применить функцию к элементам, обновляя HTML-представление результатом.
Styler.format (formatter[, subset]) Форматировать значение отображаемого текста ячеек.
Styler.set_precision (precision) Установить точность, используемую для рендеринга.
Styler.set_table_styles (table_styles) Установить стили таблицы для Styler.
Styler.set_caption (caption) Установить заголовок для Styler.
Styler.set_properties ([subset]) Удобный метод для установки одного или нескольких свойств, не зависящих от данных, для каждой ячейки.
Styler.set_uuid (uuid) Установить uuid для Styler.
Styler.clear () «Сбросить» стилер, удалив ранее примененные стили.
Встроенные стили
Styler.highlight_max ([subset, color, axis]) Выделить максимальное значение, затемняя фон.
Styler.highlight_min ([subset, color, axis]) Выделить минимальное значение, затемняя фон.
Styler.highlight_null ([null_color]) Затемнить фон null_color для пропущенных значений.
Styler.background_gradient ([cmap, low, ...]) Окрасить фон градиентом в соответствии с данными в каждом столбце (при необходимости в каждой строке).
Styler.bar ([subset, axis, color, width]) Окрасить фон color пропорционально значениям в каждом столбце.
Экспорт и импорт стилей
Styler.render () Рендерить построенные стили в HTML.
Styler.export () Экспортировать стили, примененные к текущему Styler.
Styler.use (styles) Установить стили на текущем Styler, возможно, используя стили из Styler.export.
Общие служебные функции Работа с параметрами
describe_option (pat[, _print_desc]) Выводит описание для одного или нескольких зарегистрированных параметров.
reset_option (pat) Сбросить один или несколько параметров до их значения по умолчанию.
get_option (pat) Извлекает значение указанного параметра.
set_option (pat, value) Устанавливает значение указанного параметра.
option_context (\*args) Управляющая структура контекста для временного изменения параметров в контексте оператора with.