pandas.DataFrame
-
class pandas.DataFrame(data=None, index=None, columns=None, dtype=None, copy=False) -
Двумерная изменяемая по размеру, потенциально неоднородная таблица данных с маркированными осями (строки и столбцы). Арифметические операции выравниваются по меткам строк и столбцов. Можно рассматривать как контейнер типа dict для объектов Series. Основная структура данных pandas
Параметры: data : numpy ndarray (структурированный или однородный), dict или DataFrame
Dict может содержать Series, массивы, константы или спископодобные объекты
index : Index или массив-подобный объект
Индекс, используемый для результирующей таблицы. Будет по умолчанию равен np.arange(n), если никакая информация об индексации не содержится в входных данных и индекс не предоставлен
columns : Index или массив-подобный объект
Метки столбцов для использования в результирующей таблице. Будет по умолчанию равен np.arange(n), если метки столбцов не предоставлены
dtype : dtype, по умолчанию None
Тип данных для принудительного применения, в противном случае определяется автоматически
copy : boolean, по умолчанию False
Копировать данные из входов. Воздействует только на входные данные DataFrame / 2d ndarray
См. также
-
DataFrame.from_records - конструктор из кортежей, также массивов записей
-
DataFrame.from_dict - из словарей Series, массивов или словарей
-
DataFrame.from_items - из последовательности пар (ключ, значение)
Примеры
>>> d = {'col1': ts1, 'col2': ts2} >>> df = DataFrame(data=d, index=index) >>> df2 = DataFrame(np.random.randn(10, 5)) >>> df3 = DataFrame(np.random.randn(10, 5), ... columns=['a', 'b', 'c', 'd', 'e'])Атрибуты
TТранспонировать индекс и столбцы atБыстрый скалярный аксессор на основе меток axesВозвращает список с метками оси строк и метками оси столбцов в качестве единственных членов. blocksВнутреннее свойство, синоним свойства для as_blocks() dtypesВозвращает типы данных в этом объекте. emptyИстинно, если NDFrame полностью пуст [нет элементов], что означает, что любая из осей имеет длину 0. ftypesВозвращает ftypes (указание разреженности/плотности и типа данных) в этом объекте. iatБыстрый скалярный аксессор целочисленного местоположения. ilocИндексация только на основе целочисленного местоположения для выбора по позиции. is_copyixИндексатор, в основном основанный на метке-местоположении, с по умолчанию возвращением целочисленной позиции. locИндексатор, исключительно основанный на метке-местоположении, для выбора по метке. ndimКоличество осей / размерностей массива shapeВозвращает кортеж, представляющий размерность DataFrame. sizeколичество элементов в NDFrame styleСвойство, возвращающее объект Styler, содержащий методы для построения стилизованного HTML-представления DataFrame. valuesNumpy представление NDFrame Методы
-
abs()Возвращает объект со взятым модулем – применима только к объектам, которые полностью числовые. add(other[, axis, level, fill_value])Сложение DataFrame и other, поэлементно (бинарная операция add).add_prefix(prefix)Конкатенация префиксной строки с именами элементов панели. add_suffix(suffix)Конкатенация суффиксной строки с именами элементов панели. align(other[, join, axis, level, copy, ...])Выравнивание двух объектов по их осям с all([axis, bool_only, skipna, level])Возвращает True, если все элементы на заданной оси равны True any([axis, bool_only, skipna, level])Возвращает True, если любой элемент на заданной оси равен True append(other[, ignore_index, verify_integrity])Добавление строк otherв конец этой таблицы, возвращая новый объект.apply(func[, axis, broadcast, raw, reduce, args])Применяет функцию вдоль входной оси DataFrame. applymap(func)Применяет функцию к DataFrame, которая предназначена для поэлементной работы, т.е. as_blocks([copy])Преобразование таблицы в словарь типов dtype -> Конструктор типов, каждый из которых имеет однородный тип dtype. as_matrix([columns])Преобразование таблицы в ее представление в виде массива NumPy. asfreq(freq[, method, how, normalize])Преобразование всех TimeSeries внутри в указанную частоту с использованием объектов DateOffset. assign(**kwargs)Присваивание новых столбцов DataFrame, возвращающий новый объект (копию) со всеми исходными столбцами в дополнение к новым. astype(dtype[, copy, raise_on_error])Преобразование объекта в входной тип numpy.dtype at_time(time[, asof])Выбор значений в определенное время суток (например, between_time(start_time, end_time[, ...])Выбор значений между определенными временами суток (например, 9:00-9:30 утра). bfill([axis, inplace, limit, downcast])Синоним для NDFrame.fillna(method=’bfill’) bool()Возвращает логическое значение для единственного элемента PandasObject. boxplot([column, by, ax, fontsize, rot, ...])Построение диаграммы размаха из столбца DataFrame, необязательно с группировкой по некоторым столбцам или clip([lower, upper, axis])Обрезка значений по входному порогу(ам). clip_lower(threshold[, axis])Возвращает копию входных данных со значениями, меньшими заданного значения(й), усеченными. clip_upper(threshold[, axis])Возвращает копию входных данных со значениями, большими заданного значения(й), усеченными. combine(other, func[, fill_value, overwrite])Сложение двух DataFrame объектов и не распространение значений NaN, поэтому, если для combineAdd(other)УСТАРЕЛО. combineMult(other)УСТАРЕЛО. combine_first(other)Объединение двух DataFrame объектов и по умолчанию используется значения, не равные null, в вызываемом методе frame. compound([axis, skipna, level])Возвращает составной процент значений для запрошенной оси consolidate([inplace])Вычисление NDFrame с «консолидированными» внутренними данными (данные каждого типа данных сгруппированы вместе в одном массиве ndarray). convert_objects([convert_dates, ...])Устаревшая функция. copy([deep])Создать копию данных этого объекта. corr([method, min_periods])Вычисление парной корреляции столбцов, исключая значения NA/null corrwith(other[, axis, drop])Вычисление парной корреляции между строками или столбцами двух DataFrame объектов. count([axis, level, numeric_only])Возвращает Series с количеством наблюдений, не равных NA/null, на запрошенной оси. cov([min_periods])Вычисление парной ковариации столбцов, исключая значения NA/null cummax([axis, dtype, out, skipna])Возвращает накопительное значение cummax по запрошенной оси. cummin([axis, dtype, out, skipna])Возвращает накопительное значение cummin по запрошенной оси. cumprod([axis, dtype, out, skipna])Возвращает накопительное значение cumprod по запрошенной оси. cumsum([axis, dtype, out, skipna])Возвращает накопительное значение cumsum по запрошенной оси. describe([percentiles, include, exclude])Генерация различных сводных статистик, исключая значения NaN. diff([periods, axis])1-е дискретное различие объекта div(other[, axis, level, fill_value])Деление с плавающей запятой DataFrame и other, поэлементно (бинарная операция truediv).divide(other[, axis, level, fill_value])Деление с плавающей запятой DataFrame и other, поэлементно (бинарная операция truediv).dot(other)Матричное умножение с DataFrame или Series объектами drop(labels[, axis, level, inplace, errors])Возвращает новый объект со удаленными метками на запрошенной оси. drop_duplicates(*args, **kwargs)Возвращает DataFrame со удаленными дублирующими строками, необязательно только
dropna([axis, how, thresh, subset, inplace])Возвращает объект с удаленными метками на заданной оси, где поочередно любые duplicated(*args, **kwargs)Возвращает булеву серию, обозначающую дублирующие строки, необязательно только eq(other[, axis, level])Обёртка для гибких методов сравнения eq equals(other)Определяет, содержат ли два объекта NDFrame одинаковые элементы. eval(expr[, inplace])Вычислить выражение в контексте вызывающего экземпляра DataFrame. ewm([com, span, halflife, alpha, ...])Предоставляет экспоненциально взвешенные функции expanding([min_periods, freq, center, axis])Предоставляет расширяющие преобразования. ffill([axis, inplace, limit, downcast])Синоним для NDFrame.fillna(method=’ffill’) fillna([value, method, axis, inplace, ...])Заполнить значения NA/NaN с помощью указанного метода filter([items, like, regex, axis])Ограничить ось информации набором элементов или символами подстановки first(offset)Удобный метод для подмножества начальных периодов временных рядов данных на основе смещения даты. first_valid_index()Возвращает метку для первого ненулевого значения floordiv(other[, axis, level, fill_value])Целочисленное деление DataFrame и other, поэлементно (бинарный оператор floordiv).from_csv(path[, header, sep, index_col, ...])Чтение файла CSV (НЕ РЕКОМЕНДУЕТСЯ, используйте pandas.read_csv()вместо этого).from_dict(data[, orient, dtype])Построение DataFrame из словаря массивоподобных объектов или словарей from_items(items[, columns, orient])Преобразование пар (ключ, значение) в DataFrame. from_records(data[, index, exclude, ...])Преобразование структурированного или массива записей в DataFrame ge(other[, axis, level])Обёртка для гибких методов сравнения ge get(key[, default])Получить элемент из объекта для данного ключа (колонка DataFrame, срез Panel и т. д.). get_dtype_counts()Возвращает количество типов данных в этом объекте. get_ftype_counts()Возвращает количество типов данных в этом объекте. get_value(index, col[, takeable])Быстрое получение одного значения по указанной колонке и индексу get_values()То же самое, что и values (но обрабатывает преобразования разреженности) groupby([by, axis, level, as_index, sort, ...])Группировка серии с помощью отображения (словарь или функция ключа, применение данной функции к группе, возврат результата в виде серии) или по серии столбцов. gt(other[, axis, level])Обёртка для гибких методов сравнения gt head([n])Возвращает первые n строк hist(data[, column, by, grid, xlabelsize, ...])Отображение гистограммы серии DataFrame с использованием matplotlib/pylab. icol(i)УСТАНОВЛЕНО. idxmax([axis, skipna])Возвращает индекс первого вхождения максимума по запрошенной оси. idxmin([axis, skipna])Возвращает индекс первого вхождения минимума по запрошенной оси. iget_value(i, j)УСТАНОВЛЕНО. info([verbose, buf, max_cols, memory_usage, ...])Краткий сводный отчет о DataFrame. insert(loc, column, value[, allow_duplicates])Вставить колонку в DataFrame в указанном месте. interpolate([method, axis, limit, inplace, ...])Интерполировать значения в соответствии с различными методами. irow(i[, copy])УСТАНОВЛЕНО. isin(values)Возвращает булевый DataFrame, показывающий, содержится ли каждый элемент в DataFrame в значениях. isnull()Возвращает объект той же размерности, что и булево значение, показывающий, являются ли значения нулевыми. iteritems()Итератор по парам (имя столбца, Series). iterkv(*args, **kwargs)Псевдоним iteritems, используемый для обхода 2to3. Устарело iterrows()Итерирование по строкам DataFrame как по парам (индекс, Series). itertuples([index, name])Итерирование по строкам DataFrame как именованных кортежей, значение индекса как первый элемент кортежа. join(other[, on, how, lsuffix, rsuffix, sort])Объединить столбцы с другим DataFrame по индексу или по столбцу ключа. keys()Получить ‘ось информации’ (подробнее в Индексировании) kurt([axis, skipna, level, numeric_only])Возвращает смещенное эксцесс по запрошенной оси с использованием определения эксцесса Фишера (эксцесс нормального == 0.0). kurtosis([axis, skipna, level, numeric_only])Возвращает смещенное эксцесс по запрошенной оси с использованием определения эксцесса Фишера (эксцесс нормального == 0.0). last(offset)Удобный метод для подмножества конечных периодов временных рядов данных на основе смещения даты.
last_valid_index()Возвращает метку последнего не-NA/не-null значения le(other[, axis, level])Обёртка для гибких методов сравнения le lookup(row_labels, col_labels)Функция «fancy indexing» по меткам для DataFrame. lt(other[, axis, level])Обёртка для гибких методов сравнения lt mad([axis, skipna, level])Возвращает среднее абсолютное отклонение значений для запрошенной оси mask(cond[, other, inplace, axis, level, ...])Возвращает объект такой же формы, как self, и содержащий значения из self, где cond ложно, а в противном случае - из other. max([axis, skipna, level, numeric_only])Этот метод возвращает максимальное значение в объекте. mean([axis, skipna, level, numeric_only])Возвращает среднее значение значений для указанной оси median([axis, skipna, level, numeric_only])Возвращает медиану значений для указанной оси memory_usage([index, deep])Использование памяти столбцами DataFrame. merge(right[, how, on, left_on, right_on, ...])Объединение объектов DataFrame, выполняя объединение по столбцам или индексам в стиле баз данных. min([axis, skipna, level, numeric_only])Этот метод возвращает минимальное значение в объекте. mod(other[, axis, level, fill_value])Остаток от деления dataframe и other, поэлементно (бинарная операция mod).mode([axis, numeric_only])Получает моду (режимы) каждого элемента вдоль выбранной оси. mul(other[, axis, level, fill_value])Умножение dataframe и other, поэлементно (бинарная операция mul).multiply(other[, axis, level, fill_value])Умножение dataframe и other, поэлементно (бинарная операция mul).ne(other[, axis, level])Обёртка для гибких методов сравнения ne nlargest(n, columns[, keep])Получить строки DataFrame, отсортированные по nнаибольшим значениямcolumns.notnull()Возвращает булевый объект той же размерности, указывающий, не являются ли значения нулевыми. nsmallest(n, columns[, keep])Получить строки DataFrame, отсортированные по nнаименьшим значениямcolumns.pct_change([periods, fill_method, limit, freq])Процентное изменение за заданное количество периодов. pipe(func, *args, **kwargs)Применить func(self, *args, **kwargs) pivot([index, columns, values])Изменение структуры данных (создание «пивотной» таблицы) на основе значений столбцов. pivot_table(data[, values, index, columns, ...])Создание таблицы сводного отчёта в стиле электронной таблицы как DataFrame. plotПсевдоним FramePlotMethodspop(item)Возвращает элемент и удаляет его из кадра. pow(other[, axis, level, fill_value])Возведение в степень dataframe и other, поэлементно (бинарная операция pow).prod([axis, skipna, level, numeric_only])Возвращает произведение значений для запрошенной оси product([axis, skipna, level, numeric_only])Возвращает произведение значений для запрошенной оси quantile([q, axis, numeric_only, interpolation])Возвращает значения в заданном квантиле по запрошенной оси, подобно numpy.percentile. query(expr[, inplace])Запрос по столбцам кадра с булевым выражением. radd(other[, axis, level, fill_value])Сложение dataframe и other, поэлементно (бинарная операция radd).rank([axis, method, numeric_only, ...])Вычисление рангов числовых данных (от 1 до n) по оси. rdiv(other[, axis, level, fill_value])Деление с плавающей запятой dataframe и other, поэлементно (бинарная операция rtruediv).reindex([index, columns])Соответствие DataFrame новому индексу с необязательной логикой заполнения, размещение NA/NaN в местах, где нет значения в предыдущем индексе. reindex_axis(labels[, axis, method, level, ...])Соответствие входного объекта новому индексу с необязательной логикой заполнения, размещение NA/NaN в местах, где нет значения в предыдущем индексе. reindex_like(other[, method, copy, limit, ...])Возвращает объект с совпадающими индексами с самим собой. rename([index, columns])Изменение входной функции или функций осей. rename_axis(mapper[, axis, copy, inplace])Изменение индекса и/или столбцов с помощью входной функции или функций. reorder_levels(order[, axis])Переупорядочивание уровней индекса с использованием входного порядка. replace([to_replace, value, inplace, limit, ...])Замена значений, указанных в ‘to_replace’, на ‘value’. resample(rule[, how, axis, fill_method, ...])Удобный метод для преобразования частоты и ресемплирования регулярных временных рядов. reset_index([level, drop, inplace, ...])Для DataFrame с многоуровневым индексом, возвращает новый DataFrame со сведениями об именовании в столбцах под именами индексов, по умолчанию ‘level_0’, ‘level_1’ и т.д.
rfloordiv(other[, axis, level, fill_value])Целочисленное деление DataFrame и other по элементам (бинарный оператор rfloordiv).rmod(other[, axis, level, fill_value])Остаток от деления DataFrame и other по элементам (бинарный оператор rmod).rmul(other[, axis, level, fill_value])Умножение DataFrame и other по элементам (бинарный оператор rmul).rolling(window[, min_periods, freq, center, ...])Предоставляет операции скользящего среднего. round([decimals])Округляет DataFrame до заданного числа десятичных знаков. rpow(other[, axis, level, fill_value])Возведение в степень DataFrame и other по элементам (бинарный оператор rpow).rsub(other[, axis, level, fill_value])Вычитание DataFrame и other по элементам (бинарный оператор rsub).rtruediv(other[, axis, level, fill_value])Деление с плавающей точкой DataFrame и other по элементам (бинарный оператор rtruediv).sample([n, frac, replace, weights, ...])Возвращает случайную выборку элементов из оси объекта. select(crit[, axis])Возвращает данные, соответствующие меткам осей, удовлетворяющим критериям. select_dtypes([include, exclude])Возвращает подмножество DataFrame, включающее/исключающее столбцы на основе их dtype.sem([axis, skipna, level, ddof, numeric_only])Возвращает смещённую стандартную ошибку среднего по запрошенной оси. set_axis(axis, labels)публичная версия присваивания осей set_index(keys[, drop, append, inplace, ...])Установить индекс DataFrame (метки строк) используя один или несколько существующих столбцов. set_value(index, col, value[, takeable])Установить единственное значение в указанном столбце и индексе shift([periods, freq, axis])Сдвигает индекс на необходимое количество периодов с опциональной временной частотой. skew([axis, skipna, level, numeric_only])Возвращает смещённое искажение по запрошенной оси. slice_shift([periods, axis])Эквивалентно shiftбез копирования данных.sort([columns, axis, ascending, inplace, ...])УСТАРЕЛО: используйте DataFrame.sort_values()sort_index([axis, level, ascending, ...])Сортировка объекта по меткам (по оси) sort_values(by[, axis, ascending, inplace, ...])Сортировка по значениям вдоль оси sortlevel([level, axis, ascending, inplace, ...])Сортировка многоуровневого индекса по выбранной оси и основному уровню. squeeze(**kwargs)Сжать измерения длиной 1. stack([level, dropna])Поворот уровня меток столбцов (возможно, иерархических), возвращающий DataFrame (или Series в случае объекта с одним уровнем меток столбцов), имеющий иерархический индекс с новым внутренним уровнем меток строк. std([axis, skipna, level, ddof, numeric_only])Возвращает выборочное стандартное отклонение по запрошенной оси. sub(other[, axis, level, fill_value])Вычитание DataFrame и other по элементам (бинарный оператор sub).subtract(other[, axis, level, fill_value])Вычитание DataFrame и other по элементам (бинарный оператор sub).sum([axis, skipna, level, numeric_only])Возвращает сумму значений по запрошенной оси. swapaxes(axis1, axis2[, copy])Меняет оси и соответствующим образом меняет значения осей. swaplevel([i, j, axis])Меняет уровни i и j в MultiIndex по определенной оси. tail([n])Возвращает последние n строк. take(indices[, axis, convert, is_copy])Аналогично ndarray.take. to_clipboard([excel, sep])Попытка записи текстового представления объекта в буфер обмена системы. Это можно вставить в Excel, например. to_csv([path_or_buf, sep, na_rep, ...])Запись DataFrame в файл с разделителем запятыми (csv). to_dense()Возвращает плотное представление NDFrame (в отличие от разреженного). to_dict(*args, **kwargs)Преобразование DataFrame в словарь. to_excel(excel_writer[, sheet_name, na_rep, ...])Запись DataFrame в лист Excel. to_gbq(destination_table, project_id[, ...])Запись DataFrame в таблицу Google BigQuery. to_hdf(path_or_buf, key, **kwargs)Активирует хранилище HDF. to_html([buf, columns, col_space, colSpace, ...])Вывод DataFrame в виде HTML-таблицы. to_json([path_or_buf, orient, date_format, ...])Преобразование объекта в JSON-строку. to_latex([buf, columns, col_space, ...])Вывод DataFrame в табличную среду LaTeX. to_msgpack([path_or_buf, encoding])Преобразование объекта msgpack в указанный файл. to_panel()Преобразование данных из длинного (стекового) формата (DataFrame) в широкий (3D, Panel) формат.
to_period([freq, axis, copy])Преобразовать DataFrame из DatetimeIndex в PeriodIndex с желаемой to_pickle(path)Записать объект в файл (сериализовать) в указанный путь. to_records([index, convert_datetime64])Преобразовать DataFrame в массив записей. to_sparse([fill_value, kind])Преобразовать в SparseDataFrame to_sql(name, con[, flavor, schema, ...])Записать записи, хранящиеся в DataFrame, в базу данных SQL. to_stata(fname[, convert_dates, ...])Класс для записи двоичных файлов Stata dta из объектов типа массива to_string([buf, columns, col_space, header, ...])Вывести DataFrame в табличном формате, удобном для консоли. to_timestamp([freq, how, axis, copy])Преобразовать в DatetimeIndex временных меток, в начале периода to_wide(*args, **kwargs)to_xarray()Возвратить объект xarray из объекта pandas. transpose(*args, **kwargs)Транспонировать индексы и столбцы truediv(other[, axis, level, fill_value])Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция truediv).truncate([before, after, axis, copy])Обрезает отсортированный NDFrame до и/или после определенных дат. tshift([periods, freq, axis])Сдвинуть временной индекс, используя частоту индекса, если она доступна. tz_convert(tz[, axis, level, copy])Преобразовать временную зону осей, учитывающих временную зону, в целевую временную зону. tz_localize(*args, **kwargs)Локализовать TimeSeries без временной зоны в целевую временную зону. unstack([level, fill_value])Повернуть уровень метки индекса (обязательно иерархический), возвращая DataFrame с новым уровнем меток столбцов, внутренний уровень которых состоит из повернутых меток индекса. update(other[, join, overwrite, ...])Изменить DataFrame на месте, используя значения, отличные от NaN, из переданного DataFrame. var([axis, skipna, level, ddof, numeric_only])Возвратить несмещенную дисперсию по запрошенной оси. where(cond[, other, inplace, axis, level, ...])Возвращает объект той же формы, что и self, и чьи соответствующие элементы взяты из self, где cond истинно, а в противном случае из other. xs(key[, axis, level, copy, drop_level])Возвращает поперечное сечение (строка(и) или столбец(ы)) из Series/DataFrame.
© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.DataFrame.html