Spec-Zone.ru › pandas 0.18

pandas.DataFrame

class pandas.DataFrame(data=None, index=None, columns=None, dtype=None, copy=False)

Двумерная изменяемая по размеру, потенциально неоднородная таблица данных с маркированными осями (строки и столбцы). Арифметические операции выравниваются по меткам строк и столбцов. Можно рассматривать как контейнер типа dict для объектов Series. Основная структура данных pandas

Параметры:

data : numpy ndarray (структурированный или однородный), dict или DataFrame

Dict может содержать Series, массивы, константы или спископодобные объекты

index : Index или массив-подобный объект

Индекс, используемый для результирующей таблицы. Будет по умолчанию равен np.arange(n), если никакая информация об индексации не содержится в входных данных и индекс не предоставлен

columns : Index или массив-подобный объект

Метки столбцов для использования в результирующей таблице. Будет по умолчанию равен np.arange(n), если метки столбцов не предоставлены

dtype : dtype, по умолчанию None

Тип данных для принудительного применения, в противном случае определяется автоматически

copy : boolean, по умолчанию False

Копировать данные из входов. Воздействует только на входные данные DataFrame / 2d ndarray

См. также

DataFrame.from_records
конструктор из кортежей, также массивов записей
DataFrame.from_dict
из словарей Series, массивов или словарей
DataFrame.from_items
из последовательности пар (ключ, значение)

pandas.read_csv, pandas.read_table, pandas.read_clipboard

Примеры

>>> d = {'col1': ts1, 'col2': ts2}
>>> df = DataFrame(data=d, index=index)
>>> df2 = DataFrame(np.random.randn(10, 5))
>>> df3 = DataFrame(np.random.randn(10, 5),
...                 columns=['a', 'b', 'c', 'd', 'e'])

Атрибуты

T Транспонировать индекс и столбцы
at Быстрый скалярный аксессор на основе меток
axes Возвращает список с метками оси строк и метками оси столбцов в качестве единственных членов.
blocks Внутреннее свойство, синоним свойства для as_blocks()
dtypes Возвращает типы данных в этом объекте.
empty Истинно, если NDFrame полностью пуст [нет элементов], что означает, что любая из осей имеет длину 0.
ftypes Возвращает ftypes (указание разреженности/плотности и типа данных) в этом объекте.
iat Быстрый скалярный аксессор целочисленного местоположения.
iloc Индексация только на основе целочисленного местоположения для выбора по позиции.
is_copy
ix Индексатор, в основном основанный на метке-местоположении, с по умолчанию возвращением целочисленной позиции.
loc Индексатор, исключительно основанный на метке-местоположении, для выбора по метке.
ndim Количество осей / размерностей массива
shape Возвращает кортеж, представляющий размерность DataFrame.
size количество элементов в NDFrame
style Свойство, возвращающее объект Styler, содержащий методы для построения стилизованного HTML-представления DataFrame.
values Numpy представление NDFrame

Методы

abs() Возвращает объект со взятым модулем – применима только к объектам, которые полностью числовые.
add(other[, axis, level, fill_value]) Сложение DataFrame и other, поэлементно (бинарная операция add).
add_prefix(prefix) Конкатенация префиксной строки с именами элементов панели.
add_suffix(suffix) Конкатенация суффиксной строки с именами элементов панели.
align(other[, join, axis, level, copy, ...]) Выравнивание двух объектов по их осям с
all([axis, bool_only, skipna, level]) Возвращает True, если все элементы на заданной оси равны True
any([axis, bool_only, skipna, level]) Возвращает True, если любой элемент на заданной оси равен True
append(other[, ignore_index, verify_integrity]) Добавление строк other в конец этой таблицы, возвращая новый объект.
apply(func[, axis, broadcast, raw, reduce, args]) Применяет функцию вдоль входной оси DataFrame.
applymap(func) Применяет функцию к DataFrame, которая предназначена для поэлементной работы, т.е.
as_blocks([copy]) Преобразование таблицы в словарь типов dtype -> Конструктор типов, каждый из которых имеет однородный тип dtype.
as_matrix([columns]) Преобразование таблицы в ее представление в виде массива NumPy.
asfreq(freq[, method, how, normalize]) Преобразование всех TimeSeries внутри в указанную частоту с использованием объектов DateOffset.
assign(**kwargs) Присваивание новых столбцов DataFrame, возвращающий новый объект (копию) со всеми исходными столбцами в дополнение к новым.
astype(dtype[, copy, raise_on_error]) Преобразование объекта в входной тип numpy.dtype
at_time(time[, asof]) Выбор значений в определенное время суток (например,
between_time(start_time, end_time[, ...]) Выбор значений между определенными временами суток (например, 9:00-9:30 утра).
bfill([axis, inplace, limit, downcast]) Синоним для NDFrame.fillna(method=’bfill’)
bool() Возвращает логическое значение для единственного элемента PandasObject.
boxplot([column, by, ax, fontsize, rot, ...]) Построение диаграммы размаха из столбца DataFrame, необязательно с группировкой по некоторым столбцам или
clip([lower, upper, axis]) Обрезка значений по входному порогу(ам).
clip_lower(threshold[, axis]) Возвращает копию входных данных со значениями, меньшими заданного значения(й), усеченными.
clip_upper(threshold[, axis]) Возвращает копию входных данных со значениями, большими заданного значения(й), усеченными.
combine(other, func[, fill_value, overwrite]) Сложение двух DataFrame объектов и не распространение значений NaN, поэтому, если для
combineAdd(other) УСТАРЕЛО.
combineMult(other) УСТАРЕЛО.
combine_first(other) Объединение двух DataFrame объектов и по умолчанию используется значения, не равные null, в вызываемом методе frame.
compound([axis, skipna, level]) Возвращает составной процент значений для запрошенной оси
consolidate([inplace]) Вычисление NDFrame с «консолидированными» внутренними данными (данные каждого типа данных сгруппированы вместе в одном массиве ndarray).
convert_objects([convert_dates, ...]) Устаревшая функция.
copy([deep]) Создать копию данных этого объекта.
corr([method, min_periods]) Вычисление парной корреляции столбцов, исключая значения NA/null
corrwith(other[, axis, drop]) Вычисление парной корреляции между строками или столбцами двух DataFrame объектов.
count([axis, level, numeric_only]) Возвращает Series с количеством наблюдений, не равных NA/null, на запрошенной оси.
cov([min_periods]) Вычисление парной ковариации столбцов, исключая значения NA/null
cummax([axis, dtype, out, skipna]) Возвращает накопительное значение cummax по запрошенной оси.
cummin([axis, dtype, out, skipna]) Возвращает накопительное значение cummin по запрошенной оси.
cumprod([axis, dtype, out, skipna]) Возвращает накопительное значение cumprod по запрошенной оси.
cumsum([axis, dtype, out, skipna]) Возвращает накопительное значение cumsum по запрошенной оси.
describe([percentiles, include, exclude]) Генерация различных сводных статистик, исключая значения NaN.
diff([periods, axis]) 1-е дискретное различие объекта
div(other[, axis, level, fill_value]) Деление с плавающей запятой DataFrame и other, поэлементно (бинарная операция truediv).
divide(other[, axis, level, fill_value]) Деление с плавающей запятой DataFrame и other, поэлементно (бинарная операция truediv).
dot(other) Матричное умножение с DataFrame или Series объектами
drop(labels[, axis, level, inplace, errors]) Возвращает новый объект со удаленными метками на запрошенной оси.
drop_duplicates(*args, **kwargs) Возвращает DataFrame со удаленными дублирующими строками, необязательно только
END_OF_DOCUMENT_MARKER
dropna([axis, how, thresh, subset, inplace]) Возвращает объект с удаленными метками на заданной оси, где поочередно любые
duplicated(*args, **kwargs) Возвращает булеву серию, обозначающую дублирующие строки, необязательно только
eq(other[, axis, level]) Обёртка для гибких методов сравнения eq
equals(other) Определяет, содержат ли два объекта NDFrame одинаковые элементы.
eval(expr[, inplace]) Вычислить выражение в контексте вызывающего экземпляра DataFrame.
ewm([com, span, halflife, alpha, ...]) Предоставляет экспоненциально взвешенные функции
expanding([min_periods, freq, center, axis]) Предоставляет расширяющие преобразования.
ffill([axis, inplace, limit, downcast]) Синоним для NDFrame.fillna(method=’ffill’)
fillna([value, method, axis, inplace, ...]) Заполнить значения NA/NaN с помощью указанного метода
filter([items, like, regex, axis]) Ограничить ось информации набором элементов или символами подстановки
first(offset) Удобный метод для подмножества начальных периодов временных рядов данных на основе смещения даты.
first_valid_index() Возвращает метку для первого ненулевого значения
floordiv(other[, axis, level, fill_value]) Целочисленное деление DataFrame и other, поэлементно (бинарный оператор floordiv).
from_csv(path[, header, sep, index_col, ...]) Чтение файла CSV (НЕ РЕКОМЕНДУЕТСЯ, используйте pandas.read_csv() вместо этого).
from_dict(data[, orient, dtype]) Построение DataFrame из словаря массивоподобных объектов или словарей
from_items(items[, columns, orient]) Преобразование пар (ключ, значение) в DataFrame.
from_records(data[, index, exclude, ...]) Преобразование структурированного или массива записей в DataFrame
ge(other[, axis, level]) Обёртка для гибких методов сравнения ge
get(key[, default]) Получить элемент из объекта для данного ключа (колонка DataFrame, срез Panel и т. д.).
get_dtype_counts() Возвращает количество типов данных в этом объекте.
get_ftype_counts() Возвращает количество типов данных в этом объекте.
get_value(index, col[, takeable]) Быстрое получение одного значения по указанной колонке и индексу
get_values() То же самое, что и values (но обрабатывает преобразования разреженности)
groupby([by, axis, level, as_index, sort, ...]) Группировка серии с помощью отображения (словарь или функция ключа, применение данной функции к группе, возврат результата в виде серии) или по серии столбцов.
gt(other[, axis, level]) Обёртка для гибких методов сравнения gt
head([n]) Возвращает первые n строк
hist(data[, column, by, grid, xlabelsize, ...]) Отображение гистограммы серии DataFrame с использованием matplotlib/pylab.
icol(i) УСТАНОВЛЕНО.
idxmax([axis, skipna]) Возвращает индекс первого вхождения максимума по запрошенной оси.
idxmin([axis, skipna]) Возвращает индекс первого вхождения минимума по запрошенной оси.
iget_value(i, j) УСТАНОВЛЕНО.
info([verbose, buf, max_cols, memory_usage, ...]) Краткий сводный отчет о DataFrame.
insert(loc, column, value[, allow_duplicates]) Вставить колонку в DataFrame в указанном месте.
interpolate([method, axis, limit, inplace, ...]) Интерполировать значения в соответствии с различными методами.
irow(i[, copy]) УСТАНОВЛЕНО.
isin(values) Возвращает булевый DataFrame, показывающий, содержится ли каждый элемент в DataFrame в значениях.
isnull() Возвращает объект той же размерности, что и булево значение, показывающий, являются ли значения нулевыми.
iteritems() Итератор по парам (имя столбца, Series).
iterkv(*args, **kwargs) Псевдоним iteritems, используемый для обхода 2to3. Устарело
iterrows() Итерирование по строкам DataFrame как по парам (индекс, Series).
itertuples([index, name]) Итерирование по строкам DataFrame как именованных кортежей, значение индекса как первый элемент кортежа.
join(other[, on, how, lsuffix, rsuffix, sort]) Объединить столбцы с другим DataFrame по индексу или по столбцу ключа.
keys() Получить ‘ось информации’ (подробнее в Индексировании)
kurt([axis, skipna, level, numeric_only]) Возвращает смещенное эксцесс по запрошенной оси с использованием определения эксцесса Фишера (эксцесс нормального == 0.0).
kurtosis([axis, skipna, level, numeric_only]) Возвращает смещенное эксцесс по запрошенной оси с использованием определения эксцесса Фишера (эксцесс нормального == 0.0).
last(offset) Удобный метод для подмножества конечных периодов временных рядов данных на основе смещения даты.
END_OF_DOCUMENT_MARKER
last_valid_index() Возвращает метку последнего не-NA/не-null значения
le(other[, axis, level]) Обёртка для гибких методов сравнения le
lookup(row_labels, col_labels) Функция «fancy indexing» по меткам для DataFrame.
lt(other[, axis, level]) Обёртка для гибких методов сравнения lt
mad([axis, skipna, level]) Возвращает среднее абсолютное отклонение значений для запрошенной оси
mask(cond[, other, inplace, axis, level, ...]) Возвращает объект такой же формы, как self, и содержащий значения из self, где cond ложно, а в противном случае - из other.
max([axis, skipna, level, numeric_only]) Этот метод возвращает максимальное значение в объекте.
mean([axis, skipna, level, numeric_only]) Возвращает среднее значение значений для указанной оси
median([axis, skipna, level, numeric_only]) Возвращает медиану значений для указанной оси
memory_usage([index, deep]) Использование памяти столбцами DataFrame.
merge(right[, how, on, left_on, right_on, ...]) Объединение объектов DataFrame, выполняя объединение по столбцам или индексам в стиле баз данных.
min([axis, skipna, level, numeric_only]) Этот метод возвращает минимальное значение в объекте.
mod(other[, axis, level, fill_value]) Остаток от деления dataframe и other, поэлементно (бинарная операция mod).
mode([axis, numeric_only]) Получает моду (режимы) каждого элемента вдоль выбранной оси.
mul(other[, axis, level, fill_value]) Умножение dataframe и other, поэлементно (бинарная операция mul).
multiply(other[, axis, level, fill_value]) Умножение dataframe и other, поэлементно (бинарная операция mul).
ne(other[, axis, level]) Обёртка для гибких методов сравнения ne
nlargest(n, columns[, keep]) Получить строки DataFrame, отсортированные по n наибольшим значениям columns.
notnull() Возвращает булевый объект той же размерности, указывающий, не являются ли значения нулевыми.
nsmallest(n, columns[, keep]) Получить строки DataFrame, отсортированные по n наименьшим значениям columns.
pct_change([periods, fill_method, limit, freq]) Процентное изменение за заданное количество периодов.
pipe(func, *args, **kwargs) Применить func(self, *args, **kwargs)
pivot([index, columns, values]) Изменение структуры данных (создание «пивотной» таблицы) на основе значений столбцов.
pivot_table(data[, values, index, columns, ...]) Создание таблицы сводного отчёта в стиле электронной таблицы как DataFrame.
plot Псевдоним FramePlotMethods
pop(item) Возвращает элемент и удаляет его из кадра.
pow(other[, axis, level, fill_value]) Возведение в степень dataframe и other, поэлементно (бинарная операция pow).
prod([axis, skipna, level, numeric_only]) Возвращает произведение значений для запрошенной оси
product([axis, skipna, level, numeric_only]) Возвращает произведение значений для запрошенной оси
quantile([q, axis, numeric_only, interpolation]) Возвращает значения в заданном квантиле по запрошенной оси, подобно numpy.percentile.
query(expr[, inplace]) Запрос по столбцам кадра с булевым выражением.
radd(other[, axis, level, fill_value]) Сложение dataframe и other, поэлементно (бинарная операция radd).
rank([axis, method, numeric_only, ...]) Вычисление рангов числовых данных (от 1 до n) по оси.
rdiv(other[, axis, level, fill_value]) Деление с плавающей запятой dataframe и other, поэлементно (бинарная операция rtruediv).
reindex([index, columns]) Соответствие DataFrame новому индексу с необязательной логикой заполнения, размещение NA/NaN в местах, где нет значения в предыдущем индексе.
reindex_axis(labels[, axis, method, level, ...]) Соответствие входного объекта новому индексу с необязательной логикой заполнения, размещение NA/NaN в местах, где нет значения в предыдущем индексе.
reindex_like(other[, method, copy, limit, ...]) Возвращает объект с совпадающими индексами с самим собой.
rename([index, columns]) Изменение входной функции или функций осей.
rename_axis(mapper[, axis, copy, inplace]) Изменение индекса и/или столбцов с помощью входной функции или функций.
reorder_levels(order[, axis]) Переупорядочивание уровней индекса с использованием входного порядка.
replace([to_replace, value, inplace, limit, ...]) Замена значений, указанных в ‘to_replace’, на ‘value’.
resample(rule[, how, axis, fill_method, ...]) Удобный метод для преобразования частоты и ресемплирования регулярных временных рядов.
reset_index([level, drop, inplace, ...]) Для DataFrame с многоуровневым индексом, возвращает новый DataFrame со сведениями об именовании в столбцах под именами индексов, по умолчанию ‘level_0’, ‘level_1’ и т.д.
END_OF_DOCUMENT_MARKER
rfloordiv(other[, axis, level, fill_value]) Целочисленное деление DataFrame и other по элементам (бинарный оператор rfloordiv).
rmod(other[, axis, level, fill_value]) Остаток от деления DataFrame и other по элементам (бинарный оператор rmod).
rmul(other[, axis, level, fill_value]) Умножение DataFrame и other по элементам (бинарный оператор rmul).
rolling(window[, min_periods, freq, center, ...]) Предоставляет операции скользящего среднего.
round([decimals]) Округляет DataFrame до заданного числа десятичных знаков.
rpow(other[, axis, level, fill_value]) Возведение в степень DataFrame и other по элементам (бинарный оператор rpow).
rsub(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарный оператор rsub).
rtruediv(other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other по элементам (бинарный оператор rtruediv).
sample([n, frac, replace, weights, ...]) Возвращает случайную выборку элементов из оси объекта.
select(crit[, axis]) Возвращает данные, соответствующие меткам осей, удовлетворяющим критериям.
select_dtypes([include, exclude]) Возвращает подмножество DataFrame, включающее/исключающее столбцы на основе их dtype.
sem([axis, skipna, level, ddof, numeric_only]) Возвращает смещённую стандартную ошибку среднего по запрошенной оси.
set_axis(axis, labels) публичная версия присваивания осей
set_index(keys[, drop, append, inplace, ...]) Установить индекс DataFrame (метки строк) используя один или несколько существующих столбцов.
set_value(index, col, value[, takeable]) Установить единственное значение в указанном столбце и индексе
shift([periods, freq, axis]) Сдвигает индекс на необходимое количество периодов с опциональной временной частотой.
skew([axis, skipna, level, numeric_only]) Возвращает смещённое искажение по запрошенной оси.
slice_shift([periods, axis]) Эквивалентно shift без копирования данных.
sort([columns, axis, ascending, inplace, ...]) УСТАРЕЛО: используйте DataFrame.sort_values()
sort_index([axis, level, ascending, ...]) Сортировка объекта по меткам (по оси)
sort_values(by[, axis, ascending, inplace, ...]) Сортировка по значениям вдоль оси
sortlevel([level, axis, ascending, inplace, ...]) Сортировка многоуровневого индекса по выбранной оси и основному уровню.
squeeze(**kwargs) Сжать измерения длиной 1.
stack([level, dropna]) Поворот уровня меток столбцов (возможно, иерархических), возвращающий DataFrame (или Series в случае объекта с одним уровнем меток столбцов), имеющий иерархический индекс с новым внутренним уровнем меток строк.
std([axis, skipna, level, ddof, numeric_only]) Возвращает выборочное стандартное отклонение по запрошенной оси.
sub(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарный оператор sub).
subtract(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарный оператор sub).
sum([axis, skipna, level, numeric_only]) Возвращает сумму значений по запрошенной оси.
swapaxes(axis1, axis2[, copy]) Меняет оси и соответствующим образом меняет значения осей.
swaplevel([i, j, axis]) Меняет уровни i и j в MultiIndex по определенной оси.
tail([n]) Возвращает последние n строк.
take(indices[, axis, convert, is_copy]) Аналогично ndarray.take.
to_clipboard([excel, sep]) Попытка записи текстового представления объекта в буфер обмена системы. Это можно вставить в Excel, например.
to_csv([path_or_buf, sep, na_rep, ...]) Запись DataFrame в файл с разделителем запятыми (csv).
to_dense() Возвращает плотное представление NDFrame (в отличие от разреженного).
to_dict(*args, **kwargs) Преобразование DataFrame в словарь.
to_excel(excel_writer[, sheet_name, na_rep, ...]) Запись DataFrame в лист Excel.
to_gbq(destination_table, project_id[, ...]) Запись DataFrame в таблицу Google BigQuery.
to_hdf(path_or_buf, key, **kwargs) Активирует хранилище HDF.
to_html([buf, columns, col_space, colSpace, ...]) Вывод DataFrame в виде HTML-таблицы.
to_json([path_or_buf, orient, date_format, ...]) Преобразование объекта в JSON-строку.
to_latex([buf, columns, col_space, ...]) Вывод DataFrame в табличную среду LaTeX.
to_msgpack([path_or_buf, encoding]) Преобразование объекта msgpack в указанный файл.
to_panel() Преобразование данных из длинного (стекового) формата (DataFrame) в широкий (3D, Panel) формат.
to_period([freq, axis, copy]) Преобразовать DataFrame из DatetimeIndex в PeriodIndex с желаемой
to_pickle(path) Записать объект в файл (сериализовать) в указанный путь.
to_records([index, convert_datetime64]) Преобразовать DataFrame в массив записей.
to_sparse([fill_value, kind]) Преобразовать в SparseDataFrame
to_sql(name, con[, flavor, schema, ...]) Записать записи, хранящиеся в DataFrame, в базу данных SQL.
to_stata(fname[, convert_dates, ...]) Класс для записи двоичных файлов Stata dta из объектов типа массива
to_string([buf, columns, col_space, header, ...]) Вывести DataFrame в табличном формате, удобном для консоли.
to_timestamp([freq, how, axis, copy]) Преобразовать в DatetimeIndex временных меток, в начале периода
to_wide(*args, **kwargs)
to_xarray() Возвратить объект xarray из объекта pandas.
transpose(*args, **kwargs) Транспонировать индексы и столбцы
truediv(other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other, поэлементное (бинарная операция truediv).
truncate([before, after, axis, copy]) Обрезает отсортированный NDFrame до и/или после определенных дат.
tshift([periods, freq, axis]) Сдвинуть временной индекс, используя частоту индекса, если она доступна.
tz_convert(tz[, axis, level, copy]) Преобразовать временную зону осей, учитывающих временную зону, в целевую временную зону.
tz_localize(*args, **kwargs) Локализовать TimeSeries без временной зоны в целевую временную зону.
unstack([level, fill_value]) Повернуть уровень метки индекса (обязательно иерархический), возвращая DataFrame с новым уровнем меток столбцов, внутренний уровень которых состоит из повернутых меток индекса.
update(other[, join, overwrite, ...]) Изменить DataFrame на месте, используя значения, отличные от NaN, из переданного DataFrame.
var([axis, skipna, level, ddof, numeric_only]) Возвратить несмещенную дисперсию по запрошенной оси.
where(cond[, other, inplace, axis, level, ...]) Возвращает объект той же формы, что и self, и чьи соответствующие элементы взяты из self, где cond истинно, а в противном случае из other.
xs(key[, axis, level, copy, drop_level]) Возвращает поперечное сечение (строка(и) или столбец(ы)) из Series/DataFrame.

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.18.1/generated/pandas.DataFrame.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API