Spec-Zone.ru › pandas 0.20

pandas.DataFrame

class pandas.DataFrame(data=None, index=None, columns=None, dtype=None, copy=False) [source]

Двумерная, изменяемая по размеру, потенциально разнородная таблица данных с метками осей (строки и столбцы). Арифметические операции выравниваются по меткам строк и столбцов. Можно рассматривать как контейнер типа dict для объектов Series. Основная структура данных pandas

Параметры:

data : numpy ndarray (структурированный или однородный), dict или DataFrame

Dict может содержать Series, массивы, константы или объекты типа list-like

index : Индекс или массив-подобный объект

Индекс, используемый для итоговой таблицы. Будет по умолчанию равен np.arange(n), если в входных данных нет информации об индексе и индекс не предоставлен

columns : Индекс или массив-подобный объект

Метки столбцов для использования в итоговой таблице. Будет по умолчанию равен np.arange(n), если метки столбцов не предоставлены

dtype : dtype, по умолчанию None

Тип данных для принудительного задания, иначе определяется автоматически

copy : boolean, по умолчанию False

Копировать данные из входных данных. Затрагивает только входные данные DataFrame / 2d ndarray

См. также

DataFrame.from_records
Конструктор из кортежей, также массивы записей
DataFrame.from_dict
Из словарей Series, массивов или словарей
DataFrame.from_items
Из последовательности пар (ключ, значение)

pandas.read_csv, pandas.read_table, pandas.read_clipboard

Примеры

>>> d = {'col1': ts1, 'col2': ts2}
>>> df = DataFrame(data=d, index=index)
>>> df2 = DataFrame(np.random.randn(10, 5))
>>> df3 = DataFrame(np.random.randn(10, 5),
...                 columns=['a', 'b', 'c', 'd', 'e'])

Атрибуты

T Транспонировать индекс и столбцы
at Быстрый скалярный доступ по меткам
axes Возвращает список с метками оси строк и оси столбцов в качестве единственных элементов.
blocks Внутреннее свойство, синоним свойства as_blocks()
dtypes Возвращает типы данных в этом объекте.
empty True, если NDFrame полностью пуст [нет элементов], что означает, что любая из осей имеет длину 0.
ftypes Возвращает ftypes (указание на разреженность/плотность и тип данных) в этом объекте.
iat Быстрый скалярный доступ по целочисленной позиции.
iloc Индексация, основанная исключительно на целочисленных позициях, для выбора по позиции.
is_copy
ix Индексатор, в первую очередь, основанный на метках и позициях, с возвратом к целочисленным позициям по умолчанию.
loc Индексатор, основанный исключительно на метках, для выбора по меткам.
ndim Число осей/размерностей массива
shape Возвращает кортеж, представляющий размерность DataFrame.
size количество элементов в NDFrame
style Свойство, возвращающее объект Styler, содержащий методы для построения стилизованного HTML-представления DataFrame.
values Numpy-представление NDFrame

Методы

abs() Возвращает объект с абсолютными значениями – применяется только к объектам, состоящим целиком из числовых данных.
add(other[, axis, level, fill_value]) Сложение DataFrame и other по элементам (бинарная операция add).
add_prefix(prefix) Конкатенация префикса со строкой имён элементов панели.
add_suffix(suffix) Конкатенация суффикса со строкой имён элементов панели.
agg(func[, axis]) Агрегирование с использованием вызываемой функции, строки, словаря или списка строк/вызываемых функций
aggregate(func[, axis]) Агрегирование с использованием вызываемой функции, строки, словаря или списка строк/вызываемых функций
align(other[, join, axis, level, copy, ...]) Выравнивание двух объектов по их осям с
all([axis, bool_only, skipna, level]) Возвращает True, если все элементы по указанной оси имеют значение True
any([axis, bool_only, skipna, level]) Возвращает True, если хотя бы один элемент по указанной оси имеет значение True
append(other[, ignore_index, verify_integrity]) Добавляет строки other в конец этого фрейма, возвращая новый объект.
apply(func[, axis, broadcast, raw, reduce, args]) Применяет функцию по входящей оси DataFrame.
applymap(func) Применяет функцию к DataFrame, которая предназначена для работы с элементами по отдельности, т.е.
as_blocks([copy]) Преобразует фрейм в словарь типа dtype → Типы конструкторов, каждый из которых имеет однородный тип данных.
as_matrix([columns]) Преобразует фрейм в его представление в виде массива NumPy.
asfreq(freq[, method, how, normalize, ...]) Преобразование TimeSeries к заданной частоте.
asof(where[, subset]) Берется последняя строка без каких-либо NaN (или последняя строка без
assign(**kwargs) Назначает новые столбцы DataFrame, возвращая новый объект (копию) со всеми исходными столбцами в дополнение к новым.
astype(dtype[, copy, errors]) Преобразовать объект в заданный тип numpy.dtype
at_time(time[, asof]) Выбор значений в определённое время суток (например,
between_time(start_time, end_time[, ...]) Выбор значений между определёнными временами суток (например, с 9:00 до 9:30 утра).
bfill([axis, inplace, limit, downcast]) Синоним для DataFrame.fillna(method='bfill')
bool() Возвращает булево значение для одного элемента PandasObject.
boxplot([column, by, ax, fontsize, rot, ...]) Построение диаграммы размаха (box plot) из столбца DataFrame, необязательно с группировкой по некоторым столбцам или
clip([lower, upper, axis]) Обрезание значений по входным порогам.
clip_lower(threshold[, axis]) Возвращает копию входных данных с обрезанием значений ниже заданного значения(й).
clip_upper(threshold[, axis]) Возвращает копию входных данных с обрезанием значений выше заданного значения(й).
combine(other, func[, fill_value, overwrite]) Объединение двух DataFrame-объектов, не распространяя NaN-значения, так что если для
combine_first(other) Объединение двух DataFrame-объектов, по умолчанию используя ненулевые значения во фрейме, вызывающем метод.
compound([axis, skipna, level]) Возвращает составной процент значений для указанной оси
consolidate([inplace]) УСТЕРЕЖЕН: consolidate будет внутренней реализацией только.
convert_objects([convert_dates, ...]) Устарело.
copy([deep]) Создаёт копию данных этого объекта.
corr([method, min_periods]) Вычисление парной корреляции столбцов, исключая NA/пустые значения
corrwith(other[, axis, drop]) Вычисление парной корреляции между строками или столбцами двух DataFrame-объектов.
count([axis, level, numeric_only]) Возвращает Series с количеством ненулевых/не-NaN наблюдений по указанной оси.
cov([min_periods]) Вычисление парной ковариации столбцов, исключая NA/пустые значения
cummax([axis, skipna]) Возвращает кумулятивный максимум по указанной оси.
cummin([axis, skipna]) Возвращает кумуляльный минимум по указанной оси.
cumprod([axis, skipna]) Возвращает кумулятивный продукт по указанной оси.
cumsum([axis, skipna]) Возвращает кумулятивную сумму по указанной оси.
describe([percentiles, include, exclude]) Генерирует описательные статистики, которые суммируют центральную тенденцию, дисперсию и форму распределения набора данных, исключая NaN значения.
diff([periods, axis]) Дискретное разностное значение 1-го порядка объекта
div(other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other по элементам (бинарная операция truediv).
divide(other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other по элементам (бинарная операция truediv).
dot(other) Матричное умножение с объектами DataFrame или Series
drop(labels[, axis, level, inplace, errors]) Возвращает новый объект со удаленными метками в указанной оси.
drop_duplicates([subset, keep, inplace]) Возвращает DataFrame с удаленными дублирующимися строками, необязательно только
dropna([axis, how, thresh, subset, inplace]) Возвращает объект с опушенными метками на заданной оси, где поочередно любые
duplicated([subset, keep]) Возвращает булеву серию, обозначающую дублирующие строки, необязательно только
eq(other[, axis, level]) Обёртка для гибких методов сравнения eq
equals(other) Определяет, содержат ли два объекта NDFrame одинаковые элементы.
eval(expr[, inplace]) Вычисляет выражение в контексте вызывающего экземпляра DataFrame.
ewm([com, span, halflife, alpha, ...]) Предоставляет экспоненциально взвешенные функции
expanding([min_periods, freq, center, axis]) Предоставляет расширяющие преобразования.
ffill([axis, inplace, limit, downcast]) Синоним для DataFrame.fillna(method='ffill')
fillna([value, method, axis, inplace, ...]) Заполнить значения NA/NaN с помощью указанного метода
filter([items, like, regex, axis]) Подмножество строк или столбцов DataFrame в соответствии с метками в указанном индексе.
first(offset) Удобный метод для подмножества начальных периодов временных рядов данных на основе временного сдвига.
first_valid_index() Возвращает метку для первого ненулевого значения
floordiv(other[, axis, level, fill_value]) Целочисленное деление DataFrame и other, поэлементно (бинарный оператор floordiv).
from_csv(path[, header, sep, index_col, ...]) Чтение CSV-файла (НЕ РЕКОМЕНДУЕТСЯ, используйте pandas.read_csv() вместо этого).
from_dict(data[, orient, dtype]) Построение DataFrame из словаря массивоподобных объектов или словарей
from_items(items[, columns, orient]) Преобразование пар (ключ, значение) в DataFrame.
from_records(data[, index, exclude, ...]) Преобразование структурированного или записывающего ndarray в DataFrame
ge(other[, axis, level]) Обёртка для гибких методов сравнения ge
get(key[, default]) Получение элемента из объекта для данного ключа (столбец DataFrame, срез Panel и т. д.).
get_dtype_counts() Возвращает количество типов данных в этом объекте.
get_ftype_counts() Возвращает количество типов данных ftypes в этом объекте.
get_value(index, col[, takeable]) Быстрое извлечение единственного значения в переданном столбце и индексе
get_values() То же, что и значения (но обрабатывает преобразования разреженности)
groupby([by, axis, level, as_index, sort, ...]) Группировка серии с помощью отображения (словарь или функция ключа, применение заданной функции к группе, возврат результата как серии) или по серии столбцов.
gt(other[, axis, level]) Обёртка для гибких методов сравнения gt
head([n]) Возвращает первые n строк
hist(data[, column, by, grid, xlabelsize, ...]) Строит гистограмму серии DataFrame с использованием matplotlib/pylab.
idxmax([axis, skipna]) Возвращает индекс первого вхождения максимального значения по запрошенной оси.
idxmin([axis, skipna]) Возвращает индекс первого вхождения минимального значения по запрошенной оси.
info([verbose, buf, max_cols, memory_usage, ...]) Краткий сводный вывод DataFrame.
insert(loc, column, value[, allow_duplicates]) Вставить столбец в DataFrame в указанном месте.
interpolate([method, axis, limit, inplace, ...]) Интерполировать значения по различным методам.
isin(values) Возвращает булеву DataFrame, показывающую, содержится ли каждый элемент в DataFrame в values.
isnull() Возвращает объект той же размерности, являющийся булевым значением, указывающим, являются ли значения нулевыми.
items() Итератор по парам (имя столбца, Series).
iteritems() Итератор по парам (имя столбца, Series).
iterrows() Итерирование по строкам DataFrame как парам (индекс, Series).
itertuples([index, name]) Итерирование по строкам DataFrame как именованных кортежей, со значением индекса как первым элементом кортежа.
join(other[, on, how, lsuffix, rsuffix, sort]) Объединение столбцов с другим DataFrame по индексу или по столбцу ключа.
keys() Получение ‘оси информации’ (см. Индексирование для получения дополнительных сведений)
kurt([axis, skipna, level, numeric_only]) Возвращает несмещённую эксцесс по запрошенной оси с использованием определения эксцесса Фишера (эксцесс нормального == 0.0).
kurtosis([axis, skipna, level, numeric_only]) Возвращает смещённую эксцесс по заданной оси, используя определение эксцесса Фишера (эксцесс нормального распределения == 0,0).
last(offset) Удобный метод для выделения последних периодов временных рядов данных на основе временного смещения.
last_valid_index() Возвращает метку последнего ненулевого значения.
le(other[, axis, level]) Обёртка для гибких методов сравнения le
lookup(row_labels, col_labels) Функция «fancy indexing» на основе меток для DataFrame.
lt(other[, axis, level]) Обёртка для гибких методов сравнения lt
mad([axis, skipna, level]) Возвращает среднее абсолютное отклонение значений для запрошенной оси.
mask(cond[, other, inplace, axis, level, ...]) Возвращает объект той же формы, что и self, значения которого соответствуют self, где cond ложно, а в противном случае — от other.
max([axis, skipna, level, numeric_only]) Этот метод возвращает максимальное значение в объекте.
mean([axis, skipna, level, numeric_only]) Возвращает среднее значение значений для запрошенной оси.
median([axis, skipna, level, numeric_only]) Возвращает медиану значений для запрошенной оси.
melt([id_vars, value_vars, var_name, ...]) «Преобразует» DataFrame из широкого формата в длинный формат, необязательно.
memory_usage([index, deep]) Использование памяти столбцами DataFrame.
merge(right[, how, on, left_on, right_on, ...]) Объединение объектов DataFrame путём выполнения операции присоединения в стиле базы данных по столбцам или индексам.
min([axis, skipna, level, numeric_only]) Этот метод возвращает минимальное значение в объекте.
mod(other[, axis, level, fill_value]) Остаток от деления dataframe и other, поэлементный (бинарный оператор mod).
mode([axis, numeric_only]) Получает моду (или модули) каждого элемента вдоль выбранной оси.
mul(other[, axis, level, fill_value]) Умножение dataframe и other, поэлементное (бинарный оператор mul).
multiply(other[, axis, level, fill_value]) Умножение dataframe и other, поэлементное (бинарный оператор mul).
ne(other[, axis, level]) Обёртка для гибких методов сравнения ne
nlargest(n, columns[, keep]) Получить строки DataFrame, отсортированные по n наибольшим значениям columns.
notnull() Возвращает булевый объект той же размерности, указывающий, являются ли значения не нулевыми.
nsmallest(n, columns[, keep]) Получить строки DataFrame, отсортированные по n наименьшим значениям columns.
nunique([axis, dropna]) Возвращает Series с количеством уникальных наблюдений по запрошенной оси.
pct_change([periods, fill_method, limit, freq]) Процентное изменение за заданное число периодов.
pipe(func, *args, **kwargs) Применить func(self, *args, **kwargs)
pivot([index, columns, values]) Изменение структуры данных (создание таблицы «с поворотом») на основе значений столбцов.
pivot_table(data[, values, index, columns, ...]) Создаёт таблицу сводной информации в стиле электронных таблиц в виде DataFrame.
plot Псевдоним FramePlotMethods
pop(item) Возвращает item и удаляет из фрейма.
pow(other[, axis, level, fill_value]) Возведение в степень dataframe и other, поэлементное (бинарный оператор pow).
prod([axis, skipna, level, numeric_only]) Возвращает произведение значений по запрошенной оси.
product([axis, skipna, level, numeric_only]) Возвращает произведение значений по запрошенной оси.
quantile([q, axis, numeric_only, interpolation]) Возвращает значения в заданном квантиле по запрошенной оси, подобно numpy.percentile.
query(expr[, inplace]) Запрос к столбцам фрейма с помощью булевого выражения.
radd(other[, axis, level, fill_value]) Сложение dataframe и other, поэлементное (бинарный оператор radd).
rank([axis, method, numeric_only, ...]) Вычисляет ранги числовых данных (от 1 до n) вдоль оси.
rdiv(other[, axis, level, fill_value]) Деление с плавающей точкой dataframe и other, поэлементное (бинарный оператор rtruediv).
reindex([index, columns]) Соответствие DataFrame новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, где нет значения в предыдущем индексе.
reindex_axis(labels[, axis, method, level, ...]) Соответствие входного объекта новому индексу с необязательной логикой заполнения, размещая NA/NaN в местах, где нет значения в предыдущем индексе.
reindex_like(other[, method, copy, limit, ...]) Возвращает объект с соответствующими индексами самому себе.
rename([index, columns]) Изменение осей входной функцией или функциями.
rename_axis(mapper[, axis, copy, inplace]) Изменение индекса и/или столбцов с помощью входной функции или функций.
reorder_levels(order[, axis]) Переупорядочить уровни индекса с использованием входного порядка.
replace([to_replace, value, inplace, limit, ...]) Заменить значения, указанные в ‘to_replace’, на ‘value’.
resample(rule[, how, axis, fill_method, ...]) Удобный метод для преобразования частоты и ресемплирования временных рядов.
reset_index([level, drop, inplace, ...]) Для DataFrame с многоуровневым индексом возвращает новый DataFrame с информацией о метках в столбцах под именами индексов, по умолчанию ‘level_0’, ‘level_1’ и т. д.
rfloordiv(other[, axis, level, fill_value]) Целочисленное деление DataFrame и other по элементам (бинарная операция rfloordiv).
rmod(other[, axis, level, fill_value]) Остаток от деления DataFrame и other по элементам (бинарная операция rmod).
rmul(other[, axis, level, fill_value]) Умножение DataFrame и other по элементам (бинарная операция rmul).
rolling(window[, min_periods, freq, center, ...]) Предоставляет вычисления с применением скользящего окна.
round([decimals]) Округляет DataFrame до заданного количества десятичных знаков.
rpow(other[, axis, level, fill_value]) Возведение в степень DataFrame и other по элементам (бинарная операция rpow).
rsub(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарная операция rsub).
rtruediv(other[, axis, level, fill_value]) Деление с плавающей точкой DataFrame и other по элементам (бинарная операция rtruediv).
sample([n, frac, replace, weights, ...]) Возвращает случайную выборку элементов из оси объекта.
select(crit[, axis]) Возвращает данные, соответствующие меткам оси, соответствующим критериям.
select_dtypes([include, exclude]) Возвращает подмножество DataFrame, включающее/исключающее столбцы на основе их dtype.
sem([axis, skipna, level, ddof, numeric_only]) Возвращает смещённую стандартную ошибку среднего по запрошенной оси.
set_axis(axis, labels) Общедоступная версия присваивания оси.
set_index(keys[, drop, append, inplace, ...]) Устанавливает индекс DataFrame (метки строк) с использованием одного или нескольких существующих столбцов.
set_value(index, col, value[, takeable]) Поместить единственное значение в указанный столбец и индекс.
shift([periods, freq, axis]) Смещение индекса на нужное количество периодов с необязательной временной частотой.
skew([axis, skipna, level, numeric_only]) Возвращает смещённое значение асимметрии по запрошенной оси.
slice_shift([periods, axis]) Эквивалентно shift без копирования данных.
sort_index([axis, level, ascending, ...]) Сортировка объекта по меткам (по оси).
sort_values(by[, axis, ascending, inplace, ...]) Сортировка по значениям вдоль оси.
sortlevel([level, axis, ascending, inplace, ...]) УСТЕРЕЖДЕН: используйте DataFrame.sort_index()
squeeze([axis]) Сжатие размерностей длиной 1.
stack([level, dropna]) Поворот уровня (возможно иерархических) меток столбцов, возвращая DataFrame (или Series в случае объекта с одним уровнем меток столбцов), имеющий иерархический индекс с новым внутренним уровнем меток строк.
std([axis, skipna, level, ddof, numeric_only]) Возвращает выборочное стандартное отклонение по запрошенной оси.
sub(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарная операция sub).
subtract(other[, axis, level, fill_value]) Вычитание DataFrame и other по элементам (бинарная операция sub).
sum([axis, skipna, level, numeric_only]) Возвращает сумму значений по запрошенной оси.
swapaxes(axis1, axis2[, copy]) Меняет местами оси и соответствующим образом меняет местами значения осей.
swaplevel([i, j, axis]) Меняет местами уровни i и j в MultiIndex на конкретной оси.
tail([n]) Возвращает последние n строк.
take(indices[, axis, convert, is_copy]) Аналогично ndarray.take
to_clipboard([excel, sep]) Попытка записи текстового представления объекта в буфер обмена системы. Это можно вставить в Excel, например.
to_csv([path_or_buf, sep, na_rep, ...]) Запись DataFrame в файл с разделителем запятых (csv).
to_dense() Возвращает плотное представление NDFrame (в отличие от разреженного).
to_dict([orient]) Преобразовать DataFrame в словарь.
to_excel(excel_writer[, sheet_name, na_rep, ...]) Запись DataFrame в лист Excel.
to_feather(fname) Запись двоичного формата feather для DataFrames.
to_gbq(destination_table, project_id[, ...]) Запись DataFrame в таблицу Google BigQuery.
END_OF_DOCUMENT_MARKER
to_hdf(path_or_buf, key, **kwargs) Запись содержащихся данных в файл HDF5 с использованием HDFStore.
to_html([buf, columns, col_space, header, ...]) Отображение DataFrame в виде HTML-таблицы.
to_json([path_or_buf, orient, date_format, ...]) Преобразование объекта в строку JSON.
to_latex([buf, columns, col_space, header, ...]) Отображение объекта в таблицу среды LaTeX.
to_msgpack([path_or_buf, encoding]) Объект msgpack (сериализация) в указанный файл.
to_panel() Преобразование длинного (стекового) формата (DataFrame) в широкий (3D, Panel) формат.
to_period([freq, axis, copy]) Преобразование DataFrame из DatetimeIndex в PeriodIndex с нужным
to_pickle(path[, compression]) Сериализация объекта pickle в указанный файл.
to_records([index, convert_datetime64]) Преобразование DataFrame в массив записей.
to_sparse([fill_value, kind]) Преобразовать в SparseDataFrame
to_sql(name, con[, flavor, schema, ...]) Запись записей, хранящихся в DataFrame, в базу данных SQL.
to_stata(fname[, convert_dates, ...]) Класс для записи двоичных файлов Stata dta из объектов типа массив.
to_string([buf, columns, col_space, header, ...]) Отображение DataFrame в удобном для консоли табличном выводе.
to_timestamp([freq, how, axis, copy]) Преобразование к DatetimeIndex временных меток, в начале периода.
to_xarray() Возвращает объект xarray из объекта pandas.
transform(func, *args, **kwargs) Вызов функции, создающей NDFrame с аналогичными индексами.
transpose(*args, **kwargs) Транспонирование индекса и столбцов.
truediv(other[, axis, level, fill_value]) Деление с плавающей запятой DataFrame и other, поэлементно (бинарная операция truediv).
truncate([before, after, axis, copy]) Обрезает отсортированный NDFrame до и/или после определенного значения индекса.
tshift([periods, freq, axis]) Смещение временного индекса, используя частоту индекса, если она доступна.
tz_convert(tz[, axis, level, copy]) Преобразование оси с учетом часовых поясов в целевой часовой пояс.
tz_localize(tz[, axis, level, copy, ambiguous]) Локализация временных рядов без учета часового пояса в целевой часовой пояс.
unstack([level, fill_value]) Поворот уровня меток индекса (обязательно иерархического), возвращает DataFrame с новым уровнем меток столбцов, внутренний уровень которых состоит из повернутых меток индекса.
update(other[, join, overwrite, ...]) Изменение DataFrame на месте с использованием значений без пропусков из переданного DataFrame.
var([axis, skipna, level, ddof, numeric_only]) Возвращает смещенную дисперсию по запрошенной оси.
where(cond[, other, inplace, axis, level, ...]) Возвращает объект с такой же формой, как и self, у которого соответствующие элементы взяты из self, если cond имеет значение True, и в противном случае - из other.
xs(key[, axis, level, drop_level]) Возвращает поперечный срез (строка(и) или столбец(ы)) из Series/DataFrame.

© 2008–2012, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/0.20.3/generated/pandas.DataFrame.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API