pandas.arrays.SparseArray
- classpandas.arrays.SparseArray(data, sparse_index=None, index=None, fill_value=None, kind='integer', dtype=None, copy=False)[source]
-
Расширяемый массив для хранения разреженных данных.
- Параметры
-
- data:подобный массиву или скаляр
-
Массив плотных значений для хранения в SparseArray. Может содержать fill_value.
- sparse_index:SparseIndex, необязательно
- index:Индекс
-
Устарело начиная с версии 1.4.0: Используйте функцию, подобную np.full, для построения массива с необходимыми повторениями скалярного значения вместо этого.
- fill_value:скаляр, необязательно
-
Элементы в data, которые
fill_valueне хранятся в SparseArray. Для экономии памяти это должно быть наиболее частое значение в data. По умолчанию fill_value зависит от типа данных data:data.dtype
на_значение
float
np.nanint
0bool
False
datetime64
pd.NaTtimedelta64
pd.NaTЗначение заполнения может быть указано тремя способами. В порядке приоритета:
Аргумент fill_value
dtype.fill_valueесли fill_value равно None, а dtype —SparseDtypedata.dtype.fill_valueесли fill_value равно None, а dtype не являетсяSparseDtypeи data являетсяSparseArray.
- kind:строка
-
Может быть ‘integer’ или ‘block’, по умолчанию — ‘integer’. Тип хранения для разреженных местоположений.
‘block’: хранит block и block_length для каждого смежного промежутка разреженных значений. Это лучше всего подходит, когда разреженные данные имеют тенденцию группироваться, с большими областями
fill-valueзначений между разреженными значениями.‘integer’: использует целое число для хранения местоположения каждого разреженного значения.
- dtype:np.dtype или SparseDtype, необязательно
-
Тип данных для использования в SparseArray. Для типов данных numpy это определяет тип данных
self.sp_values. Для SparseDtype это определяетself.sp_valuesиself.fill_value. - copy:bool, по умолчанию False
-
Определяет, нужно ли явно скопировать входящий массив data.
Примеры
>>> from pandas.arrays import SparseArray >>> arr = SparseArray([0, 0, 1, 2]) >>> arr [0, 0, 1, 2] Fill: 0 IntIndex Indices: array([2, 3], dtype=int32)
Атрибуты
None
Методы
None
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/1.5.0/reference/api/pandas.arrays.SparseArray.html