numpy.chararray
-
class numpy.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)[source] -
Предоставляет удобный вид на массивы значений строк и юникода.
Примечание
Класс
chararrayсуществует для обратной совместимости с Numarray, он не рекомендуется для нового развития. Начиная с numpy 1.4, если вам нужны массивы строк, рекомендуется использовать массивыdtypeobject_,string_илиunicode_и использовать свободные функции в модулеnumpy.charдля быстрых векторизованных операций со строками.По сравнению с обычным массивом NumPy типа
strилиunicode, этот класс добавляет следующие возможности:- значения автоматически очищаются от пробелов в конце при индексировании
- операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
- векторизованные операции со строками предоставляются в виде методов (например,
endswith) и инфиксных операторов (например,"+", "*", "%")
chararrays должны создаваться с помощью
numpy.char.arrayилиnumpy.char.asarray, а не напрямую с помощью этого конструктора.Этот конструктор создаёт массив, используя
buffer(сoffsetиstrides), если это неNone. ЕслиbufferявляетсяNone, то создаётся новый массив сstridesв порядке «C», если не обаlen(shape) >= 2иorder='F', в этом случаеstridesнаходится в порядке «Fortran».- Параметры
-
-
shapetuple -
Форма массива.
-
itemsizeint, optional -
Длина каждого элемента массива в количестве символов. По умолчанию равно 1.
-
unicodebool, optional -
Являются ли элементы массива типа unicode (True) или строка (False). По умолчанию False.
-
bufferobject exposing the buffer interface or str, optional -
Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.
-
offsetint, optional -
Фиксированное смещение шага от начала оси? По умолчанию 0. Должно быть >=0.
-
stridesarray_like of ints, optional -
Шаги для массива (см.
ndarray.stridesдля полного описания). По умолчанию None. -
order{‘C’, ‘F’}, optional -
Порядок хранения данных массива в памяти: ‘C’ -> порядок «строка-главный» (по умолчанию), ‘F’ -> порядок «столбец-главный» (Fortran).
-
Примеры
>>> charar = np.chararray((3, 3)) >>> charar[:] = 'a' >>> charar chararray([[b'a', b'a', b'a'], [b'a', b'a', b'a'], [b'a', b'a', b'a']], dtype='|S1')>>> charar = np.chararray(charar.shape, itemsize=5) >>> charar[:] = 'abc' >>> charar chararray([[b'abc', b'abc', b'abc'], [b'abc', b'abc', b'abc'], [b'abc', b'abc', b'abc']], dtype='|S5')- Атрибуты
-
-
T -
Транспонированный массив.
-
base -
Базовый объект, если память взята из другого объекта.
-
ctypes -
Объект для упрощения взаимодействия массива с модулем ctypes.
-
data -
Объект буфера Python, указывающий на начало данных массива.
-
dtype -
Тип данных элементов массива.
-
flags -
Информация о расположении памяти массива.
-
flat -
Итератор по массиву в 1-D.
-
imag -
Мнимая часть массива.
-
itemsize -
Длина одного элемента массива в байтах.
-
nbytes -
Общее количество байтов, потребляемых элементами массива.
-
ndim -
Количество измерений массива.
-
real -
Вещественная часть массива.
-
shape -
Кортеж измерений массива.
-
size -
Количество элементов в массиве.
-
strides -
Кортеж байтов для шага по каждому измерению при обходе массива.
-
Методы
astype(dtype[, order, casting, subok, copy])Копия массива, преобразованная к указанному типу.
argsort([axis, kind, order])Возвращает индексы, которые отсортируют этот массив.
copy([order])Возвращает копию массива.
count(sub[, start, end])Возвращает массив с количеством неперекрывающихся вхождений подстроки
subв диапазоне [start,end].decode([encoding, errors])Вызывает
str.decodeпоэлементно.dump(file)Сохраняет дамп массива в виде пикла в указанный файл.
dumps()Возвращает пикл массива в виде строки.
encode([encoding, errors])Вызывает
str.encodeпоэлементно.endswith(suffix[, start, end])Возвращает булевый массив, который
Trueесли строковый элемент вselfоканчивается наsuffix, иначеFalse.expandtabs([tabsize])Возвращает копию каждого строкового элемента, где все символы табуляции заменяются одним или несколькими пробелами.
fill(value)Заполняет массив скалярным значением.
find(sub[, start, end])Для каждого элемента возвращает самый низкий индекс в строке, где найдена подстрока
sub.flatten([order])Возвращает скопированный массив, сжатый в одномерный.
getfield(dtype[, offset])Возвращает поле данного массива как определенного типа.
index(sub[, start, end])Как
find, но вызывает исключениеValueErrorкогда подстрока не найдена.isalnum()Возвращает true для каждого элемента, если все символы в строке являются буквенно-цифровыми и присутствует хотя бы один символ, в противном случае false.
isalpha()Возвращает true для каждого элемента, если все символы в строке являются буквенными и присутствует хотя бы один символ, в противном случае false.
Для каждого элемента в
self, возвращает True, если в элементе есть только символы десятичных цифр.isdigit()Возвращает true для каждого элемента, если все символы в строке являются цифрами и присутствует хотя бы один символ, в противном случае false.
islower()Возвращает true для каждого элемента, если все символы с регистром в строке являются строчными и присутствует хотя бы один символ с регистром, в противном случае false.
Для каждого элемента в
self, возвращает True, если в элементе есть только числовые символы.isspace()Возвращает true для каждого элемента, если в строке есть только символы пробелов и присутствует хотя бы один символ, в противном случае false.
istitle()Возвращает true для каждого элемента, если элемент является строкой с заглавной буквы и присутствует хотя бы один символ, в противном случае false.
isupper()Возвращает true для каждого элемента, если все символы с регистром в строке являются заглавными и присутствует хотя бы один символ с регистром, в противном случае false.
item(*args)Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq)Возвращает строку, которая является конкатенацией строк в последовательности
seq.ljust(width[, fillchar])Возвращает массив с элементами
selfвыровненными слева в строке длинойwidth.lower()Возвращает массив с элементами
selfпреобразованными в нижний регистр.lstrip([chars])Для каждого элемента в
self, возвращает копию с удаленными символами в начале.nonzero()Возвращает индексы элементов, отличных от нуля.
put(indices, values[, mode])Устанавливает
a.flat[n] = values[n]для всехnв индексах.ravel([order])Возвращает сглаженный массив.
repeat(repeats[, axis])Повторяет элементы массива.
replace(old, new[, count])Для каждого элемента в
self, возвращает копию строки со всеми вхождениями подстрокиoldзамененными наnew.reshape(shape[, order])Возвращает массив, содержащий те же данные с новой формой.
resize(new_shape[, refcheck])Изменяет форму и размер массива на месте.
rfind(sub[, start, end])Для каждого элемента в
self, возвращает наибольший индекс в строке, где найдена подстрокаsub, при этомsubсодержится в [start,end].rindex(sub[, start, end])Как
rfind, но вызывает исключениеValueErrorкогда подстрокаsubне найдена.rjust(width[, fillchar])Возвращает массив с элементами
selfвыровненными справа в строке длинойwidth.
rsplit([sep, maxsplit])Для каждого элемента в
self, возвращает список слов в строке, используяsepв качестве разделителя.rstrip([chars])Для каждого элемента в
self, возвращает копию с удаленными символами в конце.searchsorted(v[, side, sorter])Находит индексы, куда элементы v нужно вставить в a для сохранения порядка.
setfield(val, dtype[, offset])Помещает значение в указанное место в поле, определенное типом данных.
setflags([write, align, uic])Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY) соответственно.
sort([axis, kind, order])Сортирует массив на месте.
split([sep, maxsplit])Для каждого элемента в
self, возвращает список слов в строке, используяsepв качестве разделителя.splitlines([keepends])Для каждого элемента в
self, возвращает список строк в элементе, разделяя на границы строк.squeeze([axis])Удаляет оси длины один из
a.startswith(prefix[, start, end])Возвращает булевый массив, который равен
Trueкогда элемент строки вselfначинается сprefix, иначеFalse.strip([chars])Для каждого элемента в
self, возвращает копию с удаленными начальными и конечными символами.swapaxes(axis1, axis2)Возвращает представление массива с
axis1иaxis2поменяными местами.swapcase()Для каждого элемента в
self, возвращает копию строки, где заглавные символы заменены на строчные и наоборот.take(indices[, axis, out, mode])Возвращает массив, образованный из элементов
aпо заданным индексам.title()Для каждого элемента в
self, возвращает версию строки с заглавными буквами в начале слов: слова начинаются с заглавных букв, все остальные символы в нижнем регистре.tofile(fid[, sep, format])Записывает массив в файл как текст или двоичный (по умолчанию).
tolist()Возвращает массив как вложенный список Python с
a.ndimуровнями вложенности скаляров.tostring([order])Псевдоним совместимости для
tobytesс абсолютно идентичным поведением.translate(table[, deletechars])Для каждого элемента в
self, возвращает копию строки, где все символы, присутствующие в необязательном аргументеdeletecharsудаляются, а оставшиеся символы отображаются через предоставленную таблицу преобразований.transpose(*axes)Возвращает представление массива с переставленными осями.
upper()Возвращает массив с элементами
selfв верхнем регистре.view([dtype][, type])Новое представление массива с теми же данными.
zfill(width)Возвращает числовую строку, заполненную слева нулями в строке длины
width.
© 2005–2021 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.20/reference/generated/numpy.chararray.html