numpy.char.chararray
- classnumpy.char.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)[source]
-
Предоставляет удобный вид на массивы строковых и универсальных значений.
Примечание
Класс
chararrayсуществует для обеспечения обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если нужны массивы строк, рекомендуется использовать массивыdtypeobject_,bytes_илиstr_и использовать свободные функции в модулеnumpy.charдля быстрых векторизованных строковых операций.По сравнению с массивом NumPy типа
bytes_илиstr_, этот класс добавляет следующие возможности:- Значения автоматически лишаются завершающих пробелов при индексировании.
- Операторы сравнения автоматически удаляют завершающие пробелы при сравнении значений.
- Векторизованные строковые операции предоставляются в виде методов (например,
endswith) и инфиксных операторов (например,"+", "*", "%").
chararrays должны создаваться с помощью
numpy.char.arrayилиnumpy.char.asarray, а не напрямую с помощью этого конструктора.Этот конструктор создаёт массив, используя
buffer(сoffsetиstrides) если это неNone. ЕслиbufferравноNone, то создаёт новый массив сstridesв порядке “C”, если не заданы обаlen(shape) >= 2иorder='F', в этом случаеstridesнаходится в порядке “Fortran”.- Параметры:
-
- shapeкортеж
-
Форма массива.
- itemsizeцелое число, необязательно
-
Длина каждого элемента массива в количестве символов. По умолчанию 1.
- unicodeбулево, необязательно
-
Являются ли элементы массива типа unicode (True) или строки (False). По умолчанию False.
- bufferобъект, экспонирующий интерфейс буфера или str, необязательно
-
Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.
- offsetцелое число, необязательно
-
Фиксированное смещение шага с начала оси? По умолчанию 0. Должно быть >=0.
- stridesмассив-подобный массив целых чисел, необязательно
-
Шаги для массива (см.
stridesдля полного описания). По умолчанию None. - order{‘C’, ‘F’}, необязательно
-
Порядок хранения данных массива в памяти: ‘C’ -> “строчный” порядок (по умолчанию), ‘F’ -> “столбцовый” (Fortran) порядок.
Примеры
>>> charar = np.char.chararray((3, 3)) >>> charar[:] = 'a' >>> charar chararray([[b'a', b'a', b'a'], [b'a', b'a', b'a'], [b'a', b'a', b'a']], dtype='|S1')>>> charar = np.char.chararray(charar.shape, itemsize=5) >>> charar[:] = 'abc' >>> charar chararray([[b'abc', b'abc', b'abc'], [b'abc', b'abc', b'abc'], [b'abc', b'abc', b'abc']], dtype='|S5')- Атрибуты:
-
T-
Вид транспонированного массива.
base-
Базовый объект, если память взята из другого объекта.
ctypes-
Объект для упрощения взаимодействия массива с модулем ctypes.
data-
Объект буфера Python, указывающий на начало данных массива.
- device
dtype-
Тип данных элементов массива.
flags-
Информация о структуре памяти массива.
flat-
Итератор по массиву в одномерном виде.
imag-
Мнимая часть массива.
- itemset
itemsize-
Длина одного элемента массива в байтах.
mT-
Вид транспонированного массива матрицы.
nbytes-
Общее количество байтов, занимаемых элементами массива.
ndim-
Количество измерений массива.
- newbyteorder
- ptp
real-
Вещественная часть массива.
shape-
Кортеж измерений массива.
size-
Количество элементов в массиве.
strides-
Кортеж байтов для шага по каждому измерению при обходе массива.
Методы
astype(dtype[, order, casting, subok, copy])Копия массива, преобразованная к указанному типу.
argsort([axis, kind, order])Возвращает индексы, которые отсортируют этот массив.
copy([order])Возвращает копию массива.
count(sub[, start, end])Возвращает массив с количеством неперекрывающихся вхождений подстроки
subв диапазоне [start,end].decode([encoding, errors])Вызывает
bytes.decodeпоэлементно.dump(file)Сохраняет пикл массива в указанный файл.
dumps()Возвращает пикл массива в виде строки.
encode([encoding, errors])Вызывает
str.encodeпоэлементно.endswith(suffix[, start, end])Возвращает булевый массив, который равен
True, если строковый элемент вselfзаканчивается наsuffix, иначеFalse.expandtabs([tabsize])Возвращает копию каждого строкового элемента, где все символы табуляции заменены на один или несколько пробелов.
fill(value)Заполняет массив скалярным значением.
find(sub[, start, end])Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока
sub.flatten([order])Возвращает плоский массив (копию).
getfield(dtype[, offset])Возвращает поле данного массива как определенный тип.
index(sub[, start, end])Как
find, но вызываетValueError, если подстрока не найдена.isalnum()Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть как минимум один символ, иначе False.
isalpha()Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть как минимум один символ, иначе False.
Для каждого элемента в
self, возвращает True, если в элементе есть только десятичные символы.isdigit()Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть как минимум один символ, иначе False.
islower()Возвращает True для каждого элемента, если все символы в строке в нижнем регистре и есть как минимум один символ в нижнем регистре, иначе False.
Для каждого элемента в
self, возвращает True, если в элементе есть только числовые символы.isspace()Возвращает True для каждого элемента, если в строке есть только символы пробелов и есть как минимум один символ, иначе False.
istitle()Возвращает True для каждого элемента, если элемент является строкой в стиле заголовка и есть как минимум один символ, иначе False.
isupper()Возвращает True для каждого элемента, если все символы в строке в верхнем регистре и есть как минимум один символ, иначе False.
item(*args)Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq)Возвращает строку, являющуюся конкатенацией строк в последовательности
seq.ljust(width[, fillchar])Возвращает массив с элементами
selfвыровненными влево в строке длинойwidth.lower()Возвращает массив с элементами
selfпреобразованными в нижний регистр.lstrip([chars])Для каждого элемента в
self, возвращает копию со удаленными начальными символами.nonzero()Возвращает индексы элементов, которые отличны от нуля.
put(indices, values[, mode])Устанавливает
a.flat[n] = values[n]для всехnв indices.ravel([order])Возвращает сплющенный массив.
repeat(repeats[, axis])Повторяет элементы массива.
replace(old, new[, count])Для каждого элемента в
self, возвращает копию строки со всеми вхождениями подстрокиoldзаменёнными наnew.reshape(shape, /, *[, order])Возвращает массив с теми же данными, но новой формой.
resize(new_shape[, refcheck])Изменяет форму и размер массива на месте.
rfind(sub[, start, end])Для каждого элемента в
self, возвращает наибольший индекс в строке, где подстрокаsubнайдена, так чтоsubсодержится в [start,end].
rindex(sub[, start, end])Как
rfind, но вызываетValueError, если подстрокаsubне найдена.rjust(width[, fillchar])Возвращает массив с элементами
self, выровненными вправо в строке длинойwidth.rsplit([sep, maxsplit])Для каждого элемента в
self, возвращает список слов в строке, используяsepв качестве разделителя.rstrip([chars])Для каждого элемента в
self, возвращает копию со удаленными заключительным символами.searchsorted(v[, side, sorter])Находит индексы, куда элементы v должны быть вставлены в a для сохранения порядка.
setfield(val, dtype[, offset])Поместить значение в указанное место в поле, определенное типом данных.
setflags([write, align, uic])Устанавливает флаги массива WRITEABLE, ALIGNED, WRITEBACKIFCOPY соответственно.
sort([axis, kind, order])Сортировать массив на месте.
split([sep, maxsplit])Для каждого элемента в
self, возвращает список слов в строке, используяsepв качестве разделителя.splitlines([keepends])Для каждого элемента в
self, возвращает список строк в элементе, разбивая по границам строк.squeeze([axis])Удалить оси длиной один из
a.startswith(prefix[, start, end])Возвращает булевый массив, который
Trueкогда строковый элемент вselfначинается сprefix, иначеFalse.strip([chars])Для каждого элемента в
self, возвращает копию со удаленными начальными и заключительным символами.swapaxes(axis1, axis2)Возвращает представление массива с
axis1иaxis2поменяны местами.swapcase()Для каждого элемента в
self, возвращает копию строки с заглавными буквами, преобразованными в строчные и наоборот.take(indices[, axis, out, mode])Возвращает массив, сформированный из элементов
aпо заданным индексам.title()Для каждого элемента в
self, возвращает заглавленную версию строки: слова начинаются с заглавной буквы, остальные символы преобразуются в строчные.tofile(fid[, sep, format])Записать массив в файл как текст или двоичный (по умолчанию).
tolist()Возвращает массив как вложенный список Python-скаляров глубиной
a.ndim.tostring([order])Алиас совместимости для
tobytes, с абсолютно таким же поведением.translate(table[, deletechars])Для каждого элемента в
self, возвращает копию строки, где все символы, присутствующие в необязательном аргументеdeletecharsудаляются, а оставшиеся символы отображаются через заданную таблицу преобразования.transpose(*axes)Возвращает представление массива с переставленными осями.
upper()Возвращает массив с элементами
self, преобразованными в верхний регистр.view([dtype][, type])Новое представление массива с теми же данными.
zfill(width)Возвращает числовую строку, заполненную нулями слева в строке длиной
width.
© 2005–2024 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/2.0/reference/generated/numpy.char.chararray.html