Spec-Zone.ru › NumPy 1.20

numpy.chararray

class numpy.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None) [source]

Предоставляет удобный вид на массивы значений строк и юникода.

Примечание

Класс chararray существует для обратной совместимости с Numarray, он не рекомендуется для нового развития. Начиная с numpy 1.4, если вам нужны массивы строк, рекомендуется использовать массивы dtype object_, string_ или unicode_ и использовать свободные функции в модуле numpy.char для быстрых векторизованных операций со строками.

По сравнению с обычным массивом NumPy типа str или unicode, этот класс добавляет следующие возможности:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные операции со строками предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays должны создаваться с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если это не None. Если buffer является None, то создаётся новый массив с strides в порядке «C», если не оба len(shape) >= 2 и order='F', в этом случае strides находится в порядке «Fortran».

Параметры
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию равно 1.

unicodebool, optional

Являются ли элементы массива типа unicode (True) или строка (False). По умолчанию False.

bufferobject exposing the buffer interface or str, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetint, optional

Фиксированное смещение шага от начала оси? По умолчанию 0. Должно быть >=0.

stridesarray_like of ints, optional

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> порядок «строка-главный» (по умолчанию), ‘F’ -> порядок «столбец-главный» (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Атрибуты
T

Транспонированный массив.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект буфера Python, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор по массиву в 1-D.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, потребляемых элементами массива.

ndim

Количество измерений массива.

real

Вещественная часть массива.

shape

Кортеж измерений массива.

size

Количество элементов в массиве.

strides

Кортеж байтов для шага по каждому измерению при обходе массива.

Методы

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые отсортируют этот массив.

copy([order])

Возвращает копию массива.

count(sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode([encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Сохраняет дамп массива в виде пикла в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode([encoding, errors])

Вызывает str.encode поэлементно.

endswith(suffix[, start, end])

Возвращает булевый массив, который True если строковый элемент в self оканчивается на suffix, иначе False.

expandtabs([tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменяются одним или несколькими пробелами.

fill(value)

Заполняет массив скалярным значением.

find(sub[, start, end])

Для каждого элемента возвращает самый низкий индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает скопированный массив, сжатый в одномерный.

getfield(dtype[, offset])

Возвращает поле данного массива как определенного типа.

index(sub[, start, end])

Как find, но вызывает исключение ValueError когда подстрока не найдена.

isalnum()

Возвращает true для каждого элемента, если все символы в строке являются буквенно-цифровыми и присутствует хотя бы один символ, в противном случае false.

isalpha()

Возвращает true для каждого элемента, если все символы в строке являются буквенными и присутствует хотя бы один символ, в противном случае false.

isdecimal()

Для каждого элемента в self, возвращает True, если в элементе есть только символы десятичных цифр.

isdigit()

Возвращает true для каждого элемента, если все символы в строке являются цифрами и присутствует хотя бы один символ, в противном случае false.

islower()

Возвращает true для каждого элемента, если все символы с регистром в строке являются строчными и присутствует хотя бы один символ с регистром, в противном случае false.

isnumeric()

Для каждого элемента в self, возвращает True, если в элементе есть только числовые символы.

isspace()

Возвращает true для каждого элемента, если в строке есть только символы пробелов и присутствует хотя бы один символ, в противном случае false.

istitle()

Возвращает true для каждого элемента, если элемент является строкой с заглавной буквы и присутствует хотя бы один символ, в противном случае false.

isupper()

Возвращает true для каждого элемента, если все символы с регистром в строке являются заглавными и присутствует хотя бы один символ с регистром, в противном случае false.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(seq)

Возвращает строку, которая является конкатенацией строк в последовательности seq.

ljust(width[, fillchar])

Возвращает массив с элементами self выровненными слева в строке длиной width.

lower()

Возвращает массив с элементами self преобразованными в нижний регистр.

lstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными символами в начале.

nonzero()

Возвращает индексы элементов, отличных от нуля.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в индексах.

ravel([order])

Возвращает сглаженный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old замененными на new.

reshape(shape[, order])

Возвращает массив, содержащий те же данные с новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где найдена подстрока sub, при этом sub содержится в [start, end].

rindex(sub[, start, end])

Как rfind, но вызывает исключение ValueError когда подстрока sub не найдена.

rjust(width[, fillchar])

Возвращает массив с элементами self выровненными справа в строке длиной width.

END_OF_DOCUMENT_MARKER

rsplit([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными символами в конце.

searchsorted(v[, side, sorter])

Находит индексы, куда элементы v нужно вставить в a для сохранения порядка.

setfield(val, dtype[, offset])

Помещает значение в указанное место в поле, определенное типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY) соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines([keepends])

Для каждого элемента в self, возвращает список строк в элементе, разделяя на границы строк.

squeeze([axis])

Удаляет оси длины один из a.

startswith(prefix[, start, end])

Возвращает булевый массив, который равен True когда элемент строки в self начинается с prefix, иначе False.

strip([chars])

Для каждого элемента в self, возвращает копию с удаленными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает представление массива с axis1 и axis2 поменяными местами.

swapcase()

Для каждого элемента в self, возвращает копию строки, где заглавные символы заменены на строчные и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, образованный из элементов a по заданным индексам.

title()

Для каждого элемента в self, возвращает версию строки с заглавными буквами в начале слов: слова начинаются с заглавных букв, все остальные символы в нижнем регистре.

tofile(fid[, sep, format])

Записывает массив в файл как текст или двоичный (по умолчанию).

tolist()

Возвращает массив как вложенный список Python с a.ndim уровнями вложенности скаляров.

tostring([order])

Псевдоним совместимости для tobytes с абсолютно идентичным поведением.

translate(table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars удаляются, а оставшиеся символы отображаются через предоставленную таблицу преобразований.

transpose(*axes)

Возвращает представление массива с переставленными осями.

upper()

Возвращает массив с элементами self в верхнем регистре.

view([dtype][, type])

Новое представление массива с теми же данными.

zfill(width)

Возвращает числовую строку, заполненную слева нулями в строке длины width.

© 2005–2021 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.20/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API