Spec-Zone.ru › NumPy 1.18

numpy.chararray

class numpy.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None) [source]

Предоставляет удобный вид на массивы строковых и уникодовых значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, он не рекомендуется для новых разработок. Начиная с numpy 1.4, если необходимы массивы строк, рекомендуется использовать массивы типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

В отличие от обычного массива NumPy типа str или unicode, этот класс добавляет следующие возможности:

  1. значения автоматически удаляют пробелы в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются как методы (например, endswith) и инфиксные операторы (например, "+", "*", "%")

chararrays следует создавать с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если он не None. Если buffer равно None, то создаётся новый массив с strides в порядке «C», если оба len(shape) >= 2 и order='F', в этом случае strides в порядке «Fortran».

Параметры
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodebool, optional

Являются ли элементы массива уникодовыми (True) или строковыми (False). По умолчанию False.

bufferint, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetint, optional

Фиксированное смещение шага от начала оси? По умолчанию 0. Должно быть >=0.

stridesarray_like of ints, optional

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> порядок «строка» (по умолчанию), ‘F’ -> порядок «столбец» (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Атрибуты
T

Транспонированный массив.

base

Объект базового уровня, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект буфера Python, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор 1-D по массиву.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, используемых элементами массива.

ndim

Число измерений массива.

real

Вещественная часть массива.

shape

Кортеж измерений массива.

size

Количество элементов в массиве.

strides

Кортеж байтов для шага по каждому измерению при обходе массива.

Методы

END_OF_DOCUMENT_MARKER

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые отсортируют этот массив.

copy([order])

Возвращает копию массива.

count(self, sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode(self[, encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Сохраняет пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode(self[, encoding, errors])

Вызывает str.encode поэлементно.

endswith(self, suffix[, start, end])

Возвращает булевый массив, который равен True, если строковый элемент в self оканчивается на suffix, в противном случае False.

expandtabs(self[, tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменяются одним или несколькими пробелами.

fill(value)

Заполняет массив скалярным значением.

find(self, sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает копию массива, сжатого в одну размерность.

getfield(dtype[, offset])

Возвращает поле данного массива как определенного типа.

index(self, sub[, start, end])

Как find, но вызывает исключение ValueError при отсутствии подстроки.

isalnum(self)

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми, и есть хотя бы один символ, в противном случае False.

isalpha(self)

Возвращает True для каждого элемента, если все символы в строке являются буквенными, и есть хотя бы один символ, в противном случае False.

isdecimal(self)

Для каждого элемента в self, возвращает True, если в элементе есть только символы десятичных разрядов.

isdigit(self)

Возвращает True для каждого элемента, если все символы в строке являются цифрами, и есть хотя бы один символ, в противном случае False.

islower(self)

Возвращает True для каждого элемента, если все символы в строке в нижнем регистре, и есть хотя бы один символ, в противном случае False.

isnumeric(self)

Для каждого элемента в self, возвращает True, если в элементе есть только числовые символы.

isspace(self)

Возвращает True для каждого элемента, если в строке есть только пробельные символы и есть хотя бы один символ, в противном случае False.

istitle(self)

Возвращает True для каждого элемента, если элемент является заглавленной строкой и есть хотя бы один символ, в противном случае False.

isupper(self)

Возвращает True для каждого элемента, если все символы в строке в верхнем регистре, и есть хотя бы один символ, в противном случае False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(self, seq)

Возвращает строку, которая является конкатенацией строк в последовательности seq.

ljust(self, width[, fillchar])

Возвращает массив с элементами self выровненными слева в строке длиной width.

lower(self)

Возвращает массив с элементами self, преобразованными в нижний регистр.

lstrip(self[, chars])

Для каждого элемента в self, возвращает копию со снятыми начальными символами.

nonzero()

Возвращает индексы элементов, отличных от нуля.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в индексах.

ravel([order])

Возвращает сглаженный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(self, old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old замененными на new.

reshape(shape[, order])

Возвращает массив, содержащий те же данные с новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(self, sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где подстрока sub найдена, так что sub содержится в [start, end].

rindex(self, sub[, start, end])

Как rfind, но вызывает исключение ValueError при отсутствии подстроки sub.

rjust(self, width[, fillchar])

Возвращает массив с элементами self выровненными по правому краю в строке длиной width.

rsplit(self[, sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip(self[, chars])

Для каждого элемента в self, возвращает копию со удаленными символами в конце.

searchsorted(v[, side, sorter])

Находит индексы, где элементы v должны быть вставлены в a для поддержания порядка.

setfield(val, dtype[, offset])

Поместить значение в указанное место в поле, определённом типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY) соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split(self[, sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines(self[, keepends])

Для каждого элемента в self, возвращает список строк в элементе, разбивая по границам строк.

squeeze([axis])

Удаляет одноразмерные записи из формы a.

startswith(self, prefix[, start, end])

Возвращает булевый массив, который равен True если строковый элемент в self начинается с prefix, иначе False.

strip(self[, chars])

Для каждого элемента в self, возвращает копию со удаленными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает представление массива с axis1 и axis2 поменявшимися местами.

swapcase(self)

Для каждого элемента в self, возвращает копию строки с прописными символами, преобразованными в строчные, и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, сформированный из элементов a по заданным индексам.

title(self)

Для каждого элемента в self, возвращает строку в стиле заголовка: слова начинаются с заглавных букв, а все остальные символы строчные.

tofile(fid[, sep, format])

Записать массив в файл в виде текста или двоичных данных (по умолчанию).

tolist()

Возвращает массив как вложенный список Python с глубиной a.ndim уровней.

tostring([order])

Создаёт строку Python, содержащую байты исходных данных в массиве.

translate(self, table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, встречающиеся в необязательном аргументе deletechars, удаляются, а оставшиеся символы отображаются с помощью заданной таблицы преобразования.

transpose(*axes)

Возвращает представление массива с переставленными осями.

upper(self)

Возвращает массив с элементами self преобразованными в верхний регистр.

view([dtype, type])

Новое представление массива с теми же данными.

zfill(self, width)

Возвращает числовую строку, дополненную слева нулями до длины width.

© 2005–2020 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.18/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API