Spec-Zone.ru › NumPy 1.19

numpy.chararray

class numpy.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None) [source]

Предоставляет удобный вид на массивы строковых и уникодовых значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если нужны массивы строк, рекомендуется использовать массивы типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с обычным массивом NumPy типа str или unicode, этот класс добавляет следующую функциональность:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays должны создаваться с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если это не None. Если buffer равно None, то создаётся новый массив с strides в порядке «C», если оба len(shape) >= 2 и order='F', в противном случае strides в порядке «Fortran».

Параметры
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodebool, optional

Являются ли элементы массива уникодовыми (True) или строковыми (False). По умолчанию False.

bufferobject exposing the buffer interface or str, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetint, optional

Фиксированный сдвиг от начала оси? По умолчанию 0. Должно быть >=0.

stridesarray_like of ints, optional

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> «строчный» порядок (по умолчанию), ‘F’ -> «столбцовый» (Fortran) порядок.

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Атрибуты
T

Транспонированный массив.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект Python буфера, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор по массиву в виде 1-мерного массива.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, занимаемых элементами массива.

ndim

Количество измерений массива.

real

Вещественная часть массива.

shape

Кортеж размеров массива.

size

Количество элементов в массиве.

strides

Кортеж байтов для шага по каждому измерению при прохождении по массиву.

Методы

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые бы отсортировали этот массив.

copy([order])

Возвращает копию массива.

count(self, sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode(self[, encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Сохраняет пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode(self[, encoding, errors])

Вызывает str.encode поэлементно.

endswith(self, suffix[, start, end])

Возвращает булевый массив, который равен True если строковый элемент в self оканчивается на suffix, иначе False.

expandtabs(self[, tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменены на один или несколько пробелов.

fill(value)

Заполняет массив скалярным значением.

find(self, sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где подстрока sub найдена.

flatten([order])

Возвращает сжатый в один размер копию массива.

getfield(dtype[, offset])

Возвращает поле данного массива как определенного типа.

index(self, sub[, start, end])

Как find, но генерирует исключение ValueError, когда подстрока не найдена.

isalnum(self)

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, иначе False.

isalpha(self)

Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, иначе False.

isdecimal(self)

Для каждого элемента в self, возвращает True, если в элементе только символы десятичных чисел.

isdigit(self)

Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы один символ, иначе False.

islower(self)

Возвращает True для каждого элемента, если все символы с регистром в строке являются строчными и есть хотя бы один символ с регистром, иначе False.

isnumeric(self)

Для каждого элемента в self, возвращает True, если в элементе только числовые символы.

isspace(self)

Возвращает True для каждого элемента, если в строке только символы пробелов и есть хотя бы один символ, иначе False.

istitle(self)

Возвращает True для каждого элемента, если элемент является строкой в формате заголовка и есть хотя бы один символ, иначе False.

isupper(self)

Возвращает True для каждого элемента, если все символы с регистром в строке являются заглавными и есть хотя бы один символ, иначе False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(self, seq)

Возвращает строку, которая является конкатенацией строк в последовательности seq.

ljust(self, width[, fillchar])

Возвращает массив со строковыми элементами self, выровненными по левому краю в строке длиной width.

lower(self)

Возвращает массив со строковыми элементами self, преобразованными к нижнему регистру.

lstrip(self[, chars])

Для каждого элемента в self, возвращает копию с удаленными начальными символами.

nonzero()

Возвращает индексы элементов, которые не равны нулю.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в индексах.

ravel([order])

Возвращает сплющенный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(self, old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.

reshape(shape[, order])

Возвращает массив, содержащий те же данные с новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(self, sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где подстрока sub найдена, так что sub содержится в [start, end].

rindex(self, sub[, start, end])

Как rfind, но генерирует исключение ValueError когда подстрока sub не найдена.

rjust(self, width[, fillchar])

Возвращает массив с элементами self выровненными по правому краю в строке длиной width.

rsplit(self[, sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip(self[, chars])

Для каждого элемента в self, возвращает копию со удалёнными символами с конца.

searchsorted(v[, side, sorter])

Находит индексы, куда элементы v должны быть вставлены в a для сохранения порядка.

setfield(val, dtype[, offset])

Размещает значение в указанном месте поля, определённого типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY), соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split(self[, sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines(self[, keepends])

Для каждого элемента в self, возвращает список строк в элементе, разбивая по границам строк.

squeeze([axis])

Удаляет одноразмерные записи из формы a.

startswith(self, prefix[, start, end])

Возвращает булевый массив, который True если строковый элемент в self начинается с prefix, иначе False.

strip(self[, chars])

Для каждого элемента в self, возвращает копию со удалёнными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает вид массива с axis1 и axis2 переставленными местами.

swapcase(self)

Для каждого элемента в self, возвращает копию строки с заглавными буквами, преобразованными в строчные, и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, сформированный из элементов a по заданным индексам.

title(self)

Для каждого элемента в self, возвращает строку в стиле заголовка: слова начинаются с заглавных букв, все остальные буквенные символы - строчные.

tofile(fid[, sep, format])

Записывает массив в файл как текст или двоичные данные (по умолчанию).

tolist()

Возвращает массив в виде вложенного списка Python до a.ndim уровней вложенности со скалярами.

tostring([order])

Совместимый псевдоним для tobytes с точно таким же поведением.

translate(self, table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars удалены, а оставшиеся символы отображены по таблице преобразования.

transpose(*axes)

Возвращает вид массива с переставленными осями.

upper(self)

Возвращает массив с элементами self преобразованными в верхний регистр.

view([dtype][, type])

Новый вид массива с теми же данными.

zfill(self, width)

Возвращает числовую строку, дополненную слева нулями в строке длиной width.

© 2005–2020 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.19/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API