Spec-Zone.ru › NumPy 1.21

numpy.char.chararray

class numpy.char.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)[source]

Предоставляет удобный вид на массивы значений строк и юникода.

Примечание

Класс chararray существует для обратной совместимости с Numarray, он не рекомендуется для новых разработок. Начиная с NumPy 1.4, если требуется массив строк, рекомендуется использовать массив типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с обычным массивом NumPy типа str или unicode, этот класс добавляет следующую функциональность:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически очищают пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются как методы (например, endswith) и инфиксные операторы (например, "+", "*", "%")

chararrays следует создавать с помощью numpy.char.array или numpy.char.asarray, а не непосредственно с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если он не None. Если buffer равно None, тогда создаёт новый массив с strides в порядке «C», если не указано иначе len(shape) >= 2 и order='F', в этом случае strides находится в порядке «Fortran».

Parameters
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodebool, optional

Являются ли элементы массива типа unicode (True) или string (False). По умолчанию False.

bufferobject exposing the buffer interface or str, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetint, optional

Фиксированное смещение шага от начала оси. По умолчанию 0. Должно быть больше или равно 0.

stridesarray_like of ints, optional

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> «строчный» порядок (по умолчанию), ‘F’ -> «столбцовый» порядок (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Attributes
T

Транспонированный массив.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект Python буфера, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор по массиву в 1D.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, занимаемых элементами массива.

ndim

Число измерений массива.

real

Вещественная часть массива.

shape

Кортеж измерений массива.

size

Количество элементов в массиве.

strides

Кортеж байтов, необходимых для перехода на каждое измерение при обходе массива.

Methods

END_OF_DOCUMENT_MARKER

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые бы отсортировали этот массив.

copy([order])

Возвращает копию массива.

count(sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode([encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Выгружает пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode([encoding, errors])

Вызывает str.encode поэлементно.

endswith(suffix[, start, end])

Возвращает булевый массив, который равен True, если строковый элемент в self заканчивается на suffix, иначе False.

expandtabs([tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.

fill(value)

Заполняет массив скалярным значением.

find(sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает сплющенную копию массива.

getfield(dtype[, offset])

Возвращает поле заданного массива как определенный тип.

index(sub[, start, end])

Аналогично find, но вызывает исключение ValueError, если подстрока не найдена.

isalnum()

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, в противном случае — False.

isalpha()

Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, в противном случае — False.

isdecimal()

Для каждого элемента в self, возвращает True, если в элементе только символы десятичной системы.

isdigit()

Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, в противном случае — False.

islower()

Возвращает True для каждого элемента, если все символы в строке в нижнем регистре и есть хотя бы один такой символ, в противном случае — False.

isnumeric()

Для каждого элемента в self, возвращает True, если в элементе только числовые символы.

isspace()

Возвращает True для каждого элемента, если в строке только символы пробелов и есть хотя бы один такой символ, в противном случае — False.

istitle()

Возвращает True для каждого элемента, если элемент является строкой в стиле заголовка и есть хотя бы один символ, в противном случае — False.

isupper()

Возвращает True для каждого элемента, если все символы в строке в верхнем регистре и есть хотя бы один такой символ, в противном случае — False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(seq)

Возвращает строку, являющуюся конкатенацией строк в последовательности seq.

ljust(width[, fillchar])

Возвращает массив с элементами self выровненными по левому краю в строке длиной width.

lower()

Возвращает массив с элементами self, преобразованными в нижний регистр.

lstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными начальными символами.

nonzero()

Возвращает индексы элементов, отличных от нуля.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в indices.

ravel([order])

Возвращает сплющенный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.

reshape(shape[, order])

Возвращает массив с теми же данными, но новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где найдена подстрока sub, такой, что sub содержится в [start, end].

rindex(sub[, start, end])

Как rfind, но вызывает исключение ValueError при отсутствии подстроки sub.

rjust(width[, fillchar])

Возвращает массив с элементами self, выровненными вправо в строке длиной width.

rsplit([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными хвостовыми символами.

searchsorted(v[, side, sorter])

Находит индексы, куда элементы v должны быть вставлены в a, чтобы сохранить порядок.

setfield(val, dtype[, offset])

Размещает значение в указанном месте поля, определенного типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY) соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines([keepends])

Для каждого элемента в self, возвращает список строк в элементе, разделяя по границам строк.

squeeze([axis])

Удаляет оси длины один из a.

startswith(prefix[, start, end])

Возвращает булевый массив, который True когда строковый элемент в self начинается с prefix, иначе False.

strip([chars])

Для каждого элемента в self, возвращает копию с удаленными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает вид массива с осями axis1 и axis2, поменянными местами.

swapcase()

Для каждого элемента в self, возвращает копию строки, где заглавные символы преобразованы в строчные, и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, образованный из элементов a по заданным индексам.

title()

Для каждого элемента в self, возвращает строку в стиле заголовка: слова начинаются с заглавных букв, все остальные символы — строчные.

tofile(fid[, sep, format])

Записывает массив в файл как текст или двоичные данные (по умолчанию).

tolist()

Возвращает массив в виде вложенного списка Python до a.ndim уровней.

tostring([order])

Совместимый псевдоним для tobytes, с абсолютно таким же поведением.

translate(table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы были отображены с помощью заданной таблицы преобразований.

transpose(*axes)

Возвращает вид массива с транспонированными осями.

upper()

Возвращает массив с элементами self, преобразованными в верхний регистр.

view([dtype][, type])

Новый вид массива с теми же данными.

zfill(width)

Возвращает числовую строку, дополненную слева нулями в строке длиной width.

© 2005–2022 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.21/reference/generated/numpy.char.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API