Spec-Zone.ru › NumPy 1.21

numpy.chararray

class numpy.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)[source]

Обеспечивает удобный вид на массивы строк и значений Unicode.

Примечание

Класс chararray существует для обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если требуется массив строк, рекомендуется использовать массивы типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных операций со строками.

В отличие от обычного массива NumPy типа str или unicode, этот класс добавляет следующие возможности:

  1. при индексировании значения автоматически удаляют пробелы в конце
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные операции со строками предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays следует создавать с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создает массив, используя buffer (с offset и strides), если это не None. Если buffer равно None, то создает новый массив с strides в порядке “C”, если не указано иначе в len(shape) >= 2 и order='F', в этом случае strides в порядке “Fortran”.

Parameters
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodebool, optional

Являются ли элементы массива типа unicode (True) или string (False). По умолчанию False.

bufferобъект, представляющий буфер, или str, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создается новый массив.

offsetint, optional

Фиксированное смещение шага от начала оси. По умолчанию 0. Должно быть >=0.

stridesarray_like of ints, optional

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> порядок “строка-главная” (по умолчанию), ‘F’ -> порядок “столбец-главный” (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Attributes
T

Транспонированный массив.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект Python-буфера, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор по массиву в 1D формате.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, занимаемых элементами массива.

ndim

Число измерений массива.

real

Вещественная часть массива.

shape

Кортеж размеров массива.

size

Число элементов в массиве.

strides

Кортеж байтов для шага в каждом измерении при прохождении массива.

Methods

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые бы отсортировали этот массив.

copy([order])

Возвращает копию массива.

count(sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode([encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Сохраняет пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode([encoding, errors])

Вызывает str.encode поэлементно.

endswith(suffix[, start, end])

Возвращает булевый массив, который равен True если строковый элемент в self заканчивается на suffix, в противном случае False.

expandtabs([tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменяются одним или несколькими пробелами.

fill(value)

Заполняет массив скалярным значением.

find(sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает плоский массив, являющийся копией.

getfield(dtype[, offset])

Возвращает поле данного массива в виде определенного типа.

index(sub[, start, end])

Аналогично find, но вызывает исключение ValueError если подстрока не найдена.

isalnum()

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один такой символ, иначе False.

isalpha()

Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один такой символ, иначе False.

isdecimal()

Для каждого элемента в self, возвращает True, если в элементе только символы десятичных цифр.

isdigit()

Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, иначе False.

islower()

Возвращает True для каждого элемента, если все символы с регистром в строке — строчные и есть хотя бы один такой символ, иначе False.

isnumeric()

Для каждого элемента в self, возвращает True, если в элементе только числовые символы.

isspace()

Возвращает True для каждого элемента, если в строке только символы пробелов и есть хотя бы один такой символ, иначе False.

istitle()

Возвращает True для каждого элемента, если элемент является заглавной строкой и есть хотя бы один символ, иначе False.

isupper()

Возвращает True для каждого элемента, если все символы с регистром в строке — заглавные и есть хотя бы один такой символ, иначе False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(seq)

Возвращает строку, являющуюся конкатенацией строк в последовательности seq.

ljust(width[, fillchar])

Возвращает массив с элементами self выровненными по левому краю в строке длины width.

lower()

Возвращает массив с элементами self, преобразованными к нижнему регистру.

lstrip([chars])

Для каждого элемента в self, возвращает копию со удаленными ведущими символами.

nonzero()

Возвращает индексы элементов, которые не равны нулю.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в индексах.

ravel([order])

Возвращает сглаженный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old замененными на new.

reshape(shape[, order])

Возвращает массив, содержащий те же данные с новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где найдена подстрока sub, такой что sub содержится в [start, end].

rindex(sub[, start, end])

Аналогично rfind, но вызывает исключение ValueError если подстрока sub не найдена.

rjust(width[, fillchar])

Возвращает массив с элементами self выровненными по правому краю в строке длины width.

rsplit([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными символами слева.

searchsorted(v[, side, sorter])

Находит индексы, куда элементы v должны быть вставлены в a для сохранения порядка.

setfield(val, dtype[, offset])

Размещает значение в указанном месте в поле, определённом типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY), соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines([keepends])

Для каждого элемента в self, возвращает список строк в элементе, разделяя по границам строк.

squeeze([axis])

Удаляет оси длиной один из a.

startswith(prefix[, start, end])

Возвращает булевый массив, который True если строковый элемент в self начинается с prefix, иначе False.

strip([chars])

Для каждого элемента в self, возвращает копию с удаленными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает представление массива с axis1 и axis2 поменявшими местами.

swapcase()

Для каждого элемента в self, возвращает копию строки с заглавными буквами преобразованными в строчные и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, образованный из элементов a по заданным индексам.

title()

Для каждого элемента в self, возвращает строку в стиле заголовка: слова начинаются с заглавных букв, остальные символы — строчные.

tofile(fid[, sep, format])

Записывает массив в файл как текст или двоичные данные (по умолчанию).

tolist()

Возвращает массив в виде вложенного списка Python с глубиной вложения a.ndim.

tostring([order])

Алиас совместимости для tobytes с абсолютно тем же поведением.

translate(table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы отображены с помощью заданной таблицы преобразования.

transpose(*axes)

Возвращает представление массива с переставленными осями.

upper()

Возвращает массив с элементами self преобразованными в верхний регистр.

view([dtype][, type])

Новое представление массива с теми же данными.

zfill(width)

Возвращает строку с числовой строкой, дополненную слева нулями в строке длиной width.

© 2005–2022 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.21/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API