Spec-Zone.ru › NumPy 2.0

numpy.char.chararray

classnumpy.char.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)[source]

Предоставляет удобный вид на массивы строковых и универсальных значений.

Примечание

Класс chararray существует для обеспечения обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если нужны массивы строк, рекомендуется использовать массивы dtype object_, bytes_ или str_ и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с массивом NumPy типа bytes_ или str_, этот класс добавляет следующие возможности:

  1. Значения автоматически лишаются завершающих пробелов при индексировании.
  2. Операторы сравнения автоматически удаляют завершающие пробелы при сравнении значений.
  3. Векторизованные строковые операции предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%").

chararrays должны создаваться с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides) если это не None. Если buffer равно None, то создаёт новый массив с strides в порядке “C”, если не заданы оба len(shape) >= 2 и order='F', в этом случае strides находится в порядке “Fortran”.

Параметры:
shapeкортеж

Форма массива.

itemsizeцелое число, необязательно

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodeбулево, необязательно

Являются ли элементы массива типа unicode (True) или строки (False). По умолчанию False.

bufferобъект, экспонирующий интерфейс буфера или str, необязательно

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetцелое число, необязательно

Фиксированное смещение шага с начала оси? По умолчанию 0. Должно быть >=0.

stridesмассив-подобный массив целых чисел, необязательно

Шаги для массива (см. strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, необязательно

Порядок хранения данных массива в памяти: ‘C’ -> “строчный” порядок (по умолчанию), ‘F’ -> “столбцовый” (Fortran) порядок.

Примеры

>>> charar = np.char.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.char.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Атрибуты:
T

Вид транспонированного массива.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект буфера Python, указывающий на начало данных массива.

device
dtype

Тип данных элементов массива.

flags

Информация о структуре памяти массива.

flat

Итератор по массиву в одномерном виде.

imag

Мнимая часть массива.

itemset
itemsize

Длина одного элемента массива в байтах.

mT

Вид транспонированного массива матрицы.

nbytes

Общее количество байтов, занимаемых элементами массива.

ndim

Количество измерений массива.

newbyteorder
ptp
real

Вещественная часть массива.

shape

Кортеж измерений массива.

size

Количество элементов в массиве.

strides

Кортеж байтов для шага по каждому измерению при обходе массива.

Методы

END_OF_DOCUMENT_MARKER

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые отсортируют этот массив.

copy([order])

Возвращает копию массива.

count(sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode([encoding, errors])

Вызывает bytes.decode поэлементно.

dump(file)

Сохраняет пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode([encoding, errors])

Вызывает str.encode поэлементно.

endswith(suffix[, start, end])

Возвращает булевый массив, который равен True, если строковый элемент в self заканчивается на suffix, иначе False.

expandtabs([tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменены на один или несколько пробелов.

fill(value)

Заполняет массив скалярным значением.

find(sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает плоский массив (копию).

getfield(dtype[, offset])

Возвращает поле данного массива как определенный тип.

index(sub[, start, end])

Как find, но вызывает ValueError, если подстрока не найдена.

isalnum()

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть как минимум один символ, иначе False.

isalpha()

Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть как минимум один символ, иначе False.

isdecimal()

Для каждого элемента в self, возвращает True, если в элементе есть только десятичные символы.

isdigit()

Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть как минимум один символ, иначе False.

islower()

Возвращает True для каждого элемента, если все символы в строке в нижнем регистре и есть как минимум один символ в нижнем регистре, иначе False.

isnumeric()

Для каждого элемента в self, возвращает True, если в элементе есть только числовые символы.

isspace()

Возвращает True для каждого элемента, если в строке есть только символы пробелов и есть как минимум один символ, иначе False.

istitle()

Возвращает True для каждого элемента, если элемент является строкой в стиле заголовка и есть как минимум один символ, иначе False.

isupper()

Возвращает True для каждого элемента, если все символы в строке в верхнем регистре и есть как минимум один символ, иначе False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(seq)

Возвращает строку, являющуюся конкатенацией строк в последовательности seq.

ljust(width[, fillchar])

Возвращает массив с элементами self выровненными влево в строке длиной width.

lower()

Возвращает массив с элементами self преобразованными в нижний регистр.

lstrip([chars])

Для каждого элемента в self, возвращает копию со удаленными начальными символами.

nonzero()

Возвращает индексы элементов, которые отличны от нуля.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в indices.

ravel([order])

Возвращает сплющенный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.

reshape(shape, /, *[, order])

Возвращает массив с теми же данными, но новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где подстрока sub найдена, так что sub содержится в [start, end].

rindex(sub[, start, end])

Как rfind, но вызывает ValueError, если подстрока sub не найдена.

rjust(width[, fillchar])

Возвращает массив с элементами self, выровненными вправо в строке длиной width.

rsplit([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip([chars])

Для каждого элемента в self, возвращает копию со удаленными заключительным символами.

searchsorted(v[, side, sorter])

Находит индексы, куда элементы v должны быть вставлены в a для сохранения порядка.

setfield(val, dtype[, offset])

Поместить значение в указанное место в поле, определенное типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, WRITEBACKIFCOPY соответственно.

sort([axis, kind, order])

Сортировать массив на месте.

split([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines([keepends])

Для каждого элемента в self, возвращает список строк в элементе, разбивая по границам строк.

squeeze([axis])

Удалить оси длиной один из a.

startswith(prefix[, start, end])

Возвращает булевый массив, который True когда строковый элемент в self начинается с prefix, иначе False.

strip([chars])

Для каждого элемента в self, возвращает копию со удаленными начальными и заключительным символами.

swapaxes(axis1, axis2)

Возвращает представление массива с axis1 и axis2 поменяны местами.

swapcase()

Для каждого элемента в self, возвращает копию строки с заглавными буквами, преобразованными в строчные и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, сформированный из элементов a по заданным индексам.

title()

Для каждого элемента в self, возвращает заглавленную версию строки: слова начинаются с заглавной буквы, остальные символы преобразуются в строчные.

tofile(fid[, sep, format])

Записать массив в файл как текст или двоичный (по умолчанию).

tolist()

Возвращает массив как вложенный список Python-скаляров глубиной a.ndim.

tostring([order])

Алиас совместимости для tobytes, с абсолютно таким же поведением.

translate(table[, deletechars])

Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars удаляются, а оставшиеся символы отображаются через заданную таблицу преобразования.

transpose(*axes)

Возвращает представление массива с переставленными осями.

upper()

Возвращает массив с элементами self, преобразованными в верхний регистр.

view([dtype][, type])

Новое представление массива с теми же данными.

zfill(width)

Возвращает числовую строку, заполненную нулями слева в строке длиной width.

© 2005–2024 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/2.0/reference/generated/numpy.char.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API