Spec-Zone.ru › NumPy 1.20

numpy.char.chararray

class numpy.char.chararray(shape, itemsize=1, unicode=False, buffer=None, offset=0, strides=None, order=None)

Предоставляет удобный вид на массивы строковых и Unicode-значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, он не рекомендуется для новых разработок. Начиная с numpy 1.4, если нужны массивы строк, рекомендуется использовать массивы типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с обычным массивом NumPy типа str или unicode, этот класс добавляет следующие возможности:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически очищают значения от пробелов в конце при сравнении
  3. векторизованные строковые операции предоставляются как методы (например, endswith) и инфиксные операторы (например, "+", "*", "%")

chararrays должны создаваться с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создает массив, используя buffer (с offset и strides), если это не None. Если buffer равно None, то создает новый массив с strides в порядке "C", если оба len(shape) >= 2 и order='F' не установлены, в противном случае strides в порядке "Fortran".

Параметры
shapetuple

Форма массива.

itemsizeint, optional

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicodebool, optional

Являются ли элементы массива типа Unicode (True) или строковые (False). По умолчанию False.

bufferobject exposing the buffer interface or str, optional

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offsetint, optional

Фиксированное смещение шага от начала оси? По умолчанию 0. Должно быть >=0.

stridesarray_like of ints, optional

Шаги массива (см. ndarray.strides для полного описания). По умолчанию None.

order{‘C’, ‘F’}, optional

Порядок хранения данных массива в памяти: ‘C’ -> “строчный” порядок (по умолчанию), ‘F’ -> “столбцовый” (Fortran) порядок.

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([[b'a', b'a', b'a'],
           [b'a', b'a', b'a'],
           [b'a', b'a', b'a']], dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([[b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc'],
           [b'abc', b'abc', b'abc']], dtype='|S5')
Атрибуты
T

Транспонированный массив.

base

Базовый объект, если память взята из другого объекта.

ctypes

Объект для упрощения взаимодействия массива с модулем ctypes.

data

Объект буфера Python, указывающий на начало данных массива.

dtype

Тип данных элементов массива.

flags

Информация о расположении памяти массива.

flat

Итератор по массиву в 1-мерном виде.

imag

Мнимая часть массива.

itemsize

Длина одного элемента массива в байтах.

nbytes

Общее количество байтов, занимаемых элементами массива.

ndim

Количество измерений массива.

real

Вещественная часть массива.

shape

Кортеж измерений массива.

size

Количество элементов в массиве.

strides

Кортеж байтов для шага в каждом измерении при обходе массива.

Методы

astype(dtype[, order, casting, subok, copy])

Копия массива, преобразованная к указанному типу.

argsort([axis, kind, order])

Возвращает индексы, которые бы отсортировали этот массив.

copy([order])

Возвращает копию массива.

count(sub[, start, end])

Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].

decode([encoding, errors])

Вызывает str.decode поэлементно.

dump(file)

Сохраняет пикл массива в указанный файл.

dumps()

Возвращает пикл массива в виде строки.

encode([encoding, errors])

Вызывает str.encode поэлементно.

endswith(suffix[, start, end])

Возвращает булевый массив, который равен True, если строковый элемент в self оканчивается на suffix, в противном случае False.

expandtabs([tabsize])

Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.

fill(value)

Заполняет массив скалярным значением.

find(sub[, start, end])

Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.

flatten([order])

Возвращает плоский массив (копию массива, сжатого в одну размерность).

getfield(dtype[, offset])

Возвращает поле данного массива как определенный тип.

index(sub[, start, end])

Подобно find, но вызывает исключение ValueError при отсутствии подстроки.

isalnum()

Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, иначе — False.

isalpha()

Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, иначе — False.

isdecimal()

Для каждого элемента в self, возвращает True, если в элементе содержатся только десятичные символы.

isdigit()

Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, иначе — False.

islower()

Возвращает True для каждого элемента, если все символы с регистром в строке являются строчными, и есть хотя бы один символ с регистром, иначе — False.

isnumeric()

Для каждого элемента в self, возвращает True, если в элементе содержатся только числовые символы.

isspace()

Возвращает True для каждого элемента, если в строке содержатся только пробельные символы и есть хотя бы один символ, иначе — False.

istitle()

Возвращает True для каждого элемента, если элемент является строкой в стиле заголовка и есть хотя бы один символ, иначе — False.

isupper()

Возвращает True для каждого элемента, если все символы с регистром в строке являются заглавными, и есть хотя бы один символ с регистром, иначе — False.

item(*args)

Копирует элемент массива в стандартный скаляр Python и возвращает его.

join(seq)

Возвращает строку, являющуюся конкатенацией строк в последовательности seq.

ljust(width[, fillchar])

Возвращает массив с элементами self, выровненными влево в строке длиной width.

lower()

Возвращает массив с элементами self, преобразованными в нижний регистр.

lstrip([chars])

Для каждого элемента в self, возвращает копию со снятыми символами в начале.

nonzero()

Возвращает индексы ненулевых элементов.

put(indices, values[, mode])

Устанавливает a.flat[n] = values[n] для всех n в indices.

ravel([order])

Возвращает уплощенный массив.

repeat(repeats[, axis])

Повторяет элементы массива.

replace(old, new[, count])

Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old замененными на new.

reshape(shape[, order])

Возвращает массив с теми же данными, но новой формой.

resize(new_shape[, refcheck])

Изменяет форму и размер массива на месте.

rfind(sub[, start, end])

Для каждого элемента в self, возвращает наибольший индекс в строке, где подстрока sub найдена, при этом sub содержится в [start, end].

rindex(sub[, start, end])

Как rfind, но вызывает исключение ValueError если подстрока sub не найдена.

rjust(width[, fillchar])

Возвращает массив с элементами self, выровненными вправо в строке длиной width.

rsplit([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

rstrip([chars])

Для каждого элемента в self, возвращает копию с удаленными символами слева.

searchsorted(v[, side, sorter])

Находит индексы, где элементы v должны быть вставлены в a для сохранения порядка.

setfield(val, dtype[, offset])

Помещает значение в указанное место в поле, определённое типом данных.

setflags([write, align, uic])

Устанавливает флаги массива WRITEABLE, ALIGNED, (WRITEBACKIFCOPY и UPDATEIFCOPY), соответственно.

sort([axis, kind, order])

Сортирует массив на месте.

split([sep, maxsplit])

Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.

splitlines([keepends])

Для каждого элемента в self, возвращает список строк в элементе, разбивая по границам строк.

squeeze([axis])

Удаляет оси длиной 1 из a.

startswith(prefix[, start, end])

Возвращает булевый массив, который равен True, если строковый элемент в self начинается с prefix, в противном случае False.

strip([chars])

Для каждого элемента в self, возвращает копию с удаленными начальными и конечными символами.

swapaxes(axis1, axis2)

Возвращает представление массива с осями axis1 и axis2 поменявшимися местами.

swapcase()

Для каждого элемента в self, возвращает копию строки с заглавными буквами, преобразованными в строчные, и наоборот.

take(indices[, axis, out, mode])

Возвращает массив, образованный из элементов a по заданным индексам.

title()

Для каждого элемента в self, возвращает строку в формате заголовка: слова начинаются с заглавных букв, остальные буквы — строчные.

tofile(fid[, sep, format])

Записывает массив в файл в виде текста или двоичных данных (по умолчанию).

tolist()

Возвращает массив в виде вложенного списка Python с a.ndim уровнями вложенности.

tostring([order])

Альтернативное имя для tobytes с абсолютно таким же поведением.

translate(table[, deletechars])

Для каждого элемента в self, возвращает копию строки, в которой удалены все символы, указанные в необязательном аргументе deletechars, а оставшиеся символы отображены с помощью заданной таблицы преобразования.

transpose(*axes)

Возвращает представление массива с переставленными осями.

upper()

Возвращает массив с элементами self в верхнем регистре.

view([dtype][, type])

Новое представление массива с теми же данными.

zfill(width)

Возвращает числовую строку, дополненную слева нулями в строке длиной width.

© 2005–2021 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.20/reference/generated/numpy.char.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API