Spec-Zone.ru › NumPy 1.13

numpy.chararray

class numpy.chararray [source]

Предоставляет удобный вид на массивы строковых и unicode-значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, он не рекомендуется для новых разработок. Начиная с numpy 1.4, если требуется массив строк, рекомендуется использовать массив типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с обычным массивом NumPy типа str или unicode, этот класс добавляет следующие функции:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays следует создавать с помощью numpy.char.array или numpy.char.asarray, а не напрямую через этот конструктор.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если это не None. Если buffer является None, тогда создаёт новый массив с strides в порядке «C», если не оба len(shape) >= 2 и order='Fortran', в таком случае strides в порядке «Fortran».

Параметры:

shape : кортеж

Форма массива.

itemsize : int, необязательно

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicode : bool, необязательно

Являются ли элементы массива unicode (True) или строковые (False). По умолчанию False.

buffer : int, необязательно

Память адреса начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offset : int, необязательно

Фиксированное смещение шага от начала оси? По умолчанию 0. Должно быть >=0.

strides : массив_like целых чисел, необязательно

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order : {‘C’, ‘F’}, необязательно

Порядок, в котором данные массива хранятся в памяти: ‘C’ -> порядок “строки” (по умолчанию), ‘F’ -> порядок “столбцы” (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([['a', 'a', 'a'],
       ['a', 'a', 'a'],
       ['a', 'a', 'a']],
      dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc']],
      dtype='|S5')

Атрибуты

T То же, что self.transpose(), за исключением того, что self возвращается, если self.ndim < 2.
base Базовый объект, если память взята из другого объекта.
ctypes Объект для упрощения взаимодействия массива с модулем ctypes.
data Объект буфера Python, указывающий на начало данных массива.
dtype Тип данных элементов массива.
flags Информация о расположении памяти массива.
flat Итератор 1-D по массиву.
imag Мнимая часть массива.
itemsize Длина одного элемента массива в байтах.
nbytes Общее количество байтов, потребляемых элементами массива.
ndim Число измерений массива.
real Вещественная часть массива.
shape Кортеж измерений массива.
size Количество элементов в массиве.
strides Кортеж байт для шага по каждому измерению при прохождении по массиву.

Методы

astype(dtype[, order, casting, subok, copy]) Копия массива, преобразованная к указанному типу.
copy([order]) Возвращает копию массива.
count(sub[, start, end]) Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].
decode([encoding, errors]) Вызывает str.decode поэлементно.
dump(file) Сохраняет пикл массива в указанный файл.
dumps() Возвращает пикл массива в виде строки.
encode([encoding, errors]) Вызывает str.encode поэлементно.
endswith(suffix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self оканчивается на suffix, в противном случае False.
expandtabs([tabsize]) Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.
fill(value) Заполняет массив скалярным значением.
find(sub[, start, end]) Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.
flatten([order]) Возвращает плоский массив-копию.
getfield(dtype[, offset]) Возвращает поле данного массива как определённого типа.
index(sub[, start, end]) Как find, но генерирует исключение ValueError, если подстрока не найдена.
isalnum() Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми, и есть как минимум один такой символ, в противном случае False.
isalpha() Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один такой символ, в противном случае False.
isdecimal() Для каждого элемента в self, возвращает True, если в элементе только символы десятичного представления.
isdigit() Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, в противном случае False.
islower() Возвращает True для каждого элемента, если все символы с регистром в строке являются строчными и есть хотя бы один такой символ, в противном случае False.
isnumeric() Для каждого элемента в self, возвращает True, если в элементе только числовые символы.
isspace() Возвращает True для каждого элемента, если в строке только пробельные символы и есть хотя бы один такой символ, в противном случае False.
istitle() Возвращает True для каждого элемента, если элемент является строкой в формате заголовка и есть хотя бы один символ, в противном случае False.
isupper() Возвращает True для каждого элемента, если все символы с регистром в строке заглавные и есть хотя бы один такой символ, в противном случае False.
item(*args) Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq) Возвращает строку, являющуюся конкатенацией строк в последовательности seq.
ljust(width[, fillchar]) Возвращает массив с элементами self выровненными по левому краю в строке длиной width.
lower() Возвращает массив с элементами self, преобразованными в нижний регистр.
lstrip([chars]) Для каждого элемента в self, возвращает копию с удалёнными начальными символами.
nonzero() Возвращает индексы элементов, не равных нулю.
put(indices, values[, mode]) Устанавливает a.flat[n] = values[n] для всех n в indices.
ravel([order]) Возвращает сплющенный массив.
repeat(repeats[, axis]) Повторяет элементы массива.
replace(old, new[, count]) Для каждого элемента в self, возвращается копия строки со всеми вхождениями подстроки old заменёнными на new.
reshape(shape[, order]) Возвращает массив, содержащий те же данные с новой формой.
resize(new_shape[, refcheck]) Изменение формы и размера массива на месте.
rfind(sub[, start, end]) Для каждого элемента в self, возвращается наибольший индекс в строке, где найдена подстрока sub, так что sub содержится в [start, end].
rindex(sub[, start, end]) Как rfind, но вызывает ValueError при отсутствии подстроки sub.
rjust(width[, fillchar]) Возвращает массив с элементами self выровненными по правому краю в строке длиной width.
rsplit([sep, maxsplit]) Для каждого элемента в self, возвращается список слов в строке, используя sep в качестве разделителя.
rstrip([chars]) Для каждого элемента в self, возвращается копия с удалёнными trailing символами.
searchsorted(v[, side, sorter]) Найти индексы, где элементы v должны быть вставлены в a для поддержания порядка.
setfield(val, dtype[, offset]) Поместить значение в указанное место в поле, определённом типом данных.
setflags([write, align, uic]) Установить флаги массива WRITEABLE, ALIGNED и UPDATEIFCOPY соответственно.
sort([axis, kind, order]) Сортировать массив на месте.
split([sep, maxsplit]) Для каждого элемента в self, возвращается список слов в строке, используя sep в качестве разделителя.
splitlines([keepends]) Для каждого элемента в self, возвращается список строк в элементе, разбивая по границам строк.
squeeze([axis]) Удалить одноразмерные записи из формы a.
startswith(prefix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self начинается с prefix, иначе False.
strip([chars]) Для каждого элемента в self, возвращается копия с удалёнными ведущими и trailing символами.
swapaxes(axis1, axis2) Возвращает вид массива с axis1 и axis2 поменянными местами.
swapcase() Для каждого элемента в self, возвращается копия строки с заглавными буквами, преобразованными в строчные, и наоборот.
take(indices[, axis, out, mode]) Возвращает массив, образованный из элементов a по заданным индексам.
title() Для каждого элемента в self, возвращается версия строки в стиле заголовка: слова начинаются с заглавных букв, все остальные символы — строчные.
tofile(fid[, sep, format]) Записать массив в файл как текст или двоичный (по умолчанию).
tolist() Возвращает массив как (возможно, вложенный) список.
tostring([order]) Создать байтовый объект Python, содержащий сырые данные байты массива.
translate(table[, deletechars]) Для каждого элемента в self, возвращается копия строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы были отображены с помощью заданной таблицы преобразования.
transpose(*axes) Возвращает вид массива с перенумерованными осями.
upper() Возвращает массив с элементами self преобразованными в верхний регистр.
view([dtype, type]) Новый вид массива с теми же данными.
zfill(width) Возвращает числовую строку, дополненную слева нулями в строке длиной width.
argsort
argsort

© 2008–2017 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.13.0/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API