Spec-Zone.ru › NumPy 1.11

numpy.chararray

class numpy.chararray [source]

Предоставляет удобный вид на массивы строковых и unicode значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если необходимы массивы строк, рекомендуется использовать массивы dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

По сравнению с обычным Numpy массивом типа str или unicode, этот класс добавляет следующую функциональность:

  1. значения автоматически очищаются от пробелов в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются как методы (например, endswith) и инфиксные операторы (например, "+", "*", "%")

Массивы chararray следует создавать с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если это не None. Если buffer равно None, тогда создаёт новый массив с strides в порядке “C”, если не оба len(shape) >= 2 и order='Fortran', в таком случае strides в порядке “Fortran”.

Параметры:

shape : кортеж

Форма массива.

itemsize : целое число, необязательно

Длина каждого элемента массива в количестве символов. По умолчанию 1.

unicode : bool, необязательно

Элементы массива являются unicode (True) или строками (False). По умолчанию False.

buffer : целое число, необязательно

Адрес памяти начала данных массива. По умолчанию None, в таком случае создаётся новый массив.

offset : целое число, необязательно

Фиксированное смещение шага от начала оси. По умолчанию 0. Должно быть >=0.

strides : массив целых чисел, необязательно

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order : {‘C’, ‘F’}, необязательно

Порядок, в котором данные массива хранятся в памяти: ‘C’ -> “строчный” порядок (по умолчанию), ‘F’ -> “столбцовый” (Fortran) порядок.

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([['a', 'a', 'a'],
       ['a', 'a', 'a'],
       ['a', 'a', 'a']],
      dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc']],
      dtype='|S5')

Атрибуты

T То же, что и self.transpose(), за исключением того, что self возвращается, если self.ndim < 2.
base Базовый объект, если память взята из другого объекта.
ctypes Объект для упрощения взаимодействия массива с модулем ctypes.
data Объект буфера Python, указывающий на начало данных массива.
dtype Тип данных элементов массива.
flags Информация о расположении памяти массива.
flat Итератор по массиву в 1D формате.
imag Мнимая часть массива.
itemsize Длина одного элемента массива в байтах.
nbytes Общее количество байтов, занимаемых элементами массива.
ndim Число измерений массива.
real Вещественная часть массива.
shape Кортеж измерений массива.
size Количество элементов в массиве.
strides Кортеж байтов для шага по каждому измерению при прохождении по массиву.

Методы

astype(dtype[, order, casting, subok, copy]) Копия массива, преобразованного к указанному типу.
copy([order]) Возвращает копию массива.
count(sub[, start, end]) Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].
decode([encoding, errors]) Вызывает str.decode поэлементно.
dump(file) Сохраняет пикл массива в указанный файл.
dumps() Возвращает пикл массива в виде строки.
encode([encoding, errors]) Вызывает str.encode поэлементно.
endswith(suffix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self оканчивается на suffix, в противном случае False.
expandtabs([tabsize]) Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.
fill(value) Заполняет массив скалярным значением.
find(sub[, start, end]) Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.
flatten([order]) Возвращает сжатый в один размер массив.
getfield(dtype[, offset]) Возвращает поле данного массива как определенного типа.
index(sub[, start, end]) Подобно find, но вызывает исключение ValueError, если подстрока не найдена.
isalnum() Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, иначе False.
isalpha() Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, иначе False.
isdecimal() Для каждого элемента в self, возвращает True, если в элементе есть только символы десятичных цифр.
isdigit() Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, иначе False.
islower() Возвращает True для каждого элемента, если все символы в строке в нижнем регистре и есть хотя бы один символ в нижнем регистре, иначе False.
isnumeric() Для каждого элемента в self, возвращает True, если в элементе есть только цифровые символы.
isspace() Возвращает True для каждого элемента, если в строке есть только символы пробелов и есть хотя бы один символ, иначе False.
istitle() Возвращает True для каждого элемента, если элемент — строка в стиле заголовка и есть хотя бы один символ, иначе False.
isupper() Возвращает True для каждого элемента, если все символы в строке в верхнем регистре и есть хотя бы один символ в верхнем регистре, иначе False.
item(*args) Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq) Возвращает строку, являющуюся конкатенацией строк в последовательности seq.
ljust(width[, fillchar]) Возвращает массив с элементами self выровненными влево в строке длины width.
lower() Возвращает массив с элементами self преобразованными в нижний регистр.
lstrip([chars]) Для каждого элемента в self, возвращает копию с удаленными начальными символами.
nonzero() Возвращает индексы элементов, которые не равны нулю.
put(indices, values[, mode]) Устанавливает a.flat[n] = values[n] для всех n в indices.
ravel([order]) Возвращает сплющенный массив.
repeat(repeats[, axis]) Повторяет элементы массива.
replace(old, new[, count]) Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.
reshape(shape[, order]) Возвращает массив с теми же данными, но новой формой.
resize(new_shape[, refcheck]) Изменяет форму и размер массива на месте.
rfind(sub[, start, end]) Для каждого элемента в self, возвращает наибольший индекс в строке, где подстрока sub найдена таким образом, что sub содержится в [start, end].
rindex(sub[, start, end]) Как rfind, но вызывает исключение ValueError, если подстрока sub не найдена.
rjust(width[, fillchar]) Возвращает массив с элементами self, выровненными вправо в строке длины width.
rsplit([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделительной строки.
rstrip([chars]) Для каждого элемента в self, возвращает копию со удаленными хвостовыми символами.
searchsorted(v[, side, sorter]) Находит индексы, куда элементы v должны быть вставлены в a для сохранения порядка.
setfield(val, dtype[, offset]) Поместить значение в указанное место в поле, определённом типом данных.
setflags([write, align, uic]) Устанавливает флаги массива WRITEABLE, ALIGNED и UPDATEIFCOPY соответственно.
sort([axis, kind, order]) Сортирует массив на месте.
split([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделительной строки.
splitlines([keepends]) Для каждого элемента в self, возвращает список строк в элементе, разделяя по границам строк.
squeeze([axis]) Удаляет одноразмерные элементы из формы a.
startswith(prefix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self начинается с prefix, в противном случае False.
strip([chars]) Для каждого элемента в self, возвращает копию со удаленными начальными и конечными символами.
swapaxes(axis1, axis2) Возвращает представление массива с axis1 и axis2 переставленными.
swapcase() Для каждого элемента в self, возвращает копию строки, где заглавные буквы заменены на строчные и наоборот.
take(indices[, axis, out, mode]) Возвращает массив, образованный элементами a по заданным индексам.
title() Для каждого элемента в self, возвращает заголовок-версию строки: слова начинаются с заглавных букв, все остальные буквенные символы в нижнем регистре.
tofile(fid[, sep, format]) Записывает массив в файл как текст или двоичный (по умолчанию).
tolist() Возвращает массив как (возможно, вложенный) список.
tostring([order]) Создаёт Python-байты, содержащие сырые байты данных в массиве.
translate(table[, deletechars]) Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы были отображены через заданную таблицу преобразований.
transpose(*axes) Возвращает представление массива с переставленными осями.
upper() Возвращает массив с элементами self, преобразованными в верхний регистр.
view([dtype, type]) Новое представление массива с теми же данными.
zfill(width) Возвращает числовую строку, дополненную слева нулями до длины width.
argsort

© 2008–2016 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.11.0/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API