Spec-Zone.ru › NumPy 1.10

numpy.chararray

class numpy.chararray [source]

Предоставляет удобный вид на массивы строковых и юникодных значений.

Примечание

Класс chararray существует для обратной совместимости с Numarray, его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если вам нужны массивы строк, рекомендуется использовать массивы dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

В сравнении с обычным массивом NumPy типа str или unicode, этот класс добавляет следующие функции:

  1. значения автоматически удаляют пробелы в конце при индексировании
  2. операторы сравнения автоматически удаляют пробелы в конце при сравнении значений
  3. векторизованные строковые операции предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays следует создавать с помощью numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если это не None. Если buffer равно None, то создаётся новый массив с strides в порядке «C», если не оба len(shape) >= 2 и order='Fortran', в этом случае strides находится в порядке «Fortran».

Параметры:

shape : кортеж

Форма массива.

itemsize : целое число, необязательно

Длина каждого элемента массива в числе символов. По умолчанию равно 1.

unicode : булево, необязательно

Являются ли элементы массива юникода (True) или строки (False). По умолчанию False.

buffer : целое число, необязательно

Адрес памяти начала данных массива. По умолчанию None, в этом случае создается новый массив.

offset : целое число, необязательно

Фиксированное смещение шага с начала оси? По умолчанию 0. Должно быть >=0.

strides : массив целых чисел, необязательно

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order : {‘C’, ‘F’}, необязательно

Порядок, в котором данные массива хранятся в памяти: ‘C’ -> порядок “строка-главное” (по умолчанию), ‘F’ -> порядок “столбец-главный” (Fortran).

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([['a', 'a', 'a'],
       ['a', 'a', 'a'],
       ['a', 'a', 'a']],
      dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc']],
      dtype='|S5')

Атрибуты

T То же, что self.transpose(), за исключением того, что self возвращается, если self.ndim < 2.
base Базовый объект, если память взята из другого объекта.
ctypes Объект для упрощения взаимодействия массива с модулем ctypes.
data Объект буфера Python, указывающий на начало данных массива.
dtype Тип данных элементов массива.
flags Информация о структуре памяти массива.
flat Итератор по массиву в 1-D формате.
imag Мнимая часть массива.
itemsize Длина одного элемента массива в байтах.
nbytes Общее количество байтов, используемых элементами массива.
ndim Количество измерений массива.
real Вещественная часть массива.
shape Кортеж измерений массива.
size Количество элементов в массиве.
strides Кортеж байтов, которые нужно перешагнуть в каждом измерении при обходе массива.

Методы

astype(dtype[, order, casting, subok, copy]) Копия массива, преобразованного к указанному типу.
copy([order]) Возвращает копию массива.
count(sub[, start, end]) Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].
decode([encoding, errors]) Вызывает str.decode поэлементно.
dump(file) Выгрузить пикл массива в указанный файл.
dumps() Возвращает пикл массива в виде строки.
encode([encoding, errors]) Вызывает str.encode поэлементно.
endswith(suffix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self оканчивается на suffix, в противном случае False.
expandtabs([tabsize]) Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.
fill(value) Заполнить массив скалярным значением.
find(sub[, start, end]) Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.
flatten([order]) Возвращает уплощенный массив.
getfield(dtype[, offset]) Возвращает поле заданного массива как определенного типа.
index(sub[, start, end]) Как find, но вызывает исключение ValueError, если подстрока не найдена.
isalnum() Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, иначе False.
isalpha() Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, иначе False.
isdecimal() Для каждого элемента в self, возвращает True, если в элементе только символы десятичного представления.
isdigit() Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, иначе False.
islower() Возвращает True для каждого элемента, если все символы в строке в нижнем регистре и есть хотя бы один символ в нижнем регистре, иначе False.
isnumeric() Для каждого элемента в self, возвращает True, если в элементе только числовые символы.
isspace() Возвращает True для каждого элемента, если в строке только пробельные символы и есть хотя бы один символ, иначе False.
istitle() Возвращает True для каждого элемента, если элемент является заглавной строкой и есть хотя бы один символ, иначе False.
isupper() Возвращает True для каждого элемента, если все символы в строке в верхнем регистре и есть хотя бы один символ в верхнем регистре, иначе False.
item(*args) Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq) Возвращает строку, которая является конкатенацией строк в последовательности seq.
ljust(width[, fillchar]) Возвращает массив с элементами self выровненными по левому краю в строке длины width.
lower() Возвращает массив с элементами self преобразованными в нижний регистр.
lstrip([chars]) Для каждого элемента в self, возвращает копию с удаленными ведущими символами.
nonzero() Возвращает индексы элементов, которые не равны нулю.
put(indices, values[, mode]) Устанавливает a.flat[n] = values[n] для всех n в индексах.
ravel([order]) Возвращает уплощенный массив.
repeat(repeats[, axis]) Повторяет элементы массива.
replace(old, new[, count]) Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.
reshape(shape[, order]) Возвращает массив, содержащий те же данные с новой формой.
resize(new_shape[, refcheck]) Изменить форму и размер массива на месте.
rfind(sub[, start, end]) Для каждого элемента в self, возвращает наибольший индекс в строке, где находится подстрока sub, так что sub содержится в пределах [start, end].
rindex(sub[, start, end]) Как rfind, но вызывает исключение ValueError, когда подстрока sub не найдена.
rjust(width[, fillchar]) Возвращает массив с элементами self выровненными вправо в строке длиной width.
rsplit([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.
rstrip([chars]) Для каждого элемента в self, возвращает копию с удалёнными хвостовыми символами.
searchsorted(v[, side, sorter]) Найти индексы, где элементы v должны быть вставлены в a для поддержания порядка.
setfield(val, dtype[, offset]) Поместить значение в указанное место в поле, определённом типом данных.
setflags([write, align, uic]) Установить флаги массива WRITEABLE, ALIGNED и UPDATEIFCOPY соответственно.
sort([axis, kind, order]) Сортировать массив на месте.
split([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.
splitlines([keepends]) Для каждого элемента в self, возвращает список строк в элементе, разбивая по границам строк.
squeeze([axis]) Удалить одноразмерные элементы из формы a.
startswith(prefix[, start, end]) Возвращает булевый массив, который True если строковый элемент в self начинается с prefix, в противном случае False.
strip([chars]) Для каждого элемента в self, возвращает копию с удалёнными начальными и конечными символами.
swapaxes(axis1, axis2) Возвращает представление массива с axis1 и axis2 поменявшимися местами.
swapcase() Для каждого элемента в self, возвращает копию строки с прописными символами, преобразованными в строчные, и наоборот.
take(indices[, axis, out, mode]) Возвращает массив, сформированный из элементов a по заданным индексам.
title() Для каждого элемента в self, возвращает заглавную версию строки: слова начинаются с заглавных букв, все остальные буквы строчные.
tofile(fid[, sep, format]) Записать массив в файл как текст или бинарный (по умолчанию).
tolist() Возвращает массив как (возможно вложенный) список.
tostring([order]) Построить Python байты, содержащие сырые байтовые данные в массиве.
translate(table[, deletechars]) Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы были отображены через заданную таблицу преобразования.
transpose(*axes) Возвращает представление массива с переставленными осями.
upper() Возвращает массив с элементами self преобразованными в верхний регистр.
view([dtype, type]) Новое представление массива с теми же данными.
zfill(width) Возвращает числовую строку, дополненную слева нулями в строке длиной width.
argsort
argsort

© 2008–2016 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.10.1/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API