Spec-Zone.ru › NumPy 1.12

numpy.chararray

class numpy.chararray [source]

Предоставляет удобный вид на массивы строковых и юникод-значений.

Примечание

Класс chararray существует для обеспечения обратной совместимости с Numarray, и его не рекомендуется использовать в новых разработках. Начиная с numpy 1.4, если вам нужны массивы строк, рекомендуется использовать массивы типа dtype object_, string_ или unicode_, и использовать свободные функции в модуле numpy.char для быстрых векторизованных строковых операций.

В отличие от обычного массива NumPy типа str или unicode, данный класс добавляет следующие возможности:

  1. при индексировании значения автоматически очищаются от конечных пробелов
  2. операторы сравнения автоматически удаляют конечные пробелы при сравнении значений
  3. векторизованные строковые операции предоставляются в виде методов (например, endswith) и инфиксных операторов (например, "+", "*", "%")

chararrays следует создавать с использованием numpy.char.array или numpy.char.asarray, а не напрямую с помощью этого конструктора.

Этот конструктор создаёт массив, используя buffer (с offset и strides), если он не None. Если buffer равно None, тогда создаётся новый массив с strides в порядке “C”, если оба len(shape) >= 2 и order='Fortran', то strides в порядке “Fortran”.

Параметры:

shape : кортеж

Форма массива.

itemsize : целое число, необязательно

Длина каждого элемента массива в символах. По умолчанию 1.

unicode : bool, необязательно

Являются ли элементы массива типа unicode (True) или строки (False). По умолчанию False.

buffer : целое число, необязательно

Адрес памяти начала данных массива. По умолчанию None, в этом случае создаётся новый массив.

offset : целое число, необязательно

Фиксированное смещение шага от начала оси? Должно быть >=0. По умолчанию 0.

strides : массив целых чисел, необязательно

Шаги для массива (см. ndarray.strides для полного описания). По умолчанию None.

order : {‘C’, ‘F’}, необязательно

Порядок, в котором данные массива хранятся в памяти: ‘C’ -> “строчный” порядок (по умолчанию), ‘F’ -> “столбцовый” (Fortran) порядок.

Примеры

>>> charar = np.chararray((3, 3))
>>> charar[:] = 'a'
>>> charar
chararray([['a', 'a', 'a'],
       ['a', 'a', 'a'],
       ['a', 'a', 'a']],
      dtype='|S1')
>>> charar = np.chararray(charar.shape, itemsize=5)
>>> charar[:] = 'abc'
>>> charar
chararray([['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc'],
       ['abc', 'abc', 'abc']],
      dtype='|S5')

Атрибуты

T То же, что self.transpose(), за исключением того, что self возвращается, если self.ndim < 2.
base Объект-база, если память взята из другого объекта.
ctypes Объект для упрощения взаимодействия массива с модулем ctypes.
data Объект Python буфера, указывающий на начало данных массива.
dtype Тип данных элементов массива.
flags Информация о расположении памяти массива.
flat Итератор 1-D по массиву.
imag Мнимая часть массива.
itemsize Длина одного элемента массива в байтах.
nbytes Общее количество байтов, занимаемых элементами массива.
ndim Количество измерений массива.
real Вещественная часть массива.
shape Кортеж измерений массива.
size Количество элементов в массиве.
strides Кортеж байтов для перехода по каждому измерению при обходе массива.

Методы

astype(dtype[, order, casting, subok, copy]) Копия массива, преобразованная к указанному типу.
copy([order]) Возвращает копию массива.
count(sub[, start, end]) Возвращает массив с количеством неперекрывающихся вхождений подстроки sub в диапазоне [start, end].
decode([encoding, errors]) Вызывает str.decode поэлементно.
dump(file) Выгружает пикл массива в указанный файл.
dumps() Возвращает пикл массива в виде строки.
encode([encoding, errors]) Вызывает str.encode поэлементно.
endswith(suffix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self заканчивается на suffix, иначе False.
expandtabs([tabsize]) Возвращает копию каждого строкового элемента, где все символы табуляции заменены одним или несколькими пробелами.
fill(value) Заполняет массив скалярным значением.
find(sub[, start, end]) Для каждого элемента возвращает наименьший индекс в строке, где найдена подстрока sub.
flatten([order]) Возвращает плоский массив.
getfield(dtype[, offset]) Возвращает поле данного массива как определенного типа.
index(sub[, start, end]) Подобно find, но генерирует исключение ValueError, когда подстрока не найдена.
isalnum() Возвращает True для каждого элемента, если все символы в строке являются буквенно-цифровыми и есть хотя бы один символ, иначе False.
isalpha() Возвращает True для каждого элемента, если все символы в строке являются буквенными и есть хотя бы один символ, иначе False.
isdecimal() Для каждого элемента в self, возвращает True, если в элементе содержатся только символы десятичных цифр.
isdigit() Возвращает True для каждого элемента, если все символы в строке являются цифрами и есть хотя бы одна цифра, иначе False.
islower() Возвращает True для каждого элемента, если все символы в строке с регистром являются строчными и есть хотя бы один такой символ, иначе False.
isnumeric() Для каждого элемента в self, возвращает True, если в элементе содержатся только числовые символы.
isspace() Возвращает True для каждого элемента, если в строке содержатся только пробельные символы и есть хотя бы один такой символ, иначе False.
istitle() Возвращает True для каждого элемента, если элемент является заглавленной строкой и в нём есть хотя бы один символ, иначе False.
isupper() Возвращает True для каждого элемента, если все символы с регистром в строке заглавные и есть хотя бы один такой символ, иначе False.
item(*args) Копирует элемент массива в стандартный скаляр Python и возвращает его.
join(seq) Возвращает строку, которая является конкатенацией строк в последовательности seq.
ljust(width[, fillchar]) Возвращает массив, элементы которого self выровнены влево в строке длины width.
lower() Возвращает массив, элементы которого self приведены к нижнему регистру.
lstrip([chars]) Для каждого элемента в self, возвращает копию со снятыми ведущими символами.
nonzero() Возвращает индексы элементов, которые не равны нулю.
put(indices, values[, mode]) Устанавливает a.flat[n] = values[n] для всех n в indices.
ravel([order]) Возвращает сплющенный массив.
repeat(repeats[, axis]) Повторяет элементы массива.
replace(old, new[, count]) Для каждого элемента в self, возвращает копию строки со всеми вхождениями подстроки old заменёнными на new.
reshape(shape[, order]) Возвращает массив с теми же данными, но новой формой.
resize(new_shape[, refcheck]) Изменить форму и размер массива на месте.
rfind(sub[, start, end]) Для каждого элемента в self, возвращает наибольший индекс в строке, где найден подстрока sub, так что sub содержится в [start, end].
rindex(sub[, start, end]) Как rfind, но вызывает исключение ValueError, если подстрока sub не найдена.
rjust(width[, fillchar]) Возвращает массив с элементами self, выровненными вправо в строке длиной width.
rsplit([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.
rstrip([chars]) Для каждого элемента в self, возвращает копию со удаленными хвостовыми символами.
searchsorted(v[, side, sorter]) Найти индексы, где элементы v должны быть вставлены в a, чтобы сохранить порядок.
setfield(val, dtype[, offset]) Поместить значение в указанное место в поле, определённом типом данных.
setflags([write, align, uic]) Установить флаги массива WRITEABLE, ALIGNED и UPDATEIFCOPY, соответственно.
sort([axis, kind, order]) Сортировать массив на месте.
split([sep, maxsplit]) Для каждого элемента в self, возвращает список слов в строке, используя sep в качестве разделителя.
splitlines([keepends]) Для каждого элемента в self, возвращает список строк в элементе, разделяя по границам строк.
squeeze([axis]) Удалить одноразмерные записи из формы a.
startswith(prefix[, start, end]) Возвращает булевый массив, который равен True, если строковый элемент в self начинается с prefix, иначе False.
strip([chars]) Для каждого элемента в self, возвращает копию с удаленными начальными и конечными символами.
swapaxes(axis1, axis2) Возвращает представление массива с переставленными осями axis1 и axis2.
swapcase() Для каждого элемента в self, возвращает копию строки с заглавными буквами, преобразованными в строчные, и наоборот.
take(indices[, axis, out, mode]) Возвращает массив, составленный из элементов a в заданных индексах.
title() Для каждого элемента в self, возвращает строку в стиле заголовка: слова начинаются с заглавных букв, остальные — строчные.
tofile(fid[, sep, format]) Записать массив в файл в виде текста или двоичного (по умолчанию).
tolist() Возвращает массив в виде (возможно, вложенного) списка.
tostring([order]) Создать Python-байты, содержащие сырые байты данных в массиве.
translate(table[, deletechars]) Для каждого элемента в self, возвращает копию строки, где все символы, присутствующие в необязательном аргументе deletechars, удалены, а оставшиеся символы отображены через заданную таблицу преобразования.
transpose(*axes) Возвращает представление массива с переставленными осями.
upper() Возвращает массив с элементами self, преобразованными в верхний регистр.
view([dtype, type]) Новое представление массива с теми же данными.
zfill(width) Возвращает числовую строку, дополненную нулями слева в строке длиной width.
argsort

© 2008–2017 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.12.0/reference/generated/numpy.chararray.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API