tf.string_split
Разделение элементов source по delimiter. (устаревшие аргументы)
tf.string_split(
source, sep=None, skip_empty=True, delimiter=None, result_type='SparseTensor',
name=None
)
Пусть N — размер source (обычно N будет размером пакета). Разделите каждый элемент source по delimiter и верните SparseTensor или RaggedTensor, содержащие разделительные токены. Пустые токены игнорируются.
Если sep является пустой строкой, каждый элемент source разделяется на отдельные строки, каждая из которых содержит один байт. (Это включает разделение многобайтовых последовательностей UTF-8). Если разделитель содержит несколько байтов, он обрабатывается как набор разделителей, каждый из которых рассматривается как потенциальная точка разбиения.
Примеры:
tf.strings.split(['hello world', 'a b c'])
tf.SparseTensor(indices=[[0, 0], [0, 1], [1, 0], [1, 1], [1, 2]],
values=['hello', 'world', 'a', 'b', 'c']
dense_shape=[2, 3])
tf.strings.split(['hello world', 'a b c'], result_type="RaggedTensor")
| Args | |
|---|---|
source | 1-D строка Tensor, строки для разделения. |
sep | 0-D строка Tensor, символ-разделитель, длина строки должна быть 0 или 1. По умолчанию ' '. |
skip_empty | bool. Если True, пустые строки из результата пропускаются. |
delimiter | устаревший псевдоним для sep. |
result_type | Тип тензора для результата: один из "RaggedTensor" или "SparseTensor". |
name | Имя операции (необязательно). |
| Raises | |
|---|---|
ValueError | Если разделитель не является строкой. |
| Returns | |
|---|---|
SparseTensor или RaggedTensor ранга 2, строки, разделенные по разделителю. Первый столбец индексов соответствует строке в source, а второй — индексу компонента разбиения в этой строке. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/string_split