tf.strings.split
| Просмотреть исходный код на GitHub |
Разделяет элементы input по sep в RaggedTensor.
tf.strings.split(
input, sep=None, maxsplit=-1, name=None
)
Пусть N – размер input (обычно N – размер пакета). Разделяет каждый элемент input по sep и возвращает RaggedTensor, содержащий разделенные токены. Пустые токены игнорируются.
Пример:
tf.strings.split('hello world').numpy()
array([b'hello', b'world'], dtype=object)
tf.strings.split(['hello world', 'a b c'])
<tf.RaggedTensor [[b'hello', b'world'], [b'a', b'b', b'c']]>
Если sep задан, последовательные разделители не группируются вместе и считаются разделителями пустых строк. Например, input от "1<>2<><>3" и sep от "<>" возвращает ["1", "2", "", "3"]. Если sep равен None или пустой строке, последовательные пробелы рассматриваются как один разделитель, а результат не будет содержать пустых строк в начале или конце, если строка имеет начальные или конечные пробелы.
Обратите внимание, что упомянутое выше поведение соответствует поведению python's str.split.
| Аргументы | |
|---|---|
input | Строка Tensor ранга N, строки для разделения. Если rank(input) статически неизвестно, предполагается, что это 1. |
sep | Разделительная строка 0-D Tensor. |
maxsplit | int. Если maxsplit > 0, предел разделения результата. |
name | Имя операции (необязательно). |
| Возможные исключения | |
|---|---|
ValueError | Если sep не является строкой. |
| Возвращаемое значение | |
|---|---|
RaggedTensor ранга N+1, строки, разделенные по разделителю. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/strings/split