tf.raw_ops.DecodeWav
Декодировать 16-битный PCM WAV-файл в тензор с плавающей точкой.
tf.raw_ops.DecodeWav(
contents, desired_channels=-1, desired_samples=-1, name=None
)
Значения со знаком от -32768 до 32767 в 16-битном формате будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.
При установке значения `desired_channels`, если вход содержит меньше каналов, чем указано, последний канал будет дублирован для достижения требуемого количества. В противном случае, если вход содержит больше каналов, чем требуется, дополнительные каналы будут проигнорированы.
Если установлено значение `desired_samples`, аудио будет усечено или дополнено нулями до требуемой длины.
Первый вывод содержит тензор с содержимым аудиообразцов. Самая низкая размерность будет представлять количество каналов, а вторая – количество образцов. Например, стерео WAV-файл длиной десять образцов должен давать форму вывода [10, 2].
| Аргументы | |
|---|---|
contents | Tensor типа string. Аудио в формате WAV, обычно из файла. |
desired_channels | Необязательный int. По умолчанию -1. Требуемое количество каналов выборки. |
desired_samples | Необязательная int. По умолчанию -1. Требуемая длина аудио. |
name | Название операции (необязательно). |
| Возвращаемые значения | |
|---|---|
Кортеж из Tensor объектов (audio, sample_rate). | |
audio | Tensor типа float32. |
sample_rate | Tensor типа int32. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/raw_ops/DecodeWav