tf.audio.decode_wav
Декодирование 16-битного PCM WAV файла в тензор с плавающей точкой.
tf.audio.decode_wav(
contents, desired_channels=-1, desired_samples=-1, name=None
)
Значения со знаком от -32768 до 32767 будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.
Если задано значение desired_channels, то если вход содержит меньше каналов, чем это значение, последний канал будет дублирован для получения требуемого числа каналов. Если вход содержит больше каналов, чем требуется, дополнительные каналы будут проигнорированы.
Если задано значение desired_samples, то аудио будет усечено или дополнено нулями до запрошенной длины.
Первый результат содержит тензор с содержимым аудио-образцов. Самая низкая размерность будет представлять количество каналов, а вторая — количество образцов. Например, стерео WAV файл длиной десять образцов должен дать форму вывода [10, 2].
| Аргументы | |
|---|---|
contents | Tensor типа string. Аудио в WAV формате, обычно из файла. |
desired_channels | Необязательное значение. По умолчанию -1. Количество требуемых каналов образцов. |
desired_samples | Необязательное значение. По умолчанию -1. Требуемая длина аудио. |
name | Имя операции (необязательно). |
| Возвращаемые значения | |
|---|---|
Кортеж объектов Tensor (audio, sample_rate). | |
audio | Tensor типа float32. |
sample_rate | Tensor типа int32. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/audio/decode_wav