tf.audio.decode_wav
Декодирование 16-битного PCM WAV-файла в тензор с плавающей точкой.
tf.audio.decode_wav(
contents, desired_channels=-1, desired_samples=-1, name=None
)
Значения со знаком от -32768 до 32767 будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.
При установке desired_channels, если вход содержит меньше каналов, чем указано, то последний канал будет дублирован для обеспечения требуемого числа, иначе, если вход содержит больше каналов, чем требуется, то дополнительные каналы будут проигнорированы.
Если задано desired_samples, то аудио будет обрезано или дополнено нулями до требуемой длины.
Первый вывод содержит тензор с содержимым аудио-образцов. Самая низкая размерность будет представлять количество каналов, а вторая — количество образцов. Например, стерео WAV-файл длиной десять образцов должен давать форму вывода [10, 2].
| Аргументы | |
|---|---|
contents | Tensor типа string. Аудио в WAV-формате, обычно из файла. |
desired_channels | Необязательное int. По умолчанию -1. Количество требуемых каналов образцов. |
desired_samples | Необязательная int. По умолчанию -1. Требуемая длина аудио. |
name | Имя операции (необязательно). |
| Возвращаемые значения | |
|---|---|
Кортеж объектов Tensor (аудио, частота_дискретизации). | |
audio | Tensor типа float32. |
sample_rate | Tensor типа int32. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/audio/decode_wav