tf.raw_ops.DecodeWav
Декодирование 16-битного PCM WAV-файла в тензор с плавающей точкой.
tf.raw_ops.DecodeWav(
contents, desired_channels=-1, desired_samples=-1, name=None
)
Значения со знаком от -32768 до 32767 16-битного формата будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.
При заданном значении desired_channels, если входной файл содержит меньше каналов, то последний канал будет дублирован для достижения заданного числа. В противном случае, если входной файл содержит больше каналов, чем запрошенных, дополнительные каналы будут проигнорированы.
Если задано desired_samples, то аудио будет усечено или дополнено нулями до требуемой длины.
Первый вывод содержит тензор с содержимым аудио-сэмплов. Самая низкая размерность будет представлять количество каналов, а вторая - количество сэмплов. Например, стерео WAV-файл длиной в десять сэмплов должен привести к форме вывода [10, 2].
| Аргументы | |
|---|---|
contents | A Tensor типа string. Аудио в WAV формате, обычно из файла. |
desired_channels | Необязательный int. По умолчанию -1. Количество каналов сэмплов. |
desired_samples | Необязательный int. По умолчанию -1. Запрашиваемая длина аудио. |
name | Имя операции (необязательно). |
| Возвращаемое значение | |
|---|---|
Кортеж объектов Tensor (аудио, частота_сэмплирования). | |
audio | A Tensor типа float32. |
sample_rate | A Tensor типа int32. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/api_docs/python/tf/raw_ops/DecodeWav