tf.audio.decode_wav
Декодирование 16-битного PCM-файла WAV в тензор с плавающей точкой.
tf.audio.decode_wav(
contents: Annotated[Any, _atypes.String],
desired_channels: int = -1,
desired_samples: int = -1,
name=None
)
Использование в ноутбуках
| Используется в учебниках |
|---|
Значения со знаком от -32768 до 32767 с 16 битами будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.
При установке desired_channels, если вход содержит меньше каналов, чем это значение, последний канал будет дублирован, чтобы получить нужное количество. В противном случае, если вход содержит больше каналов, чем требуется, дополнительные каналы будут проигнорированы.
Если установлено desired_samples, аудио будет усечено или дополнено нулями до запрошенной длины.
Первый выход содержит тензор с содержимым аудио-образцов. Самая низкая размерность будет представлять количество каналов, а вторая – количество образцов. Например, стереофайл WAV длиной в десять образцов должен дать форму выходных данных [10, 2].
| Аргументы | |
|---|---|
contents | Tensor типа string. Аудио WAV в кодированном виде, обычно из файла. |
desired_channels | Необязательный int. По умолчанию -1. Количество каналов образцов, необходимых для обработки. |
desired_samples | Необязательная int. По умолчанию -1. Запрошенная длина аудио. |
name | Имя операции (необязательно). |
| Возвращаемые значения | |
|---|---|
Кортеж объектов Tensor (аудио, частота_дискретизации). | |
audio | Tensor типа float32. |
sample_rate | Tensor типа int32. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/api_docs/python/tf/audio/decode_wav