tf.contrib.ffmpeg.decode_audio
Создать операцию, которая декодирует содержимое аудиофайла. (устарело)
tf.contrib.ffmpeg.decode_audio(
contents, file_format=None, samples_per_second=None, channel_count=None,
stream=None
)
Обратите внимание, что ffmpeg свободен в выборе «лучшего» аудиотрека из mp4. https://trac.ffmpeg.org/wiki/Map
| Аргументы | |
|---|---|
contents | Двоичное содержимое аудиофайла для декодирования. Это скаляр. |
file_format | Строка или скалярный тензор строки, определяющий формат, которому соответствует содержимое. Это может быть mp3, mp4, ogg или wav. |
int | Количество выборок в секунду, предполагаемое в виде int или скалярного int32 тензора. В некоторых случаях произойдёт пересэмплирование для генерации правильной частоты дискретизации. |
channel_count | Количество каналов, которое должно быть создано из аудиосодержимого, как int или скалярный int32 тензор. Если в contents содержится больше каналов, то некоторые из них будут объединены или удалены. Если contents содержит меньше каналов, чем указано, то дополнительные каналы будут созданы из существующих. |
stream | Строка, определяющая, какой поток из файла содержимого должен быть декодирован, например, '0' означает 0-й поток. Значение по умолчанию — '' (пустая строка), что оставляет решение ffmpeg. |
| Возвращаемое значение | |
|---|---|
Тензор ранга 2, имеющий время по размеру 0 и каналы по размеру 1. Размер 0 будет samples_per_second * length_in_seconds широким, а размер 1 будет channel_count широким. Если ffmpeg не сможет декодировать аудио, то будет возвращен пустой тензор. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/contrib/ffmpeg/decode_audio