Spec-Zone.ru › TensorFlow 2.3

tf.audio.decode_wav

Декодирование 16-битного PCM WAV файла в тензор с плавающей точкой.

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения дополнительной информации.

tf.compat.v1.audio.decode_wav

tf.audio.decode_wav(
    contents, desired_channels=-1, desired_samples=-1, name=None
)

Значения со знаком от -32768 до 32767 будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.

Если задано значение desired_channels, то если вход содержит меньше каналов, чем это значение, последний канал будет дублирован для получения требуемого числа каналов. Если вход содержит больше каналов, чем требуется, дополнительные каналы будут проигнорированы.

Если задано значение desired_samples, то аудио будет усечено или дополнено нулями до запрошенной длины.

Первый результат содержит тензор с содержимым аудио-образцов. Самая низкая размерность будет представлять количество каналов, а вторая — количество образцов. Например, стерео WAV файл длиной десять образцов должен дать форму вывода [10, 2].

Аргументы
contents Tensor типа string. Аудио в WAV формате, обычно из файла.
desired_channels Необязательное значение. По умолчанию -1. Количество требуемых каналов образцов.
desired_samples Необязательное значение. По умолчанию -1. Требуемая длина аудио.
name Имя операции (необязательно).
Возвращаемые значения
Кортеж объектов Tensor (audio, sample_rate).
audio Tensor типа float32.
sample_rate Tensor типа int32.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/audio/decode_wav

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API