Spec-Zone.ru › TensorFlow 2.4

tf.audio.decode_wav

Декодирование 16-битного PCM WAV-файла в тензор с плавающей точкой.

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения более подробной информации.

tf.compat.v1.audio.decode_wav

tf.audio.decode_wav(
    contents, desired_channels=-1, desired_samples=-1, name=None
)

Значения со знаком от -32768 до 32767 будут масштабированы до -1,0 до 1,0 в формате с плавающей точкой.

При установке desired_channels, если вход содержит меньше каналов, чем указано, то последний канал будет дублирован для обеспечения требуемого числа, иначе, если вход содержит больше каналов, чем требуется, то дополнительные каналы будут проигнорированы.

Если задано desired_samples, то аудио будет обрезано или дополнено нулями до требуемой длины.

Первый вывод содержит тензор с содержимым аудио-образцов. Самая низкая размерность будет представлять количество каналов, а вторая — количество образцов. Например, стерео WAV-файл длиной десять образцов должен давать форму вывода [10, 2].

Аргументы
contents Tensor типа string. Аудио в WAV-формате, обычно из файла.
desired_channels Необязательное int. По умолчанию -1. Количество требуемых каналов образцов.
desired_samples Необязательная int. По умолчанию -1. Требуемая длина аудио.
name Имя операции (необязательно).
Возвращаемые значения
Кортеж объектов Tensor (аудио, частота_дискретизации).
audio Tensor типа float32.
sample_rate Tensor типа int32.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/audio/decode_wav

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API