Spec-Zone.ru › TensorFlow 1.15

tf.audio.decode_wav

Декодирование 16-битного PCM WAV-файла в тензор с плавающей точкой.

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения дополнительных сведений.

tf.compat.v1.audio.decode_wav, `tf.compat.v2.audio.decode_wav`

tf.audio.decode_wav(
    contents, desired_channels=-1, desired_samples=-1, name=None
)

Значения с сигнатурой от -32768 до 32767 в формате 16 бит будут масштабированы до -1.0 до 1.0 в формате с плавающей точкой.

При установке параметра desired_channels, если вход содержит меньше каналов, чем указано, последний канал будет дублирован, чтобы обеспечить требуемое количество; в противном случае, если вход содержит больше каналов, чем запрошено, дополнительные каналы будут проигнорированы.

Если установлен параметр desired_samples, аудио будет обрезано или дополнено нулями до запрошенной длины.

Первый вывод содержит тензор с содержимым аудио-сэмплов. Самая младшая размерность будет представлять количество каналов, а вторая — количество сэмплов. Например, стерео WAV-файл длиной десять сэмплов должен дать форму вывода [10, 2].

Аргументы
contents Tensor типа string. Аудио в формате WAV, обычно из файла.
desired_channels Необязательный int. По умолчанию -1. Требуемое количество каналов сэмплов.
desired_samples Необязательная int. По умолчанию -1. Запрошенная длина аудио.
name Имя операции (необязательно).
Возвращаемые значения
Кортеж объектов Tensor (аудио, частота_сэмплов).
audio Tensor типа float32.
sample_rate Tensor типа int32.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r1.15/api_docs/python/tf/audio/decode_wav

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API