synthesize-speech
Описание
Преобразует входные данные UTF-8, обычный текст или SSML, в поток байтов. Входные данные SSML должны быть валидными и правильно сформированными данными SSML. Некоторые алфавиты могут быть недоступны для всех голосов (например, кириллица может вообще не читаться голосами на английском языке), если не используется сопоставление фонем. Дополнительную информацию см. в разделе Как это работает .
См. также: Документацию API AWS
Синтаксис
synthesize-speech
[--engine <value>]
[--language-code <value>]
[--lexicon-names <value>]
--output-format <value>
[--sample-rate <value>]
[--speech-mark-types <value>]
--text <value>
[--text-type <value>]
--voice-id <value>
<outfile>
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--engine (строка)
Указывает движок (standard , neural , long-form или generative), который Amazon Polly будет использовать при обработке входного текста для синтеза речи. Укажите движок, поддерживаемый выбранным голосом. Если движок не указан, используется стандартный движок по умолчанию. Если выбранный голос не поддерживается стандартным движком, это приведёт к ошибке. Информацию о голосах Amazon Polly и доступных голосах для каждого движка см. в разделе Доступные голоса .
Тип: Строка
Допустимые значения: standard | neural | long-form | generative
Обязательный: Да
Возможные значения:
standardneurallong-formgenerative
--language-code (строка)
Необязательный код языка для запроса Synthesize Speech. Это необходимо только при использовании двуязычных голосов, таких как Aditi, которые могут использоваться для индийского английского языка (en-IN) или хинди (hi-IN).
Если используется двуязычный голос, и код языка не указан, Amazon Polly использует язык по умолчанию для двуязычного голоса. Язык по умолчанию для любого голоса — тот, который возвращается операцией DescribeVoices для параметра LanguageCode. Например, если код языка не указан, Aditi будет использовать индийский английский, а не хинди.
Возможные значения:
arbcmn-CNcy-GBda-DKde-DEen-AUen-GBen-GB-WLSen-INen-USes-ESes-MXes-USfr-CAfr-FRis-ISit-ITja-JPhi-INko-KRnb-NOnl-NLpl-PLpt-BRpt-PTro-ROru-RUsv-SEtr-TRen-NZen-ZAca-ESde-ATyue-CNar-AEfi-FIen-IEnl-BEfr-BEcs-CZde-CHen-SG
--lexicon-names (список)
Список одного или нескольких названий словарей произношения, которые вы хотите, чтобы служба использовала во время синтеза. Словари применяются только в том случае, если язык словаря совпадает с языком голоса. Информацию о хранении словарей см. в разделе PutLexicon .
(строка)
Синтаксис:
"string" "string" ...
--output-format (строка)
Формат, в котором будет закодирован возвращаемый результат. Для потока аудио это будет mp3, ogg_vorbis или pcm. Для меток речи это будет json.
При использовании pcm возвращаемое содержимое представляет собой аудио/pcm в формате со знаком 16 бит, 1 канал (моно), little-endian.
Возможные значения:
jsonmp3ogg_vorbispcm
--sample-rate (строка)
Частота аудио в Гц.
Допустимые значения для mp3 и ogg_vorbis — “8000”, “16000”, “22050” и “24000”. Значение по умолчанию для стандартных голосов — “22050”. Значение по умолчанию для нейронных голосов — “24000”. Значение по умолчанию для голосов для длинных форм — “24000”. Значение по умолчанию для генеративных голосов — “24000”.
Допустимые значения для pcm — “8000” и “16000”. Значение по умолчанию — “16000”.
--speech-mark-types (список)
Тип меток речи, возвращаемых для входного текста.
(строка)
Синтаксис:
"string" "string" ...
Where valid values are:
sentence
ssml
viseme
word
--text (строка)
ssml как TextType , следуйте формату SSML для входного текста.--text-type (строка)
Указывает, является ли входной текст обычным текстом или SSML. Значение по умолчанию — обычный текст. Дополнительную информацию см. в разделе Использование SSML .
Возможные значения:
ssmltext
--voice-id (строка)
Идентификатор голоса для синтеза. Список доступных идентификаторов голосов можно получить, вызвав операцию DescribeVoices.
Возможные значения:
AditiAmyAstridBiancaBrianCamilaCarlaCarmenCelineChantalConchitaCristianoDoraEmmaEnriqueEwaFilizGabrielleGeraintGiorgioGwynethHansInesIvyJacekJanJoannaJoeyJustinKarlKendraKevinKimberlyLeaLivLotteLuciaLupeMadsMajaMarleneMathieuMatthewMaximMiaMiguelMizukiNajaNicoleOliviaPenelopeRaveenaRicardoRubenRussellSalliSeoyeonTakumiTatyanaVickiVitoriaZeinaZhiyuAriaAyandaArletHannahArthurDanielLiamPedroKajalHiujinLauraElinIdaSuviOlaHalaAndresSergioRemiAdrianoThiagoRuthStephenKazuhaTomokoNiamhSofieLisaIsabelleZaydDanielleGregoryBurcuJitkaSabrinaJasmineJihye
outfile (строка) Имя файла, в который будет сохранено содержимое
Общие параметры
--debug (boolean)
Включить отладочную регистрацию.
--endpoint-url (string)
Переопределить URL по умолчанию команды заданным URL.
--no-verify-ssl (boolean)
По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого подключения SSL AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет поведение проверки сертификатов SSL по умолчанию.
--no-paginate (boolean)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (string)
Стиль форматирования вывода команды.
- json
- text
- table
- yaml
- yaml-stream
--query (string)
Запрос JMESPath для фильтрации данных ответа.
--profile (string)
Использование определенного профиля из файла учетных данных.
--region (string)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (string)
Отображение версии этого инструмента.
--color (string)
Включение/выключение цветного вывода.
- on
- off
- auto
--no-sign-request (boolean)
Не подписывать запросы. Учетные данные не будут загружаться, если этот аргумент предоставлен.
--ca-bundle (string)
Файл с корневым сертификатом для проверки сертификатов SSL. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (int)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-connect-timeout (int)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-binary-format (string)
Стиль форматирования, используемый для двоичных блоков. По умолчанию используется формат base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, которое соответствует двоичному блоку fileb:// всегда будет обрабатываться как двоичное и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (boolean)
Отключить вывод страницы CLI.
--cli-auto-prompt (boolean)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (boolean)
Отключить автоматическую запрос параметров ввода CLI.
Вывод
AudioStream -> (потоковый блок)
ContentType -> (строка)
Указывает тип аудиопотока. Это должно соответствовать параметру OutputFormat в вашем запросе.
- Если вы запросили
mp3в качествеOutputFormat, возвращаемыйContentType— audio/mpeg. - Если вы запросили
ogg_vorbisв качествеOutputFormat, возвращаемыйContentType— audio/ogg. - Если вы запросили
pcmв качествеOutputFormat, возвращаемыйContentType— audio/pcm в формате со знаком 16 бит, 1 канал (моно), little-endian. - Если вы запросили
jsonв качествеOutputFormat, возвращаемыйContentType— application/x-json-stream.
RequestCharacters -> (целое число)
© Copyright 2025, Amazon Web Services. Created using Sphinx.