start-speech-synthesis-task
Описание
Разрешает создание асинхронной задачи синтеза речи, запуская новую SpeechSynthesisTask . Для этой операции требуется вся стандартная информация, необходимая для синтеза речи, плюс имя ведра Amazon S3 для хранения результата задачи синтеза, а также два необязательных параметра (OutputS3KeyPrefix и SnsTopicArn ). После создания задачи синтеза эта операция вернёт объект SpeechSynthesisTask , который будет включать идентификатор этой задачи и текущий статус. Объект SpeechSynthesisTask доступен в течение 72 часов после запуска асинхронной задачи синтеза.
См. также: Документация API AWS
Синтаксис
start-speech-synthesis-task
[--engine <value>]
[--language-code <value>]
[--lexicon-names <value>]
--output-format <value>
--output-s3-bucket-name <value>
[--output-s3-key-prefix <value>]
[--sample-rate <value>]
[--sns-topic-arn <value>]
[--speech-mark-types <value>]
--text <value>
[--text-type <value>]
--voice-id <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--engine (строка)
Указывает движок (standard , neural , long-form или generative ), который Amazon Polly должен использовать при обработке входного текста для синтеза речи. Использование голоса, который не поддерживается выбранным движком, приведёт к ошибке.
Возможные значения:
standardneurallong-formgenerative
--language-code (строка)
Необязательный код языка для запроса синтеза речи. Это необходимо только при использовании двуязычного голоса, такого как Aditi, который может использоваться для индийского английского языка (en-IN) или хинди (hi-IN).
Если используется двуязычный голос и код языка не указан, Amazon Polly использует язык по умолчанию для двуязычного голоса. Язык по умолчанию для любого голоса — тот, который возвращается операцией DescribeVoices для параметра LanguageCode. Например, если код языка не указан, Aditi будет использовать индийский английский, а не хинди.
Возможные значения:
arbcmn-CNcy-GBda-DKde-DEen-AUen-GBen-GB-WLSen-INen-USes-ESes-MXes-USfr-CAfr-FRis-ISit-ITja-JPhi-INko-KRnb-NOnl-NLpl-PLpt-BRpt-PTro-ROru-RUsv-SEtr-TRen-NZen-ZAca-ESde-ATyue-CNar-AEfi-FIen-IEnl-BEfr-BEcs-CZde-CHen-SG
--lexicon-names (список)
Список одного или нескольких имен лексиконов произношения, которые вы хотите использовать при синтезе. Лексиконы применяются только в том случае, если язык лексикона совпадает с языком голоса.
(строка)
Синтаксис:
"string" "string" ...
--output-format (строка)
Формат, в котором будет закодирован возвращаемый результат. Для аудиопотока это будет mp3, ogg_vorbis или pcm. Для текстовых меток — json.
Возможные значения:
jsonmp3ogg_vorbispcm
--output-s3-bucket-name (строка)
--output-s3-key-prefix (строка)
--sample-rate (строка)
Частота аудиосигнала, указанная в Гц.
Допустимые значения для mp3 и ogg_vorbis — “8000”, “16000”, “22050” и “24000”. Значение по умолчанию для стандартных голосов — “22050”. Значение по умолчанию для нейронных голосов — “24000”. Значение по умолчанию для голосов для длинных форм — “24000”. Значение по умолчанию для генеративных голосов — “24000”.
Допустимые значения для pcm — “8000” и “16000”. Значение по умолчанию — “16000”.
--sns-topic-arn (строка)
--speech-mark-types (список)
Тип текстовых меток, возвращаемых для входного текста.
(строка)
Синтаксис:
"string" "string" ...
Where valid values are:
sentence
ssml
viseme
word
--text (строка)
--text-type (строка)
Указывает, является ли входной текст обычным текстом или SSML. Значение по умолчанию — обычный текст.
Возможные значения:
ssmltext
--voice-id (строка)
Идентификатор голоса для использования при синтезе.
Возможные значения:
AditiAmyAstridBiancaBrianCamilaCarlaCarmenCelineChantalConchitaCristianoDoraEmmaEnriqueEwaFilizGabrielleGeraintGiorgioGwynethHansInesIvyJacekJanJoannaJoeyJustinKarlKendraKevinKimberlyLeaLivLotteLuciaLupeMadsMajaMarleneMathieuMatthewMaximMiaMiguelMizukiNajaNicoleOliviaPenelopeRaveenaRicardoRubenRussellSalliSeoyeonTakumiTatyanaVickiVitoriaZeinaZhiyuAriaAyandaArletHannahArthurDanielLiamPedroKajalHiujinLauraElinIdaSuviOlaHalaAndresSergioRemiAdrianoThiagoRuthStephenKazuhaTomokoNiamhSofieLisaIsabelleZaydDanielleGregoryBurcuJitkaSabrinaJasmineJihye
--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному в --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные JSON-строкой. Невозможно передать произвольные двоичные значения с помощью значения JSON-строки, так как строка будет интерпретирована буквально. Это может не быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если предоставлено значение null или input , выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено значение yaml-input, будет выведен пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, проверяются входные данные команды и возвращается пример выходного JSON для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.
Глобальные параметры
--debug (boolean)
Включить отладочную регистрацию.
--endpoint-url (string)
Переопределить URL команды заданным URL.
--no-verify-ssl (boolean)
По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI проверит SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.
--no-paginate (boolean)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (string)
Стиль форматирования вывода команды.
- json
- text
- table
- yaml
- yaml-stream
--query (string)
Запрос JMESPath для фильтрации данных ответа.
--profile (string)
Использовать определённый профиль из файла учетных данных.
--region (string)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (string)
Отобразить версию этого инструмента.
--color (string)
Включить/выключить цветной вывод.
- on
- off
- auto
--no-sign-request (boolean)
Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент указан.
--ca-bundle (string)
Файл сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (int)
Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию - 60 секунд.
--cli-connect-timeout (int)
Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию - 60 секунд.
--cli-binary-format (string)
Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию - base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны быть переданы буквально. При предоставлении содержимого из файла, соответствующего двоичному блоку, fileb:// всегда будет рассматриваться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (boolean)
Отключить пейджер cli для вывода.
--cli-auto-prompt (boolean)
Автоматически запрашивать параметры входных данных CLI.
--no-cli-auto-prompt (boolean)
Отключить автоматическое запроса параметров входных данных CLI.
Примеры
Примечание
Для использования следующих примеров, у вас должна быть установлена и настроена AWS CLI. Подробнее см. руководство по началу работы в руководстве пользователя AWS CLI.
Если не указано иное, все примеры используют правила цитирования в стиле Unix. Эти примеры нужно адаптировать к правилам цитирования вашей оболочки. См. Использование кавычек со строками в руководстве пользователя AWS CLI.
Для синтеза текста
Следующий start-speech-synthesis-task пример синтезирует текст в text_file.txt и сохраняет полученный MP3-файл в указанном ведре.
aws polly start-speech-synthesis-task \
--output-format mp3 \
--output-s3-bucket-name amzn-s3-demo-bucket \
--text file://text_file.txt \
--voice-id Joanna
Вывод:
{
"SynthesisTask": {
"TaskId": "70b61c0f-57ce-4715-a247-cae8729dcce9",
"TaskStatus": "scheduled",
"OutputUri": "https://s3.us-east-2.amazonaws.com/amzn-s3-demo-bucket/70b61c0f-57ce-4715-a247-cae8729dcce9.mp3",
"CreationTime": 1603911042.689,
"RequestCharacters": 1311,
"OutputFormat": "mp3",
"TextType": "text",
"VoiceId": "Joanna"
}
}
Для получения дополнительной информации, см. Создание файлов с длительным аудио в Руководстве разработчика Amazon Polly.
Вывод
SynthesisTask -> (структура)
Объект SynthesisTask, предоставляющий информацию и атрибуты о только что отправленной задаче синтеза речи.
Engine -> (строка)
standard, neural, long-form или generative) для использования Amazon Polly при обработке входного текста для синтеза речи. Использование голоса, который не поддерживается выбранным движком, приведет к ошибке.TaskId -> (строка)
TaskStatus -> (строка)
TaskStatusReason -> (строка)
OutputUri -> (строка)
CreationTime -> (метка времени)
RequestCharacters -> (целое число)
SnsTopicArn -> (строка)
LexiconNames -> (список)
Список одного или нескольких имен словарей произношения, которые вы хотите применить в процессе синтеза. Словари применяются только в том случае, если язык словаря совпадает с языком голоса.
(строка)
OutputFormat -> (строка)
SampleRate -> (строка)
Частота дискретизации, указанная в Гц.
Допустимые значения для mp3 и ogg_vorbis - “8000”, “16000”, “22050” и “24000”. Значение по умолчанию для стандартных голосов - “22050”. Значение по умолчанию для нейронных голосов - “24000”. Значение по умолчанию для голосов для длинных форм - “24000”. Значение по умолчанию для генеративных голосов - “24000”.
Допустимые значения для pcm - “8000” и “16000”. Значение по умолчанию - “16000”.
SpeechMarkTypes -> (список)
Тип меток речи, возвращаемых для входного текста.
(строка)
TextType -> (строка)
VoiceId -> (строка)
LanguageCode -> (строка)
Необязательный код языка для задачи синтеза. Это необходимо только при использовании двуязычного голоса, такого как Aditi, который может использоваться для английского языка в Индии (en-IN) или хинди (hi-IN).
Если используется двуязычный голос и код языка не указан, Amazon Polly использует язык по умолчанию для двуязычного голоса. Язык по умолчанию для любого голоса - тот, который возвращается операцией DescribeVoices для параметра LanguageCode. Например, если код языка не указан, Aditi будет использовать индийский английский, а не хинди.
© Copyright 2025, Amazon Web Services. Created using Sphinx.