Spec-Zone.ru › AWS CLI v2

[ aws . полли ]

start-speech-synthesis-task

Описание

Разрешает создание асинхронной задачи синтеза речи, запуская новую SpeechSynthesisTask . Для этой операции требуется вся стандартная информация, необходимая для синтеза речи, плюс имя ведра Amazon S3 для хранения результата задачи синтеза, а также два необязательных параметра (OutputS3KeyPrefix и SnsTopicArn ). После создания задачи синтеза эта операция вернёт объект SpeechSynthesisTask , который будет включать идентификатор этой задачи и текущий статус. Объект SpeechSynthesisTask доступен в течение 72 часов после запуска асинхронной задачи синтеза.

См. также: Документация API AWS

Синтаксис

  start-speech-synthesis-task
[--engine <value>]
[--language-code <value>]
[--lexicon-names <value>]
--output-format <value>
--output-s3-bucket-name <value>
[--output-s3-key-prefix <value>]
[--sample-rate <value>]
[--sns-topic-arn <value>]
[--speech-mark-types <value>]
--text <value>
[--text-type <value>]
--voice-id <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--engine (строка)

Указывает движок (standard , neural , long-form или generative ), который Amazon Polly должен использовать при обработке входного текста для синтеза речи. Использование голоса, который не поддерживается выбранным движком, приведёт к ошибке.

Возможные значения:

  • standard
  • neural
  • long-form
  • generative

--language-code (строка)

Необязательный код языка для запроса синтеза речи. Это необходимо только при использовании двуязычного голоса, такого как Aditi, который может использоваться для индийского английского языка (en-IN) или хинди (hi-IN).

Если используется двуязычный голос и код языка не указан, Amazon Polly использует язык по умолчанию для двуязычного голоса. Язык по умолчанию для любого голоса — тот, который возвращается операцией DescribeVoices для параметра LanguageCode. Например, если код языка не указан, Aditi будет использовать индийский английский, а не хинди.

Возможные значения:

  • arb
  • cmn-CN
  • cy-GB
  • da-DK
  • de-DE
  • en-AU
  • en-GB
  • en-GB-WLS
  • en-IN
  • en-US
  • es-ES
  • es-MX
  • es-US
  • fr-CA
  • fr-FR
  • is-IS
  • it-IT
  • ja-JP
  • hi-IN
  • ko-KR
  • nb-NO
  • nl-NL
  • pl-PL
  • pt-BR
  • pt-PT
  • ro-RO
  • ru-RU
  • sv-SE
  • tr-TR
  • en-NZ
  • en-ZA
  • ca-ES
  • de-AT
  • yue-CN
  • ar-AE
  • fi-FI
  • en-IE
  • nl-BE
  • fr-BE
  • cs-CZ
  • de-CH
  • en-SG

--lexicon-names (список)

Список одного или нескольких имен лексиконов произношения, которые вы хотите использовать при синтезе. Лексиконы применяются только в том случае, если язык лексикона совпадает с языком голоса.

(строка)

Синтаксис:

"string" "string" ...

--output-format (строка)

Формат, в котором будет закодирован возвращаемый результат. Для аудиопотока это будет mp3, ogg_vorbis или pcm. Для текстовых меток — json.

Возможные значения:

  • json
  • mp3
  • ogg_vorbis
  • pcm

--output-s3-bucket-name (строка)

Имя ведра Amazon S3, в которое будет сохранён выходной файл.

--output-s3-key-prefix (строка)

Префикс ключа Amazon S3 для выходного файла речи.

--sample-rate (строка)

Частота аудиосигнала, указанная в Гц.

Допустимые значения для mp3 и ogg_vorbis — “8000”, “16000”, “22050” и “24000”. Значение по умолчанию для стандартных голосов — “22050”. Значение по умолчанию для нейронных голосов — “24000”. Значение по умолчанию для голосов для длинных форм — “24000”. Значение по умолчанию для генеративных голосов — “24000”.

Допустимые значения для pcm — “8000” и “16000”. Значение по умолчанию — “16000”.

--sns-topic-arn (строка)

ARN для темы SNS, которая используется для отправки уведомлений о статусе задачи синтеза речи.

--speech-mark-types (список)

Тип текстовых меток, возвращаемых для входного текста.

(строка)

Синтаксис:

"string" "string" ...

Where valid values are:
  sentence
  ssml
  viseme
  word

--text (строка)

Входной текст для синтеза. Если вы укажете ssml в качестве TextType, используйте формат SSML для входного текста.

--text-type (строка)

Указывает, является ли входной текст обычным текстом или SSML. Значение по умолчанию — обычный текст.

Возможные значения:

  • ssml
  • text

--voice-id (строка)

Идентификатор голоса для использования при синтезе.

Возможные значения:

  • Aditi
  • Amy
  • Astrid
  • Bianca
  • Brian
  • Camila
  • Carla
  • Carmen
  • Celine
  • Chantal
  • Conchita
  • Cristiano
  • Dora
  • Emma
  • Enrique
  • Ewa
  • Filiz
  • Gabrielle
  • Geraint
  • Giorgio
  • Gwyneth
  • Hans
  • Ines
  • Ivy
  • Jacek
  • Jan
  • Joanna
  • Joey
  • Justin
  • Karl
  • Kendra
  • Kevin
  • Kimberly
  • Lea
  • Liv
  • Lotte
  • Lucia
  • Lupe
  • Mads
  • Maja
  • Marlene
  • Mathieu
  • Matthew
  • Maxim
  • Mia
  • Miguel
  • Mizuki
  • Naja
  • Nicole
  • Olivia
  • Penelope
  • Raveena
  • Ricardo
  • Ruben
  • Russell
  • Salli
  • Seoyeon
  • Takumi
  • Tatyana
  • Vicki
  • Vitoria
  • Zeina
  • Zhiyu
  • Aria
  • Ayanda
  • Arlet
  • Hannah
  • Arthur
  • Daniel
  • Liam
  • Pedro
  • Kajal
  • Hiujin
  • Laura
  • Elin
  • Ida
  • Suvi
  • Ola
  • Hala
  • Andres
  • Sergio
  • Remi
  • Adriano
  • Thiago
  • Ruth
  • Stephen
  • Kazuha
  • Tomoko
  • Niamh
  • Sofie
  • Lisa
  • Isabelle
  • Zayd
  • Danielle
  • Gregory
  • Burcu
  • Jitka
  • Sabrina
  • Jasmine
  • Jihye

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному в --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные JSON-строкой. Невозможно передать произвольные двоичные значения с помощью значения JSON-строки, так как строка будет интерпретирована буквально. Это может не быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если предоставлено значение null или input , выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено значение yaml-input, будет выведен пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, проверяются входные данные команды и возвращается пример выходного JSON для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.

Глобальные параметры

--debug (boolean)

Включить отладочную регистрацию.

--endpoint-url (string)

Переопределить URL команды заданным URL.

--no-verify-ssl (boolean)

По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI проверит SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.

--no-paginate (boolean)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (string)

Стиль форматирования вывода команды.

  • json
  • text
  • table
  • yaml
  • yaml-stream

--query (string)

Запрос JMESPath для фильтрации данных ответа.

--profile (string)

Использовать определённый профиль из файла учетных данных.

--region (string)

Регион для использования. Переопределяет настройки конфигурации/среды.

--version (string)

Отобразить версию этого инструмента.

--color (string)

Включить/выключить цветной вывод.

  • on
  • off
  • auto

--no-sign-request (boolean)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент указан.

--ca-bundle (string)

Файл сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки конфигурации/среды.

--cli-read-timeout (int)

Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию - 60 секунд.

--cli-connect-timeout (int)

Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию - 60 секунд.

--cli-binary-format (string)

Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию - base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны быть переданы буквально. При предоставлении содержимого из файла, соответствующего двоичному блоку, fileb:// всегда будет рассматриваться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (boolean)

Отключить пейджер cli для вывода.

--cli-auto-prompt (boolean)

Автоматически запрашивать параметры входных данных CLI.

--no-cli-auto-prompt (boolean)

Отключить автоматическое запроса параметров входных данных CLI.

Примеры

Примечание

Для использования следующих примеров, у вас должна быть установлена и настроена AWS CLI. Подробнее см. руководство по началу работы в руководстве пользователя AWS CLI.

Если не указано иное, все примеры используют правила цитирования в стиле Unix. Эти примеры нужно адаптировать к правилам цитирования вашей оболочки. См. Использование кавычек со строками в руководстве пользователя AWS CLI.

Для синтеза текста

Следующий start-speech-synthesis-task пример синтезирует текст в text_file.txt и сохраняет полученный MP3-файл в указанном ведре.

aws polly start-speech-synthesis-task \
    --output-format mp3 \
    --output-s3-bucket-name amzn-s3-demo-bucket \
    --text  file://text_file.txt \
    --voice-id Joanna

Вывод:

{
    "SynthesisTask": {
        "TaskId": "70b61c0f-57ce-4715-a247-cae8729dcce9",
        "TaskStatus": "scheduled",
        "OutputUri": "https://s3.us-east-2.amazonaws.com/amzn-s3-demo-bucket/70b61c0f-57ce-4715-a247-cae8729dcce9.mp3",
        "CreationTime": 1603911042.689,
        "RequestCharacters": 1311,
        "OutputFormat": "mp3",
        "TextType": "text",
        "VoiceId": "Joanna"
    }
}

Для получения дополнительной информации, см. Создание файлов с длительным аудио в Руководстве разработчика Amazon Polly.

Вывод

SynthesisTask -> (структура)

Объект SynthesisTask, предоставляющий информацию и атрибуты о только что отправленной задаче синтеза речи.

Engine -> (строка)

Указывает движок (standard, neural, long-form или generative) для использования Amazon Polly при обработке входного текста для синтеза речи. Использование голоса, который не поддерживается выбранным движком, приведет к ошибке.

TaskId -> (строка)

Идентификатор, сгенерированный Amazon Polly, для задачи синтеза речи.

TaskStatus -> (строка)

Текущий статус отдельной задачи синтеза речи.

TaskStatusReason -> (строка)

Причина текущего статуса конкретной задачи синтеза речи, включая ошибки, если задача завершилась неудачно.

OutputUri -> (строка)

Путь к выходному файлу речи.

CreationTime -> (метка времени)

Метка времени начала задачи синтеза.

RequestCharacters -> (целое число)

Количество оплачиваемых символов, синтезированных.

SnsTopicArn -> (строка)

ARN темы SNS, необязательно используемой для предоставления уведомлений о статусе задачи синтеза речи.

LexiconNames -> (список)

Список одного или нескольких имен словарей произношения, которые вы хотите применить в процессе синтеза. Словари применяются только в том случае, если язык словаря совпадает с языком голоса.

(строка)

OutputFormat -> (строка)

Формат кодирования возвращаемого вывода. Для аудиопотока это будет mp3, ogg_vorbis или pcm. Для меток речи - json.

SampleRate -> (строка)

Частота дискретизации, указанная в Гц.

Допустимые значения для mp3 и ogg_vorbis - “8000”, “16000”, “22050” и “24000”. Значение по умолчанию для стандартных голосов - “22050”. Значение по умолчанию для нейронных голосов - “24000”. Значение по умолчанию для голосов для длинных форм - “24000”. Значение по умолчанию для генеративных голосов - “24000”.

Допустимые значения для pcm - “8000” и “16000”. Значение по умолчанию - “16000”.

SpeechMarkTypes -> (список)

Тип меток речи, возвращаемых для входного текста.

(строка)

TextType -> (строка)

Указывает, является ли входной текст обычным текстом или SSML. Значение по умолчанию - обычный текст.

VoiceId -> (строка)

Идентификатор голоса, который необходимо использовать для синтеза.

LanguageCode -> (строка)

Необязательный код языка для задачи синтеза. Это необходимо только при использовании двуязычного голоса, такого как Aditi, который может использоваться для английского языка в Индии (en-IN) или хинди (hi-IN).

Если используется двуязычный голос и код языка не указан, Amazon Polly использует язык по умолчанию для двуязычного голоса. Язык по умолчанию для любого голоса - тот, который возвращается операцией DescribeVoices для параметра LanguageCode. Например, если код языка не указан, Aditi будет использовать индийский английский, а не хинди.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API