Spec-Zone.ru › AWS CLI v2

[ aws . transcribe ]

start-transcription-job

Описание

Транскрибирует аудио из медиафайла и применяет любые дополнительные параметры запроса, которые вы хотите включить в свой запрос.

Чтобы сделать запрос StartTranscriptionJob, вы должны сначала загрузить свой медиафайл в ведро Amazon S3; затем вы можете указать расположение файла Amazon S3 с помощью параметра Media.

Вы должны включить следующие параметры в свой запрос StartTranscriptionJob:

  • region : Регион Amazon Web Services, в котором вы выполняете запрос. Список поддерживаемых регионов Amazon Web Services для Amazon Transcribe см. в документации Amazon Transcribe по конечным точкам и квотам.
  • TranscriptionJobName : Пользовательское имя, созданное для вашей задачи транскрипции, уникальное в рамках вашей учетной записи Amazon Web Services.
  • Media (MediaFileUri ): Расположение вашего медиафайла в Amazon S3.
  • Один из LanguageCode , IdentifyLanguage , или IdentifyMultipleLanguages : Если вы знаете язык вашего медиафайла, укажите его с помощью параметра LanguageCode; все допустимые коды языков можно найти в таблице Поддерживаемые языки. Если вы не знаете языки, используемые в вашем медиа, используйте либо IdentifyLanguage, либо IdentifyMultipleLanguages, и позвольте Amazon Transcribe определить языки за вас.

См. также: Документация AWS API

Синтаксис

  start-transcription-job
--transcription-job-name <value>
[--language-code <value>]
[--media-sample-rate-hertz <value>]
[--media-format <value>]
--media <value>
[--output-bucket-name <value>]
[--output-key <value>]
[--output-encryption-kms-key-id <value>]
[--kms-encryption-context <value>]
[--settings <value>]
[--model-settings <value>]
[--job-execution-settings <value>]
[--content-redaction <value>]
[--identify-language | --no-identify-language]
[--identify-multiple-languages | --no-identify-multiple-languages]
[--language-options <value>]
[--subtitles <value>]
[--tags <value>]
[--language-id-settings <value>]
[--toxicity-detection <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--transcription-job-name (строка)

Уникальное имя для вашей задачи транскрипции, выбранное вами. Это имя также используется в качестве имени файла выходных данных транскрипции по умолчанию. Если вы хотите указать другое имя для файла выходных данных транскрипции, используйте параметр OutputKey.

Имя чувствительно к регистру, не может содержать пробелы и должно быть уникальным в рамках учетной записи Amazon Web Services. Если вы попытаетесь создать новую задачу с тем же именем, что и существующая задача, получите ошибку ConflictException.

--language-code (строка)

Код языка, представляющий язык, на котором произносится аудио в файле.

Если вы не уверены в языке аудио, рассмотрите возможность использования IdentifyLanguage или IdentifyMultipleLanguages для автоматической идентификации языка.

Обратите внимание, что вам необходимо включить один из параметров LanguageCode , IdentifyLanguage или IdentifyMultipleLanguages в ваш запрос. Если вы включите больше одного из этих параметров, ваша задача транскрипции завершится ошибкой.

Список поддерживаемых языков и соответствующих кодов языков см. в таблице Поддерживаемые языки.

Примечание

Для транскрипции речи на современном стандартном арабском языке (ar-SA) в Amazon Web Services GovCloud (US) (US-West, us-gov-west-1), Amazon Web Services GovCloud (US) (US-East, us-gov-east-1), Канаде (Калгари, ca-west-1) и Африке (Кейптаун, af-south-1), ваш файл медиа должен быть закодирован с частотой дискретизации 16 000 Гц или выше.

Возможные значения:

  • af-ZA
  • ar-AE
  • ar-SA
  • da-DK
  • de-CH
  • de-DE
  • en-AB
  • en-AU
  • en-GB
  • en-IE
  • en-IN
  • en-US
  • en-WL
  • es-ES
  • es-US
  • fa-IR
  • fr-CA
  • fr-FR
  • he-IL
  • hi-IN
  • id-ID
  • it-IT
  • ja-JP
  • ko-KR
  • ms-MY
  • nl-NL
  • pt-BR
  • pt-PT
  • ru-RU
  • ta-IN
  • te-IN
  • tr-TR
  • zh-CN
  • zh-TW
  • th-TH
  • en-ZA
  • en-NZ
  • vi-VN
  • sv-SE
  • ab-GE
  • ast-ES
  • az-AZ
  • ba-RU
  • be-BY
  • bg-BG
  • bn-IN
  • bs-BA
  • ca-ES
  • ckb-IQ
  • ckb-IR
  • cs-CZ
  • cy-WL
  • el-GR
  • et-ET
  • eu-ES
  • fi-FI
  • gl-ES
  • gu-IN
  • ha-NG
  • hr-HR
  • hu-HU
  • hy-AM
  • is-IS
  • ka-GE
  • kab-DZ
  • kk-KZ
  • kn-IN
  • ky-KG
  • lg-IN
  • lt-LT
  • lv-LV
  • mhr-RU
  • mi-NZ
  • mk-MK
  • ml-IN
  • mn-MN
  • mr-IN
  • mt-MT
  • no-NO
  • or-IN
  • pa-IN
  • pl-PL
  • ps-AF
  • ro-RO
  • rw-RW
  • si-LK
  • sk-SK
  • sl-SI
  • so-SO
  • sr-RS
  • su-ID
  • sw-BI
  • sw-KE
  • sw-RW
  • sw-TZ
  • sw-UG
  • tl-PH
  • tt-RU
  • ug-CN
  • uk-UA
  • uz-UZ
  • wo-SN
  • zh-HK
  • zu-ZA

--media-sample-rate-hertz (целое число)

Частота дискретизации аудиодорожки в вашем файле медиа в герцах.

Если вы не укажете частоту дискретизации медиа, Amazon Transcribe определит её для вас. Если вы укажете частоту дискретизации, она должна соответствовать частоте, определённой Amazon Transcribe. Если между указанным вами значением и обнаруженным значением есть несоответствие, ваша задача завершится ошибкой. В большинстве случаев вы можете опустить MediaSampleRateHertz и позволить Amazon Transcribe определить частоту дискретизации.

--media-format (строка)

Укажите формат вашего файла медиа.

Возможные значения:

  • mp3
  • mp4
  • wav
  • flac
  • ogg
  • amr
  • webm
  • m4a

--media (структура)

Описание расположения файла медиа в Amazon S3, которое вы хотите использовать в своём запросе.

MediaFileUri -> (строка)

Расположение файла медиа в Amazon S3, который вы хотите транскрибировать. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что ведро Amazon S3, содержащее ваше медиа, должно находиться в той же области Amazon Web Services, где вы выполняете запрос транскрипции.

RedactedMediaFileUri -> (строка)

Расположение файла медиа, который вы хотите отредактировать, в Amazon S3. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что ведро Amazon S3, содержащее ваше медиа, должно находиться в той же области Amazon Web Services, где вы выполняете запрос транскрипции.

Предупреждение

RedactedMediaFileUri генерирует отредактированный аудиофайл в дополнение к отредактированному протоколу транскрипции. Он поддерживается только для запросов транскрипции Call Analytics (StartCallAnalyticsJob).

Сокращенная синтаксис:

MediaFileUri=string,RedactedMediaFileUri=string

Синтаксис JSON:

{
  "MediaFileUri": "string",
  "RedactedMediaFileUri": "string"
}

--output-bucket-name (строка)

Имя ведра Amazon S3, в котором вы хотите сохранить выходные данные транскрипции. Не включайте префикс S3:// указанного ведра.

Если вы хотите, чтобы выходные данные были сохранены в подпапке этого ведра, укажите её с помощью параметра OutputKey; OutputBucketName принимает только имя ведра.

Например, если вы хотите сохранить выходные данные в S3://DOC-EXAMPLE-BUCKET , установите OutputBucketName в DOC-EXAMPLE-BUCKET . Однако, если вы хотите сохранить выходные данные в S3://DOC-EXAMPLE-BUCKET/test-files/ , установите OutputBucketName в DOC-EXAMPLE-BUCKET и OutputKey в test-files/ .

Обратите внимание, что Amazon Transcribe должен иметь разрешения на использование указанного расположения. Вы можете изменить разрешения Amazon S3 с помощью консоли управления Amazon Web Services. См. также Требуемые разрешения для ролей IAM.

Если вы не укажете OutputBucketName, ваш протокол транскрипции будет размещен в управляемом службой ведре Amazon S3, и вам будет предоставлен URI для доступа к вашему протоколу транскрипции.

--output-key (строка)

Используйте в сочетании с OutputBucketName для указания расположения выходных данных вашего протокола транскрипции и, необязательно, уникального имени для файла выходных данных. Имя по умолчанию для выходных данных транскрипции совпадает с именем, которое вы указали для вашей задачи транскрипции (TranscriptionJobName).

Вот несколько примеров использования OutputKey:

  • Если вы укажете ‘DOC-EXAMPLE-BUCKET’ как OutputBucketName и ‘my-transcript.json’ как OutputKey, путь к выходным данным транскрипции будет s3://DOC-EXAMPLE-BUCKET/my-transcript.json.
  • Если вы укажете ‘my-first-transcription’ как TranscriptionJobName, ‘DOC-EXAMPLE-BUCKET’ как OutputBucketName, и ‘my-transcript’ как OutputKey, путь к выходным данным транскрипции будет s3://DOC-EXAMPLE-BUCKET/my-transcript/my-first-transcription.json.
  • Если вы укажете ‘DOC-EXAMPLE-BUCKET’ как OutputBucketName и ‘test-files/my-transcript.json’ как OutputKey, путь к выходным данным транскрипции будет s3://DOC-EXAMPLE-BUCKET/test-files/my-transcript.json.
  • Если вы укажете ‘my-first-transcription’ как TranscriptionJobName, ‘DOC-EXAMPLE-BUCKET’ как OutputBucketName, и ‘test-files/my-transcript’ как OutputKey, путь к выходным данным транскрипции будет s3://DOC-EXAMPLE-BUCKET/test-files/my-transcript/my-first-transcription.json.

Если вы укажете имя подпапки ведра Amazon S3, которой не существует, она будет создана для вас.

--output-encryption-kms-key-id (строка)

Ключ KMS, который вы хотите использовать для шифрования выходных данных транскрипции.

Если вы используете ключ из текущей учетной записи Amazon Web Services, вы можете указать ключ KMS четырьмя способами:

  • Используйте сам идентификатор ключа KMS. Например, 1234abcd-12ab-34cd-56ef-1234567890ab.
  • Используйте псевдоним для идентификатора ключа KMS. Например, alias/ExampleAlias.
  • Используйте Amazon Resource Name (ARN) для идентификатора ключа KMS. Например, arn:aws:kms:region:account-ID:key/1234abcd-12ab-34cd-56ef-1234567890ab.
  • Используйте ARN для псевдонима ключа KMS. Например, arn:aws:kms:region:account-ID:alias/ExampleAlias.

Если вы используете ключ из другой учетной записи Amazon Web Services, чем текущая, вы можете указать ключ KMS двумя способами:

  • Используйте ARN для идентификатора ключа KMS. Например, arn:aws:kms:region:account-ID:key/1234abcd-12ab-34cd-56ef-1234567890ab.
  • Используйте ARN для псевдонима ключа KMS. Например, arn:aws:kms:region:account-ID:alias/ExampleAlias.

Если вы не укажете ключ шифрования, ваши выходные данные будут зашифрованы с использованием ключа Amazon S3 по умолчанию (SSE-S3).

Если вы укажете ключ KMS для шифрования выходных данных, вам также необходимо указать расположение выходных данных с помощью параметра OutputLocation.

Обратите внимание, что роль, выполняющая запрос, должна иметь разрешения на использование указанного ключа KMS.

--kms-encryption-context (карта)

Карта пар «ключ-значение» обычного текста, не содержащего секретные ключи, известная как пары контекста шифрования, обеспечивают дополнительный уровень безопасности для ваших данных. Дополнительную информацию можно найти в разделах KMS encryption context и Ассиметричные ключи в KMS.

ключ -> (строка)

значение -> (строка)

Упрощённый синтаксис:

KeyName1=string,KeyName2=string

Синтаксис JSON:

{"string": "string"
  ...}

--settings (структура)

Укажите дополнительные необязательные параметры в запросе, включая идентификацию канала, альтернативные транскрипции, разделение по говорящим. Вы можете использовать их для применения пользовательских словарей и фильтров словарей.

Если вы хотите включить пользовательский словарь или пользовательский фильтр словаря (или оба) в свой запрос, но не хотите использовать автоматическое определение языка, используйте Settings с параметрами VocabularyName или VocabularyFilterName (или оба).

Если вы используете автоматическое определение языка со своим запросом и хотите включить пользовательскую языковую модель, пользовательский словарь или пользовательский фильтр словаря, используйте вместо этого параметр с параметрами LanguageModelName , VocabularyName или VocabularyFilterName.

VocabularyName -> (строка)

Имя пользовательского словаря, который вы хотите использовать в запросе на транскрипцию. Это имя чувствительно к регистру, не может содержать пробелы и должно быть уникальным в рамках учетной записи Amazon Web Services.

ShowSpeakerLabels -> (булево)

Включает разделение по говорящим (диаррацию) в выходных данных транскрипции. Разделение по говорящим помещает речь отдельных говорящих в вашем медиафайле.

Если вы включите ShowSpeakerLabels в свой запрос, вы также должны включить MaxSpeakerLabels.

Дополнительную информацию см. в разделе Разделение говорящих (диаррация).

MaxSpeakerLabels -> (целое число)

Укажите максимальное количество говорящих, которых вы хотите разделить в медиа.

Обратите внимание, что если в медиафайле содержится больше говорящих, чем указанное число, несколько говорящих рассматриваются как один.

Если вы указали поле MaxSpeakerLabels, вы должны установить поле ShowSpeakerLabels в значение true.

ChannelIdentification -> (булево)

Включает идентификацию канала в аудио с несколькими каналами.

Идентификация канала транскрибирует аудио на каждом канале независимо, а затем добавляет вывод для каждого канала в один протокол.

Дополнительную информацию см. в разделе Транскрипция аудио с несколькими каналами.

ShowAlternatives -> (булево)

Для включения альтернативных транскрипций в выходные данные транскрипции, включите ShowAlternatives в запросе на транскрипцию.

Если у вас есть многоканальное аудио и вы не включили идентификацию канала, ваше аудио транскрибируется непрерывно, и ваш протокол не разделяет речь по каналам.

Если вы включите ShowAlternatives, вы также должны включить MaxAlternatives, которое является максимальным количеством альтернативных транскрипций, которые вы хотите, чтобы Amazon Transcribe сгенерировал.

Дополнительную информацию см. в разделе Альтернативные транскрипции.

MaxAlternatives -> (целое число)

Укажите максимальное количество альтернативных транскрипций, которые вы хотите включить в свой протокол.

Если вы выберете число большее, чем число альтернативных транскрипций, сгенерированных Amazon Transcribe, будут включены только фактические альтернативные транскрипции.

Если вы включите MaxAlternatives в своем запросе, вы также должны включить ShowAlternatives со значением true.

Дополнительную информацию см. в разделе Альтернативные транскрипции.

VocabularyFilterName -> (строка)

Имя пользовательского фильтра словаря, который вы хотите использовать в запросе на транскрипцию. Это имя чувствительно к регистру, не может содержать пробелы и должно быть уникальным в рамках учетной записи Amazon Web Services.

Обратите внимание, что если вы включите VocabularyFilterName в своем запросе, вы также должны включить VocabularyFilterMethod.

VocabularyFilterMethod -> (строка)

Укажите, как вы хотите применить пользовательский фильтр словаря к вашему протоколу.

Чтобы заменить слова на ***, выберите mask.

Чтобы удалить слова, выберите remove.

Чтобы отметить слова без изменения, выберите tag.

Упрощённый синтаксис:

VocabularyName=string,ShowSpeakerLabels=boolean,MaxSpeakerLabels=integer,ChannelIdentification=boolean,ShowAlternatives=boolean,MaxAlternatives=integer,VocabularyFilterName=string,VocabularyFilterMethod=string

Синтаксис JSON:

{
  "VocabularyName": "string",
  "ShowSpeakerLabels": true|false,
  "MaxSpeakerLabels": integer,
  "ChannelIdentification": true|false,
  "ShowAlternatives": true|false,
  "MaxAlternatives": integer,
  "VocabularyFilterName": "string",
  "VocabularyFilterMethod": "remove"|"mask"|"tag"
}

--model-settings (структура)

Укажите пользовательскую языковую модель, которую вы хотите включить в задание транскрипции. Если вы включите ModelSettings в свой запрос, вы должны включить параметр LanguageModelName.

Дополнительную информацию см. в разделе Пользовательские языковые модели.

LanguageModelName -> (строка)

Имя пользовательской языковой модели, которую вы хотите использовать при обработке задания транскрипции. Обратите внимание, что имена пользовательских языковых моделей чувствительны к регистру.

Язык указанной пользовательской языковой модели должен соответствовать коду языка, который вы указываете в запросе транскрипции. Если языки не совпадают, пользовательская языковая модель не применяется. Ошибки или предупреждения, связанные с несовпадением языков, отсутствуют.

Упрощённый синтаксис:

LanguageModelName=string

Синтаксис JSON:

{
  "LanguageModelName": "string"
}

--job-execution-settings (структура)

Позволяет контролировать обработку задания транскрипции. В настоящее время единственное JobExecutionSettings изменение, которое вы можете выбрать, — включение очереди задач с помощью параметра AllowDeferredExecution.

Если вы включите JobExecutionSettings в свой запрос, вы также должны включить параметры: AllowDeferredExecution и DataAccessRoleArn.

AllowDeferredExecution -> (булево)

Позволяет включить очереди задач, когда предел одновременных запросов превышен. Когда AllowDeferredExecution установлено в значение true, запросы на задачи транскрипции помещаются в очередь до тех пор, пока число задач не опустится ниже предела одновременных запросов. Если AllowDeferredExecution установлено в false, и количество запросов на задачи транскрипции превысит предел одновременных запросов, вы получите ошибку LimitExceededException.

Если вы включите AllowDeferredExecution в свой запрос, вы также должны включить DataAccessRoleArn.

DataAccessRoleArn -> (строка)

Amazon Resource Name (ARN) роли IAM, имеющей разрешения на доступ к ведру Amazon S3, содержащему входные файлы. Если у указанной роли нет соответствующих разрешений для доступа к указанному расположению Amazon S3, ваш запрос завершится неудачей.

ARN ролей IAM имеют формат arn:partition:iam::account:role/role-name-with-path. Например: arn:aws:iam::111122223333:role/Admin. Дополнительную информацию см. в разделе IAM ARNs.

Обратите внимание, что если вы включите DataAccessRoleArn в свой запрос, вы также должны включить AllowDeferredExecution.

Упрощённый синтаксис:

AllowDeferredExecution=boolean,DataAccessRoleArn=string

Синтаксис JSON:

{
  "AllowDeferredExecution": true|false,
  "DataAccessRoleArn": "string"
}

--content-redaction (структура)

Позволяет замаскировать или отметить указанную лично идентифицируемую информацию (PII) в вашем протоколе. Если вы используете ContentRedaction, вы также должны включить параметры: RedactionOutput и RedactionType. Вы можете по желанию включить PiiEntityTypes, чтобы выбрать типы PII, которые вы хотите замаскировать. Если вы не включите PiiEntityTypes в свой запрос, вся PII маскируется.

RedactionType -> (строка)

Укажите категорию информации, которую вы хотите замаскировать; PII (лично идентифицируемая информация) является единственным допустимым значением. Вы можете использовать PiiEntityTypes, чтобы выбрать типы PII, которые вы хотите замаскировать. Если вы не включите PiiEntityTypes в свой запрос, вся PII маскируется.

RedactionOutput -> (строка)

Укажите, хотите ли вы только замаскированный протокол или замаскированный и незамаскированный протокол.

При выборе redacted Amazon Transcribe создаёт только замаскированный протокол.

При выборе redacted_and_unredacted Amazon Transcribe создаёт замаскированный и незамаскированный протокол (как два отдельных файла).

PiiEntityTypes -> (список)

Укажите типы лично идентифицируемой информации (PII), которые вы хотите замаскировать в вашем протоколе. Вы можете включить любое количество типов или выбрать ALL. Если вы не включите PiiEntityTypes в свой запрос, вся PII маскируется.

(строка)

Упрощённый синтаксис:

RedactionType=string,RedactionOutput=string,PiiEntityTypes=string,string

Синтаксис JSON:

{
  "RedactionType": "PII",
  "RedactionOutput": "redacted"|"redacted_and_unredacted",
  "PiiEntityTypes": ["BANK_ACCOUNT_NUMBER"|"BANK_ROUTING"|"CREDIT_DEBIT_NUMBER"|"CREDIT_DEBIT_CVV"|"CREDIT_DEBIT_EXPIRY"|"PIN"|"EMAIL"|"ADDRESS"|"NAME"|"PHONE"|"SSN"|"ALL", ...]
}

--identify-language | --no-identify-language (булево)

Включает автоматическое определение языка в запросе транскрипции. Используйте этот параметр, если в вашем медиафайле содержится только один язык. Если ваше медиа содержит несколько языков, используйте IdentifyMultipleLanguages вместо этого.

Если вы включите IdentifyLanguage, вы можете по желанию включить список кодов языка, используя LanguageOptions, который, по вашему мнению, может присутствовать в вашем медиафайле. Включение LanguageOptions ограничивает IdentifyLanguage только указанными вами вариантами языка, что может повысить точность транскрипции.

Если вы хотите применить пользовательскую языковую модель, пользовательский словарь или пользовательский фильтр словаря к запросу автоматического определения языка, включите LanguageIdSettings с соответствующими параметрами (VocabularyName, LanguageModelName и VocabularyFilterName). Если вы включите LanguageIdSettings, также включите LanguageOptions.

Обратите внимание, что вы должны включить один из параметров LanguageCode, IdentifyLanguage или IdentifyMultipleLanguages в свой запрос. Если вы включите больше одного из этих параметров, задание транскрипции завершится ошибкой.

--identify-multiple-languages | --no-identify-multiple-languages (булево)

Включает автоматическую идентификацию языка в запросе на транскрипцию. Используйте этот параметр, если ваш медиафайл содержит более одного языка. Если медиафайл содержит только один язык, используйте IdentifyLanguage вместо этого.

Если вы включите IdentifyMultipleLanguages, вы можете дополнительно включить список кодов языков, используя LanguageOptions, которые, по вашему мнению, могут присутствовать в медиафайле. Включение LanguageOptions ограничивает IdentifyLanguage только указанными вами языковыми вариантами, что может повысить точность транскрипции.

Если вы хотите применить пользовательский словарь или фильтр пользовательского словаря к запросу на автоматическую идентификацию языка, включите LanguageIdSettings с соответствующими подпараметрами (VocabularyName и VocabularyFilterName ). Если вы включите LanguageIdSettings, также включите LanguageOptions.

Обратите внимание, что в вашем запросе необходимо включить один из параметров LanguageCode , IdentifyLanguage или IdentifyMultipleLanguages. Если вы включите более одного из этих параметров, работа транскрипции завершится ошибкой.

--language-options (список)

Вы можете указать два или более кодов языка, которые, по вашему мнению, могут присутствовать в медиафайле. Включение более пяти кодов не рекомендуется. Если вы не уверены в присутствии определённых языков, не включайте этот параметр.

Если вы включите LanguageOptions в свой запрос, вы также должны включить IdentifyLanguage.

Дополнительную информацию см. в разделе Поддерживаемые языки.

Для транскрипции речи на современном стандартном арабском языке (ar-SA) в Amazon Web Services GovCloud (US) (US-West, us-gov-west-1), Amazon Web Services GovCloud (US) (US-East, us-gov-east-1), в Канаде (Калгари) ca-west-1 и Африке (Кейптаун) af-south-1, медиафайл должен быть закодирован со скоростью дискретизации 16 000 Гц или выше.

(строка)

Синтаксис:

"string" "string" ...

Where valid values are:
  af-ZA
  ar-AE
  ar-SA
  da-DK
  de-CH
  de-DE
  en-AB
  en-AU
  en-GB
  en-IE
  en-IN
  en-US
  en-WL
  es-ES
  es-US
  fa-IR
  fr-CA
  fr-FR
  he-IL
  hi-IN
  id-ID
  it-IT
  ja-JP
  ko-KR
  ms-MY
  nl-NL
  pt-BR
  pt-PT
  ru-RU
  ta-IN
  te-IN
  tr-TR
  zh-CN
  zh-TW
  th-TH
  en-ZA
  en-NZ
  vi-VN
  sv-SE
  ab-GE
  ast-ES
  az-AZ
  ba-RU
  be-BY
  bg-BG
  bn-IN
  bs-BA
  ca-ES
  ckb-IQ
  ckb-IR
  cs-CZ
  cy-WL
  el-GR
  et-ET
  eu-ES
  fi-FI
  gl-ES
  gu-IN
  ha-NG
  hr-HR
  hu-HU
  hy-AM
  is-IS
  ka-GE
  kab-DZ
  kk-KZ
  kn-IN
  ky-KG
  lg-IN
  lt-LT
  lv-LV
  mhr-RU
  mi-NZ
  mk-MK
  ml-IN
  mn-MN
  mr-IN
  mt-MT
  no-NO
  or-IN
  pa-IN
  pl-PL
  ps-AF
  ro-RO
  rw-RW
  si-LK
  sk-SK
  sl-SI
  so-SO
  sr-RS
  su-ID
  sw-BI
  sw-KE
  sw-RW
  sw-TZ
  sw-UG
  tl-PH
  tt-RU
  ug-CN
  uk-UA
  uz-UZ
  wo-SN
  zh-HK
  zu-ZA

--subtitles (структура)

Создаёт файлы субтитров для входного медиафайла. Вы можете указать форматы WebVTT (.vtt) и SubRip (.srt).

Форматы -> (список)

Укажите формат выходного файла субтитров; если вы выберете форматы WebVTT (vtt ) и SubRip (srt ), будут сгенерированы два выходных файла.

(строка)

OutputStartIndex -> (целое число)

Укажите начальное значение, которое присваивается первому сегменту субтитров.

Значение по умолчанию для Amazon Transcribe — 0, что отличается от широко используемого стандарта 1. Если вы не уверены, какое значение использовать, рекомендуется выбрать 1, поскольку это может улучшить совместимость с другими сервисами.

Краткая запись синтаксиса:

Formats=string,string,OutputStartIndex=integer

Синтаксис JSON:

{
  "Formats": ["vtt"|"srt", ...],
  "OutputStartIndex": integer
}

--tags (список)

Добавляет один или несколько пользовательских тегов, каждый в виде пары ключ:значение, к новой задаче транскрипции в момент её запуска.

Дополнительную информацию об использовании тегов с Amazon Transcribe см. в разделе Маркирование ресурсов.

(структура)

Добавляет метаданные в виде пары ключ:значение к указанному ресурсу.

Например, вы можете добавить тег Department:Sales к ресурсу, чтобы указать, что он относится к отделу продаж вашей организации. Вы также можете использовать теги для управления доступом на основе тегов.

Дополнительную информацию о тегах см. в разделе Маркирование ресурсов.

Ключ -> (строка)

Первая часть пары ключ:значение, формирующей тег, связанный с данным ресурсом. Например, в теге Department:Sales ключом является «Отдел».

Значение -> (строка)

Вторая часть пары ключ:значение, формирующей тег, связанный с данным ресурсом. Например, в теге Department:Sales значением является «Продажи».

Обратите внимание, что вы можете установить значение тега в пустую строку, но не можете установить значение тега в значение null. Пропуск значения тега эквивалентен использованию пустой строки.

Краткая запись синтаксиса:

Key=string,Value=string ...

Синтаксис JSON:

[
  {
    "Key": "string",
    "Value": "string"
  }
  ...
]

--language-id-settings (отображение)

Если в запросе используется автоматическая идентификация языка и вы хотите применить пользовательскую языковую модель, пользовательский словарь или фильтр пользовательского словаря, включите LanguageIdSettings с соответствующими подпараметрами (VocabularyName, LanguageModelName и VocabularyFilterName ). Обратите внимание, что многоязычная идентификация (IdentifyMultipleLanguages) не поддерживает пользовательские языковые модели.

LanguageIdSettings поддерживает от двух до пяти кодов языка. Каждый включённый вами код языка может иметь связанную пользовательскую языковую модель, пользовательский словарь и фильтр пользовательского словаря. Коды языка, которые вы указываете, должны соответствовать языкам связанных пользовательских языковых моделей, пользовательских словарей и фильтров пользовательских словарей.

Рекомендуется включить LanguageOptions при использовании LanguageIdSettings, чтобы обеспечить идентификацию правильного диалекта языка. Например, если вы указываете пользовательский словарь на языке en-US, но Amazon Transcribe определяет, что в медиафайле используется язык en-AU, ваш пользовательский словарь не будет применён к транскрипции. Если вы включите LanguageOptions и укажите en-US как единственный диалект английского языка, ваш пользовательский словарь будет применён к транскрипции.

Если вы хотите включить пользовательскую языковую модель в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметром LanguageModelName. Если вы хотите включить пользовательский словарь или фильтр пользовательского словаря (или оба) в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметрами VocabularyName или VocabularyFilterName (или оба).

ключ -> (строка)

значение -> (структура)

Если в запросе используется автоматическая идентификация языка и вы хотите применить пользовательскую языковую модель, пользовательский словарь или фильтр пользовательского словаря, включите LanguageIdSettings с соответствующими подпараметрами (VocabularyName, LanguageModelName и VocabularyFilterName). Обратите внимание, что многоязычная идентификация (IdentifyMultipleLanguages) не поддерживает пользовательские языковые модели.

LanguageIdSettings поддерживает от двух до пяти кодов языка. Каждый включённый вами код языка может иметь связанную пользовательскую языковую модель, пользовательский словарь и фильтр пользовательского словаря. Коды языка, которые вы указываете, должны соответствовать языкам связанных пользовательских языковых моделей, пользовательских словарей и фильтров пользовательских словарей.

Рекомендуется включить LanguageOptions при использовании LanguageIdSettings, чтобы обеспечить идентификацию правильного диалекта языка. Например, если вы указываете пользовательский словарь на языке en-US, но Amazon Transcribe определяет, что в медиафайле используется язык en-AU, ваш пользовательский словарь не будет применён к транскрипции. Если вы включите LanguageOptions и укажите en-US как единственный диалект английского языка, ваш пользовательский словарь будет применён к транскрипции.

Если вы хотите включить пользовательскую языковую модель в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметром LanguageModelName. Если вы хотите включить пользовательский словарь или фильтр пользовательского словаря (или оба) в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметрами VocabularyName или VocabularyFilterName (или оба).

Имя словаря -> (строка)

Имя пользовательского словаря, которое вы хотите использовать при обработке задачи транскрипции. Имена пользовательских словарей чувствительны к регистру.

Язык указанного пользовательского словаря должен соответствовать коду языка, который вы указываете в запросе на транскрипцию. Если языки не совпадают, пользовательский словарь не будет применён. Соответствие языков не приведёт к ошибкам или предупреждениям.

Имя фильтра словаря -> (строка)

Имя фильтра пользовательского словаря, которое вы хотите использовать при обработке задачи транскрипции. Имена фильтров пользовательских словарей чувствительны к регистру.

Язык указанного фильтра пользовательского словаря должен соответствовать коду языка, который вы указываете в запросе на транскрипцию. Если языки не совпадают, фильтр пользовательского словаря не будет применён. Соответствие языков не приведёт к ошибкам или предупреждениям.

Обратите внимание, что если вы включите VocabularyFilterName в свой запрос, вы также должны включить VocabularyFilterMethod.

Имя языковой модели -> (строка)

Имя пользовательской языковой модели, которую вы хотите использовать при обработке задачи транскрипции. Обратите внимание, что имена пользовательских языковых моделей чувствительны к регистру.

Язык указанной языковой модели должен соответствовать коду языка, который вы указываете в запросе на транскрипцию. Если языки не совпадают, пользовательская языковая модель не будет применён. Соответствие языков не приведёт к ошибкам или предупреждениям.

Краткая запись синтаксиса:

  KeyName1=VocabularyName=string,VocabularyFilterName=string,LanguageModelName=string,KeyName2=VocabularyName=string,VocabularyFilterName=string,LanguageModelName=string

Where valid key names are:
  af-ZA
  ar-AE
  ar-SA
  da-DK
  de-CH
  de-DE
  en-AB
  en-AU
  en-GB
  en-IE
  en-IN
  en-US
  en-WL
  es-ES
  es-US
  fa-IR
  fr-CA
  fr-FR
  he-IL
  hi-IN
  id-ID
  it-IT
  ja-JP
  ko-KR
  ms-MY
  nl-NL
  pt-BR
  pt-PT
  ru-RU
  ta-IN
  te-IN
  tr-TR
  zh-CN
  zh-TW
  th-TH
  en-ZA
  en-NZ
  vi-VN
  sv-SE
  ab-GE
  ast-ES
  az-AZ
  ba-RU
  be-BY
  bg-BG
  bn-IN
  bs-BA
  ca-ES
  ckb-IQ
  ckb-IR
  cs-CZ
  cy-WL
  el-GR
  et-ET
  eu-ES
  fi-FI
  gl-ES
  gu-IN
  ha-NG
  hr-HR
  hu-HU
  hy-AM
  is-IS
  ka-GE
  kab-DZ
  kk-KZ
  kn-IN
  ky-KG
  lg-IN
  lt-LT
  lv-LV
  mhr-RU
  mi-NZ
  mk-MK
  ml-IN
  mn-MN
  mr-IN
  mt-MT
  no-NO
  or-IN
  pa-IN
  pl-PL
  ps-AF
  ro-RO
  rw-RW
  si-LK
  sk-SK
  sl-SI
  so-SO
  sr-RS
  su-ID
  sw-BI
  sw-KE
  sw-RW
  sw-TZ
  sw-UG
  tl-PH
  tt-RU
  ug-CN
  uk-UA
  uz-UZ
  wo-SN
  zh-HK
  zu-ZA

Синтаксис JSON:

{"af-ZA"|"ar-AE"|"ar-SA"|"da-DK"|"de-CH"|"de-DE"|"en-AB"|"en-AU"|"en-GB"|"en-IE"|"en-IN"|"en-US"|"en-WL"|"es-ES"|"es-US"|"fa-IR"|"fr-CA"|"fr-FR"|"he-IL"|"hi-IN"|"id-ID"|"it-IT"|"ja-JP"|"ko-KR"|"ms-MY"|"nl-NL"|"pt-BR"|"pt-PT"|"ru-RU"|"ta-IN"|"te-IN"|"tr-TR"|"zh-CN"|"zh-TW"|"th-TH"|"en-ZA"|"en-NZ"|"vi-VN"|"sv-SE"|"ab-GE"|"ast-ES"|"az-AZ"|"ba-RU"|"be-BY"|"bg-BG"|"bn-IN"|"bs-BA"|"ca-ES"|"ckb-IQ"|"ckb-IR"|"cs-CZ"|"cy-WL"|"el-GR"|"et-ET"|"eu-ES"|"fi-FI"|"gl-ES"|"gu-IN"|"ha-NG"|"hr-HR"|"hu-HU"|"hy-AM"|"is-IS"|"ka-GE"|"kab-DZ"|"kk-KZ"|"kn-IN"|"ky-KG"|"lg-IN"|"lt-LT"|"lv-LV"|"mhr-RU"|"mi-NZ"|"mk-MK"|"ml-IN"|"mn-MN"|"mr-IN"|"mt-MT"|"no-NO"|"or-IN"|"pa-IN"|"pl-PL"|"ps-AF"|"ro-RO"|"rw-RW"|"si-LK"|"sk-SK"|"sl-SI"|"so-SO"|"sr-RS"|"su-ID"|"sw-BI"|"sw-KE"|"sw-RW"|"sw-TZ"|"sw-UG"|"tl-PH"|"tt-RU"|"ug-CN"|"uk-UA"|"uz-UZ"|"wo-SN"|"zh-HK"|"zu-ZA": {
      "VocabularyName": "string",
      "VocabularyFilterName": "string",
      "LanguageModelName": "string"
    }
  ...}

--toxicity-detection (список)

Включает обнаружение токсичной речи в вашей транскрипции. Если вы включите ToxicityDetection в свой запрос, вы также должны включить ToxicityCategories.

Дополнительную информацию о типах токсичной речи, которые может обнаружить Amazon Transcribe, см. в разделе Обнаружение токсичной речи.

(структура)

Содержит ToxicityCategories, который является обязательным параметром, если вы хотите включить обнаружение токсичности (ToxicityDetection) в ваш запрос на транскрипцию.

Категории токсичности -> (список)

Если вы включите ToxicityDetection в свой запрос на транскрипцию, вы также должны включить ToxicityCategories. Единственное допустимое значение для этого параметра — ALL.

(строка)

Краткая запись синтаксиса:

ToxicityCategories=string,string ...

Синтаксис JSON:

[
  {
    "ToxicityCategories": ["ALL", ...]
  }
  ...
]

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному в --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения переопределят значения, полученные из JSON. Невозможно передавать произвольные двоичные значения с помощью значения, предоставленного в JSON, так как строка будет взята буквально. Это может не быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (string) Выводит скелет JSON в стандартный вывод без отправки запроса API. Если не предоставлено значение или значение input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, он проверяет входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный скелет JSON не является стабильным между версиями AWS CLI, и никаких гарантий обратной совместимости в сгенерированном скелете JSON нет.

Глобальные опции

--debug (boolean)

Включить отладочное логирование.

--endpoint-url (string)

Переопределить URL по умолчанию для команды указанным URL.

--no-verify-ssl (boolean)

По умолчанию AWS CLI использует SSL при взаимодействии с сервисами AWS. Для каждого SSL-соединения AWS CLI будет проверять SSL-сертификаты. Эта опция переопределяет поведение по умолчанию при проверке SSL-сертификатов.

--no-paginate (boolean)

Отключить автоматическое разбиение на страницы. Если автоматическое разбиение на страницы отключено, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (string)

Стиль форматирования для вывода команд.

  • json
  • text
  • table
  • yaml
  • yaml-stream

--query (string)

Запрос JMESPath для использования при фильтрации данных ответа.

--profile (string)

Использовать определенный профиль из вашего файла учетных данных.

--region (string)

Регион для использования. Переопределяет настройки config/env.

--version (string)

Отобразить версию этого инструмента.

--color (string)

Включить/выключить цветной вывод.

  • on
  • off
  • auto

--no-sign-request (boolean)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.

--ca-bundle (string)

Пакет сертификатов CA для использования при проверке SSL-сертификатов. Переопределяет настройки config/env.

--cli-read-timeout (int)

Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокироваться и не будет таймаута. Значение по умолчанию — 60 секунд.

--cli-connect-timeout (int)

Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокироваться и не будет таймаута. Значение по умолчанию — 60 секунд.

--cli-binary-format (string)

Стиль форматирования для двоичных больших объектов. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные большие объекты будут предоставлены в виде строки с кодировкой base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, соответствующего двоичному большому объекту, fileb:// всегда будет рассматриваться как двоичный и использовать содержимое файла напрямую, независимо от параметра cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (boolean)

Отключить пейджер CLI для вывода.

--cli-auto-prompt (boolean)

Автоматически запрашивать параметры ввода CLI.

--no-cli-auto-prompt (boolean)

Отключить автоматический запрос параметров ввода CLI.

Примеры

Примечание

Чтобы использовать следующие примеры, необходимо установить и настроить AWS CLI. Дополнительную информацию см. в руководстве Getting started в Руководстве пользователя AWS CLI .

Если не указано иное, во всех примерах используются правила цитирования, подобные unix. Эти примеры необходимо будет адаптировать к правилам цитирования вашего терминала. См. Использование кавычек со строками в Руководстве пользователя AWS CLI .

Пример 1: Чтобы расшифровать аудиофайл

Следующий пример start-transcription-job расшифровывает ваш аудиофайл.

aws transcribe start-transcription-job \
    --cli-input-json file://myfile.json

Содержимое myfile.json:

{
    "TranscriptionJobName": "cli-simple-transcription-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    }
}

Дополнительные сведения см. в разделе Начало работы (интерфейс командной строки AWS) в Руководстве разработчика Amazon Transcribe.

Пример 2: Чтобы расшифровать многоканальный аудиофайл

Следующий пример start-transcription-job расшифровывает ваш многоканальный аудиофайл.

aws transcribe start-transcription-job \
    --cli-input-json file://mysecondfile.json

Содержимое mysecondfile.json:

{
    "TranscriptionJobName": "cli-channelid-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    },
    "Settings":{
        "ChannelIdentification":true
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-channelid-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "the-language-of-your-transcription-job",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
        },
        "StartTime": "2020-09-17T16:07:56.817000+00:00",
        "CreationTime": "2020-09-17T16:07:56.784000+00:00",
        "Settings": {
            "ChannelIdentification": true
        }
    }
}

Дополнительные сведения см. в разделе Расшифровка многоканального аудио в Руководстве разработчика Amazon Transcribe.

Пример 3: Чтобы расшифровать аудиофайл и идентифицировать разных говорящих

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и идентифицирует говорящих в выходных данных расшифровки.

aws transcribe start-transcription-job \
    --cli-input-json file://mythirdfile.json

Содержимое mythirdfile.json:

{
    "TranscriptionJobName": "cli-speakerid-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    },
    "Settings":{
    "ShowSpeakerLabels": true,
    "MaxSpeakerLabels": 2
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-speakerid-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "the-language-of-your-transcription-job",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
        },
        "StartTime": "2020-09-17T16:22:59.696000+00:00",
        "CreationTime": "2020-09-17T16:22:59.676000+00:00",
        "Settings": {
            "ShowSpeakerLabels": true,
            "MaxSpeakerLabels": 2
        }
    }
}

Дополнительные сведения см. в разделе Идентификация говорящих в Руководстве разработчика Amazon Transcribe.

Пример 4: Чтобы расшифровать аудиофайл и замаскировать любые нежелательные слова в выходных данных расшифровки

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и использует фильтр словаря, который вы создали ранее, чтобы замаскировать любые нежелательные слова.

aws transcribe start-transcription-job \
    --cli-input-json file://myfourthfile.json

Содержимое myfourthfile.json:

{
    "TranscriptionJobName": "cli-filter-mask-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
          "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    },
    "Settings":{
        "VocabularyFilterName": "your-vocabulary-filter",
        "VocabularyFilterMethod": "mask"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-filter-mask-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "the-language-of-your-transcription-job",
        "Media": {
            "MediaFileUri": "s3://Amazon-S3-Prefix/your-media-file.file-extension"
        },
        "StartTime": "2020-09-18T16:36:18.568000+00:00",
        "CreationTime": "2020-09-18T16:36:18.547000+00:00",
        "Settings": {
            "VocabularyFilterName": "your-vocabulary-filter",
            "VocabularyFilterMethod": "mask"
        }
    }
}

Дополнительные сведения см. в разделе Фильтрация расшифровок в Руководстве разработчика Amazon Transcribe.

Пример 5: Чтобы расшифровать аудиофайл и удалить любые нежелательные слова в выходных данных расшифровки

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и использует фильтр словаря, который вы создали ранее, чтобы замаскировать любые нежелательные слова.

aws transcribe start-transcription-job \
    --cli-input-json file://myfifthfile.json

Содержимое myfifthfile.json:

{
    "TranscriptionJobName": "cli-filter-remove-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    },
    "Settings":{
        "VocabularyFilterName": "your-vocabulary-filter",
        "VocabularyFilterMethod": "remove"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-filter-remove-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "the-language-of-your-transcription-job",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
        },
        "StartTime": "2020-09-18T16:36:18.568000+00:00",
        "CreationTime": "2020-09-18T16:36:18.547000+00:00",
        "Settings": {
            "VocabularyFilterName": "your-vocabulary-filter",
            "VocabularyFilterMethod": "remove"
        }
    }
}

Дополнительные сведения см. в разделе Фильтрация расшифровок в Руководстве разработчика Amazon Transcribe.

Пример 6: Чтобы расшифровать аудиофайл с повышенной точностью, используя пользовательский словарь

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и использует фильтр словаря, который вы создали ранее, чтобы замаскировать любые нежелательные слова.

aws transcribe start-transcription-job \
    --cli-input-json file://mysixthfile.json

Содержимое mysixthfile.json:

{
    "TranscriptionJobName": "cli-vocab-job",
    "LanguageCode": "the-language-of-your-transcription-job",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    },
    "Settings":{
        "VocabularyName": "your-vocabulary"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-vocab-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "the-language-of-your-transcription-job",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
        },
        "StartTime": "2020-09-18T16:36:18.568000+00:00",
        "CreationTime": "2020-09-18T16:36:18.547000+00:00",
        "Settings": {
            "VocabularyName": "your-vocabulary"
        }
    }
}

Дополнительные сведения см. в разделе Фильтрация расшифровок в Руководстве разработчика Amazon Transcribe.

Пример 7: Чтобы определить язык аудиофайла и расшифровать его

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и использует фильтр словаря, который вы создали ранее, чтобы замаскировать любые нежелательные слова.

aws transcribe start-transcription-job \
    --cli-input-json file://myseventhfile.json

Содержимое myseventhfile.json:

{
    "TranscriptionJobName": "cli-identify-language-transcription-job",
    "IdentifyLanguage": true,
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-identify-language-transcription-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/Amazon-S3-prefix/your-media-file-name.file-extension"
        },
        "StartTime": "2020-09-18T22:27:23.970000+00:00",
        "CreationTime": "2020-09-18T22:27:23.948000+00:00",
        "IdentifyLanguage": true
    }
}

Дополнительные сведения см. в разделе Определение языка в Руководстве разработчика Amazon Transcribe.

Пример 8: Чтобы расшифровать аудиофайл с отредактированной личной информацией

Следующий пример start-transcription-job расшифровывает ваш аудиофайл и редактирует любую личную информацию в выходных данных расшифровки.

aws transcribe start-transcription-job \
    --cli-input-json file://myeighthfile.json

Содержимое myeigthfile.json:

{
    "TranscriptionJobName": "cli-redaction-job",
    "LanguageCode": "language-code",
    "Media": {
        "MediaFileUri": "s3://Amazon-S3-Prefix/your-media-file.file-extension"
    },
    "ContentRedaction": {
        "RedactionOutput":"redacted",
        "RedactionType":"PII"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-redaction-job",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "language-code",
        "Media": {
            "MediaFileUri": "s3://Amazon-S3-Prefix/your-media-file.file-extension"
        },
        "StartTime": "2020-09-25T23:49:13.195000+00:00",
        "CreationTime": "2020-09-25T23:49:13.176000+00:00",
        "ContentRedaction": {
            "RedactionType": "PII",
            "RedactionOutput": "redacted"
        }
    }
}

Дополнительные сведения см. в разделе Автоматическое редактирование контента в Руководстве разработчика Amazon Transcribe.

Пример 9: Чтобы создать транскрипт с отредактированной личной информацией (PII) и неотредактированный транскрипт

Следующий пример start-transcription-job создает две транскрипции вашего аудиофайла: одну с отредактированной личной информацией и другую без каких-либо правок.

aws transcribe start-transcription-job \
    --cli-input-json file://myninthfile.json

Содержимое myninthfile.json:

{
    "TranscriptionJobName": "cli-redaction-job-with-unredacted-transcript",
    "LanguageCode": "language-code",
    "Media": {
          "MediaFileUri": "s3://Amazon-S3-Prefix/your-media-file.file-extension"
        },
    "ContentRedaction": {
        "RedactionOutput":"redacted_and_unredacted",
        "RedactionType":"PII"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-redaction-job-with-unredacted-transcript",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "language-code",
        "Media": {
            "MediaFileUri": "s3://Amazon-S3-Prefix/your-media-file.file-extension"
        },
        "StartTime": "2020-09-25T23:59:47.677000+00:00",
        "CreationTime": "2020-09-25T23:59:47.653000+00:00",
        "ContentRedaction": {
            "RedactionType": "PII",
            "RedactionOutput": "redacted_and_unredacted"
        }
    }
}

Дополнительные сведения см. в разделе Автоматическое редактирование контента в Руководстве разработчика Amazon Transcribe.

Пример 10: Чтобы использовать пользовательскую языковую модель, которую вы создали ранее, для расшифровки аудиофайла.

Следующий пример start-transcription-job расшифровывает ваш аудиофайл с помощью пользовательской языковой модели, которую вы создали ранее.

aws transcribe start-transcription-job \
    --cli-input-json file://mytenthfile.json

Содержимое mytenthfile.json:

{
    "TranscriptionJobName": "cli-clm-2-job-1",
    "LanguageCode": "language-code",
    "Media": {
        "MediaFileUri": "s3://amzn-s3-demo-bucket/your-audio-file.file-extension"
    },
    "ModelSettings": {
        "LanguageModelName":"cli-clm-2"
    }
}

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "cli-clm-2-job-1",
        "TranscriptionJobStatus": "IN_PROGRESS",
        "LanguageCode": "language-code",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/your-audio-file.file-extension"
        },
        "StartTime": "2020-09-28T17:56:01.835000+00:00",
        "CreationTime": "2020-09-28T17:56:01.801000+00:00",
        "ModelSettings": {
            "LanguageModelName": "cli-clm-2"
        }
    }
}

Дополнительные сведения см. в разделе Улучшение точности расшифровки для конкретного домена с помощью пользовательских языковых моделей в Руководстве разработчика Amazon Transcribe.

Вывод

TranscriptionJob -> (структура)

Предоставляет подробную информацию о текущей работе по транскрипции, включая статус работы и, при необходимости, причину сбоя.

TranscriptionJobName -> (строка)

Имя работы по транскрипции. Имена работ чувствительны к регистру и должны быть уникальными в рамках учетной записи Amazon Web Services.

TranscriptionJobStatus -> (строка)

Предоставляет статус указанной работы по транскрипции.

Если статус равен COMPLETED, работа завершена, и вы можете найти результаты по указанному адресу в TranscriptFileUri (или RedactedTranscriptFileUri, если вы запросили редактирование транскрипта). Если статус равен FAILED, FailureReason содержит подробности о причинах сбоя работы по транскрипции.

LanguageCode -> (строка)

Код языка, используемый для создания работы по транскрипции. Этот параметр используется для определения языка. Для запросов с несколькими языками см. множественное число этого параметра, LanguageCodes.

MediaSampleRateHertz -> (целое число)

Частота дискретизации, в герцах, аудиодорожки в файле входных данных.

MediaFormat -> (строка)

Формат входного файла мультимедиа.

Media -> (структура)

Предоставляет расположение в Amazon S3 файла мультимедиа, используемого в вашем запросе.

MediaFileUri -> (строка)

Расположение файла мультимедиа в Amazon S3, который вы хотите транскрибировать. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что ведро Amazon S3, содержащее входные данные мультимедиа, должно находиться в той же области Amazon Web Services, где вы отправляете запрос на транскрипцию.

RedactedMediaFileUri -> (строка)

Расположение в Amazon S3 файла мультимедиа, который вы хотите отредактировать. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что ведро Amazon S3, содержащее входные данные мультимедиа, должно находиться в той же области Amazon Web Services, где вы отправляете запрос на транскрипцию.

Предупреждение

RedactedMediaFileUri создаёт отредактированный аудиофайл в дополнение к отредактированному транскрипту. Он поддерживается только для запросов транскрипции Call Analytics (StartCallAnalyticsJob).

Transcript -> (структура)

Предоставляет URI Amazon S3, который вы можете использовать для доступа к вашему транскрипту.

TranscriptFileUri -> (строка)

Расположение транскрипта в Amazon S3. Вы можете использовать этот URI для доступа или загрузки транскрипта.

Если вы включили OutputBucketName в запросе на работу по транскрипции, это URI этого ведра. Если вы также включили OutputKey в своём запросе, выходные данные находятся по указанному пути в вашем запросе.

Если вы не включили OutputBucketName в запросе на работу по транскрипции, ваш транскрипт хранится в управляемом сервисом ведре, и TranscriptFileUri предоставляет вам временный URI, который можно использовать для безопасного доступа к вашему транскрипту.

Примечание

Временные URI для управляемых сервисом ведёр Amazon S3 действительны только 15 минут. Если вы получите ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

RedactedTranscriptFileUri -> (строка)

Расположение отредактированного транскрипта в Amazon S3. Вы можете использовать этот URI для доступа или загрузки транскрипта.

Если вы включили OutputBucketName в запросе на работу по транскрипции, это URI этого ведра. Если вы также включили OutputKey в своём запросе, выходные данные находятся по указанному пути в вашем запросе.

Если вы не включили OutputBucketName в запросе на работу по транскрипции, ваш транскрипт хранится в управляемом сервисом ведре, и RedactedTranscriptFileUri предоставляет вам временный URI, который можно использовать для безопасного доступа к вашему транскрипту.

Примечание

Временные URI для управляемых сервисом ведёр Amazon S3 действительны только 15 минут. Если вы получите ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

StartTime -> (временная метка)

Дата и время начала обработки указанной работы по транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:32:58.789000-07:00 представляет работу по транскрипции, которая начала обработку в 12:32 по UTC-7 4 мая 2022 года.

CreationTime -> (временная метка)

Дата и время запроса на указанную работу по транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:32:58.761000-07:00 представляет работу по транскрипции, которая начала обработку в 12:32 по UTC-7 4 мая 2022 года.

CompletionTime -> (временная метка)

Дата и время завершения обработки указанной работы по транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:33:13.922000-07:00 представляет работу по транскрипции, которая начала обработку в 12:33 по UTC-7 4 мая 2022 года.

FailureReason -> (строка)

Если TranscriptionJobStatus равен FAILED, FailureReason содержит информацию о причинах сбоя запроса на работу по транскрипции.

Поле FailureReason содержит одно из следующих значений:

  • Unsupported media format. Указанный в MediaFormat формат мультимедиа неверный. См. список поддерживаемых форматов в параметре MediaFormat.
  • The media format provided does not match the detected media format. Указанный в MediaFormat формат мультимедиа не соответствует формату входного файла. Проверьте формат файла мультимедиа и исправьте указанное значение.
  • Invalid sample rate for audio file. Указанная в MediaSampleRateHertz частота дискретизации неверная. Частота дискретизации должна быть в диапазоне от 8000 до 48000 герц.
  • The sample rate provided does not match the detected sample rate. Указанная в MediaSampleRateHertz частота дискретизации не соответствует частоте дискретизации, обнаруженной в вашем входном файле мультимедиа. Проверьте частоту дискретизации вашего файла мультимедиа и исправьте указанное значение.
  • Invalid file size: file size too large. Размер вашего файла мультимедиа превышает обрабатываемую Amazon Transcribe. Дополнительную информацию см. в разделе Квоты сервиса.
  • Invalid number of channels: number of channels too large. Ваш аудиофайл содержит больше каналов, чем может обработать Amazon Transcribe. Дополнительную информацию см. в разделе Квоты сервиса.

Settings -> (структура)

Предоставляет информацию о дополнительных параметрах, включённых в ваш запрос. Дополнительные параметры включают идентификацию каналов, альтернативные транскрипции, разделение по говорящим, пользовательские словари и фильтры пользовательских словарей.

VocabularyName -> (строка)

Имя пользовательского словаря, который вы хотите использовать в запросе на работу по транскрипции. Это имя чувствительно к регистру, не может содержать пробелов и должно быть уникальным в рамках учетной записи Amazon Web Services.

ShowSpeakerLabels -> (логическое значение)

Включает разделение по говорящим (диарризацию) в выходных данных транскрипции. Разделение по говорящим помечает речь отдельных говорящих в вашем файле мультимедиа.

Если вы включили ShowSpeakerLabels в своём запросе, вы также должны включить MaxSpeakerLabels.

Дополнительную информацию см. в разделе Разделение говорящих (диарризация).

MaxSpeakerLabels -> (целое число)

Укажите максимальное количество говорящих, которые вы хотите разделить в вашем мультимедиа.

Обратите внимание, что если в вашем мультимедиа содержится больше говорящих, чем указанное число, несколько говорящих обрабатываются как один.

Если вы укажете поле MaxSpeakerLabels, вы должны установить поле ShowSpeakerLabels в значение true.

ChannelIdentification -> (логическое значение)

Включает идентификацию каналов в аудио с несколькими каналами.

Идентификация каналов транскрибирует аудио на каждом канале независимо, а затем добавляет выходные данные для каждого канала в один транскрипт.

Дополнительную информацию см. в разделе Транскрипция аудио с несколькими каналами.

ShowAlternatives -> (логическое значение)

Чтобы включить альтернативные транскрипции в выходные данные транскрипции, включите ShowAlternatives в запросе на транскрипцию.

Если у вас есть аудио с несколькими каналами и вы не включили идентификацию каналов, ваше аудио транскрибируется непрерывно, и ваш транскрипт не разделяет речь по каналам.

Если вы включили ShowAlternatives, вы также должны включить MaxAlternatives, которое является максимальным числом альтернативных транскрипций, которые Amazon Transcribe должен сгенерировать.

Дополнительную информацию см. в разделе Альтернативные транскрипции.

MaxAlternatives -> (целое число)

Укажите максимальное количество альтернативных транскрипций, которые Amazon Transcribe должен включить в ваш транскрипт.

Если вы выберете число, большее, чем число сгенерированных альтернативных транскрипций Amazon Transcribe, будут включены только фактическое количество альтернативных транскрипций.

Если вы включите MaxAlternatives в своём запросе, вы также должны включить ShowAlternatives со значением true.

Дополнительную информацию см. в разделе Альтернативные транскрипции.

VocabularyFilterName -> (строка)

Имя фильтра пользовательского словаря, который вы хотите использовать в запросе на работу по транскрипции. Это имя чувствительно к регистру, не может содержать пробелов и должно быть уникальным в рамках учетной записи Amazon Web Services.

Обратите внимание, что если вы включили VocabularyFilterName в своём запросе, вы также должны включить VocabularyFilterMethod.

VocabularyFilterMethod -> (строка)

Укажите, как вы хотите применить фильтр пользовательского словаря к вашему транскрипту.

Чтобы заменить слова на ***, выберите mask.

Чтобы удалить слова, выберите remove.

Чтобы пометить слова без изменения, выберите tag.

ModelSettings -> (структура)

Предоставляет информацию о пользовательской модели языка, включённой в ваш запрос.

LanguageModelName -> (строка)

Имя пользовательской модели языка, которую вы хотите использовать при обработке вашей работы по транскрипции. Обратите внимание, что имена пользовательских моделей языка чувствительны к регистру.

Язык указанной пользовательской модели языка должен совпадать с кодом языка, который вы указываете в запросе на транскрипцию. Если языки не совпадают, пользовательская модель языка не применяется. Неопределённость в языке не вызывает ошибок или предупреждений.

JobExecutionSettings -> (структура)

Предоставляет информацию о том, как обрабатывалась ваша транскрипционная задача. Этот параметр показывает, была ли ваша заявка помещена в очередь и какой использовался роль доступа к данным.

AllowDeferredExecution -> (boolean)

Позволяет включить помещение задачи в очередь, когда превышен предел одновременных запросов. Когда AllowDeferredExecution установлено в значение true , запросы на транскрипцию задач помещаются в очередь до тех пор, пока количество задач не станет ниже предела одновременных запросов. Если AllowDeferredExecution установлено в значение false , и количество запросов на транскрипцию задач превышает предел одновременных запросов, вы получите ошибку LimitExceededException.

Если вы включаете AllowDeferredExecution в свой запрос, вы также должны включить DataAccessRoleArn .

DataAccessRoleArn -> (string)

Идентификатор ресурса Amazon (ARN) роли IAM, имеющей разрешения на доступ к ведру Amazon S3, содержащему ваши входные файлы. Если у указанной роли нет соответствующих разрешений на доступ к указанному расположению в Amazon S3, ваш запрос завершится ошибкой.

ARN ролей IAM имеют формат arn:partition:iam::account:role/role-name-with-path . Например: arn:aws:iam::111122223333:role/Admin . Дополнительную информацию можно найти в разделе IAM ARNs .

Обратите внимание, что если вы включаете DataAccessRoleArn в свой запрос, вы также должны включить AllowDeferredExecution .

ContentRedaction -> (structure)

Указывает, было ли включено удаление контента в вашей транскрипции.

RedactionType -> (string)

Укажите категорию информации, которую вы хотите удалить; PII (лично идентифицируемая информация) является единственным допустимым значением. Вы можете использовать PiiEntityTypes, чтобы выбрать типы ПИИ, которые вы хотите удалить. Если вы не включаете PiiEntityTypes в свой запрос, удаляется вся ПИИ.

RedactionOutput -> (string)

Укажите, хотите ли вы только отредактированную транскрипцию или отредактированную и неотредактированную транскрипцию.

Когда вы выбираете redacted, Amazon Transcribe создает только отредактированную транскрипцию.

Когда вы выбираете redacted_and_unredacted, Amazon Transcribe создает отредактированную и неотредактированную транскрипцию (в виде двух отдельных файлов).

PiiEntityTypes -> (list)

Укажите типы лично идентифицируемой информации (ПИИ), которые вы хотите удалить в своей транскрипции. Вы можете указать любое количество типов или выбрать ALL. Если вы не включаете PiiEntityTypes в свой запрос, удаляется вся ПИИ.

(string)

IdentifyLanguage -> (boolean)

Указывает, была ли включена автоматическая идентификация языка (TRUE) для указанной задачи транскрипции.

IdentifyMultipleLanguages -> (boolean)

Указывает, была ли включена автоматическая идентификация нескольких языков (TRUE) для указанной задачи транскрипции.

LanguageOptions -> (list)

Предоставляет языковые коды, указанные вами в запросе.

(string)

IdentifiedLanguageScore -> (float)

Оценка уверенности, связанная с языком, идентифицированным в вашем медиафайле.

Значения оценок уверенности находятся в диапазоне от 0 до 1; большее значение указывает на более высокую вероятность того, что идентифицированный язык правильно соответствует языку, на котором произнесено ваше медиа.

LanguageCodes -> (list)

Языковые коды, используемые для создания вашей задачи транскрипции. Этот параметр используется с многоязычной идентификацией. Для запросов идентификации одного языка обратитесь к единственному варианту этого параметра, LanguageCode .

(structure)

Предоставляет информацию о речи, содержащейся в дискретном высказывании, когда многоязычная идентификация включена в ваш запрос. Это высказывание представляет собой блок речи, состоящий из одного языка, предшествующий или следующий за блоком речи на другом языке.

LanguageCode -> (string)

Предоставляет языковой код для каждого идентифицированного языка в вашем медиа.

DurationInSeconds -> (float)

Предоставляет общее время, в секундах, которое каждый идентифицированный язык произносится в вашем медиа.

Tags -> (list)

Теги, каждый в виде пары ключ-значение, присвоенные указанной задаче транскрипции.

(structure)

Добавляет метаданные в виде пары ключ-значение к указанному ресурсу.

Например, вы можете добавить тег Department:Sales к ресурсу, чтобы указать, что он относится к отделу продаж вашей организации. Вы также можете использовать теги для управления доступом на основе тегов.

Дополнительную информацию о тегах см. в разделе Тегирование ресурсов.

Key -> (string)

Первая часть пары ключ-значение, которая формирует тег, связанный с данным ресурсом. Например, в теге Department:Sales ключ равен ‘Department’.

Value -> (string)

Вторая часть пары ключ-значение, которая формирует тег, связанный с данным ресурсом. Например, в теге Department:Sales значение равно ‘Sales’.

Обратите внимание, что вы можете установить значение тега на пустую строку, но не можете установить значение тега на null. Пропуск значения тега эквивалентно использованию пустой строки.

Subtitles -> (structure)

Указывает, были ли сгенерированы субтитры с вашей транскрипцией.

Formats -> (list)

Предоставляет формат файлов субтитров. Если ваш запрос включал форматы WebVTT (vtt) и SubRip (srt), оба формата отображаются.

(string)

SubtitleFileUris -> (list)

Расположение вашего файла транскрипции в Amazon S3. Вы можете использовать этот URI для доступа к файлу субтитров или его загрузки. Файл субтитров хранится в том же месте, что и ваша транскрипция. Если вы указали форматы субтитров WebVTT и SubRip, предоставляются два URI.

Если вы включили OutputBucketName в запросе к задаче транскрипции, это URI этого ведра. Если вы также включили OutputKey в свой запрос, выходные данные находятся в указанном вами пути.

Если вы не включили OutputBucketName в свой запрос задачи транскрипции, файл субтитров хранится в управляемом службой ведре, и TranscriptFileUri предоставляет вам временный URI, который вы можете использовать для безопасного доступа к файлу субтитров.

Примечание

Временные URI для управляемых службой Amazon S3 ведер действительны только 15 минут. Если вы получите ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

(string)

OutputStartIndex -> (integer)

Предоставляет начальное значение индекса для ваших файлов субтитров. Если вы не указали значение в своем запросе, используется значение по умолчанию 0.

LanguageIdSettings -> (map)

Предоставляет имя и язык всех пользовательских языковых моделей, пользовательских словарей и пользовательских фильтров словарей, которые вы включили в свой запрос.

key -> (string)

value -> (structure)

Если в вашем запросе используется автоматическая идентификация языка и вы хотите применить пользовательскую языковую модель, пользовательский словарь или пользовательский фильтр словаря, включите LanguageIdSettings с соответствующими подпараметрами (VocabularyName, LanguageModelName и VocabularyFilterName). Обратите внимание, что многоязычная идентификация (IdentifyMultipleLanguages) не поддерживает пользовательские языковые модели.

LanguageIdSettings поддерживает от двух до пяти языковых кодов. Каждый включенный вами языковой код может иметь связанную пользовательскую языковую модель, пользовательский словарь и пользовательский фильтр словаря. Указанные вами языковые коды должны соответствовать языкам связанных пользовательских языковых моделей, пользовательских словарей и пользовательских фильтров словарей.

Рекомендуется включать LanguageOptions при использовании LanguageIdSettings, чтобы убедиться, что определен правильный диалект языка. Например, если вы укажете пользовательский словарь, который на языке en-US, но Amazon Transcribe определит, что язык, на котором произнесено ваше медиа, является en-AU, ваш пользовательский словарь не будет применен к вашей транскрипции. Если вы включите LanguageOptions и включите en-US в качестве единственного диалекта английского языка, ваш пользовательский словарь будет применен к вашей транскрипции.

Если вы хотите включить пользовательскую языковую модель в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметром LanguageModelName. Если вы хотите включить пользовательский словарь или пользовательский фильтр словаря (или оба) в свой запрос, но не хотите использовать автоматическую идентификацию языка, используйте вместо этого параметр с подпараметром VocabularyName или VocabularyFilterName (или оба).

VocabularyName -> (string)

Имя пользовательского словаря, который вы хотите использовать при обработке задачи транскрипции. Имена пользовательских словарей чувствительны к регистру.

Язык указанного пользовательского словаря должен соответствовать языковому коду, который вы указываете в запросе транскрипции. Если языки не совпадают, пользовательский словарь не применяется. Ошибки или предупреждения, связанные с несоответствием языков, отсутствуют.

VocabularyFilterName -> (string)

Имя пользовательского фильтра словаря, который вы хотите использовать при обработке задачи транскрипции. Имена пользовательских фильтров словарей чувствительны к регистру.

Язык указанного пользовательского фильтра словаря должен соответствовать языковому коду, который вы указываете в запросе транскрипции. Если языки не совпадают, пользовательский фильтр словаря не применяется. Ошибки или предупреждения, связанные с несоответствием языков, отсутствуют.

Обратите внимание, что если вы включаете VocabularyFilterName в свой запрос, вы также должны включить VocabularyFilterMethod .

LanguageModelName -> (string)

Имя пользовательской языковой модели, которую вы хотите использовать при обработке вашей задачи транскрипции. Обратите внимание, что имена пользовательских языковых моделей чувствительны к регистру.

Язык указанной пользовательской языковой модели должен соответствовать языковому коду, который вы указываете в запросе транскрипции. Если языки не совпадают, пользовательская языковая модель не применяется. Ошибки или предупреждения, связанные с несоответствием языков, отсутствуют.

ToxicityDetection -> (list)

Предоставляет информацию о настройках обнаружения токсичности, примененных к вашей транскрипции.

(structure)

Содержит ToxicityCategories, что является обязательным параметром, если вы хотите включить обнаружение токсичности (ToxicityDetection) в запросе транскрипции.

ToxicityCategories -> (list)

Если вы включаете ToxicityDetection в свой запрос транскрипции, вы также должны включить ToxicityCategories. Единственное допустимое значение для этого параметра — ALL.

(string)

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API