Spec-Zone.ru › AWS CLI v2

[ aws . transcribe ]

get-transcription-job

Описание

Предоставляет информацию о заданном задании транскрипции.

Чтобы просмотреть статус заданного задания транскрипции, проверьте поле TranscriptionJobStatus. Если статус равен COMPLETED, задание завершено. Результаты можно найти по адресу, указанному в TranscriptFileUri. Если статус равен FAILED, FailureReason предоставляет подробную информацию о причинах сбоя задания транскрипции.

Если вы включили редактирование контента, отредактированный текст транскрипции можно найти по адресу, указанному в RedactedTranscriptFileUri.

Чтобы получить список ваших заданий транскрипции, используйте операцию.

См. также: Документация API AWS

Синтаксис

  get-transcription-job
--transcription-job-name <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--transcription-job-name (строка)

Имя задания транскрипции, о котором требуется получить информацию. Имена заданий чувствительны к регистру.

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка следует формату, предоставленному в --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные JSON. Передача произвольных двоичных значений с помощью значения, предоставленного JSON, невозможна, так как строка будет воспринята буквально. Это не может быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если предоставлено значение без значения или значение input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, он проверит входные данные команды и вернет пример выходного JSON для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.

Глобальные параметры

--debug (логическое значение)

Включает отладочную запись журналов.

--endpoint-url (строка)

Переопределяет URL по умолчанию команды указанным URL.

--no-verify-ssl (логическое значение)

По умолчанию AWS CLI использует SSL при взаимодействии с AWS-сервисами. Для каждого подключения SSL AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет поведение проверки сертификатов SSL по умолчанию.

--no-paginate (логическое значение)

Отключает автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI будет выполнять только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования вывода команды.

  • json
  • text
  • table
  • yaml
  • yaml-stream

--query (строка)

Запрос JMESPath для фильтрации данных ответа.

--profile (строка)

Использование определенного профиля из файла учетных данных.

--region (строка)

Регион для использования. Переопределяет настройки конфигурации/окружения.

--version (строка)

Отображение версии этого инструмента.

--color (строка)

Включение/выключение цветного вывода.

  • on
  • off
  • auto

--no-sign-request (логическое значение)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.

--ca-bundle (строка)

Набор сертификатов CA для использования при проверке сертификатов SSL. Переопределяет настройки конфигурации/окружения.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет выполняться блокирующим образом и не будет ограничено по времени. Значение по умолчанию составляет 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет выполняться блокирующим образом и не будет ограничено по времени. Значение по умолчанию составляет 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, отображающего двоичный блок fileb://, всегда будет рассматриваться как двоичный и будет использоваться содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (логическое значение)

Отключение пейджера cli для вывода.

--cli-auto-prompt (логическое значение)

Автоматически запрашивать параметры ввода CLI.

--no-cli-auto-prompt (логическое значение)

Отключить автоматический запрос параметров ввода CLI.

Примеры

Примечание

Для использования следующих примеров необходимо установить и настроить AWS CLI. Дополнительную информацию см. в руководстве по началу работы в руководстве пользователя AWS CLI.

Если не указано иное, все примеры используют правила цитирования unix-подобных систем. Эти примеры необходимо адаптировать к правилам цитирования вашей терминальной оболочки. См. использование кавычек со строками в руководстве пользователя AWS CLI .

Получение информации о конкретном задании транскрипции

Следующий get-transcription-job пример получает информацию о конкретном задании транскрипции. Для доступа к результатам транскрипции используйте параметр TranscriptFileUri. Используйте параметр MediaFileUri, чтобы увидеть, какой аудиофайл вы транскрибировали с помощью этого задания. Вы можете использовать объект Settings, чтобы увидеть опциональные функции, которые вы включили в задании транскрипции.

aws transcribe get-transcription-job \
    --transcription-job-name your-transcription-job

Вывод:

{
    "TranscriptionJob": {
        "TranscriptionJobName": "your-transcription-job",
        "TranscriptionJobStatus": "COMPLETED",
        "LanguageCode": "language-code",
        "MediaSampleRateHertz": 48000,
        "MediaFormat": "mp4",
        "Media": {
            "MediaFileUri": "s3://amzn-s3-demo-bucket/your-audio-file.file-extension"
        },
        "Transcript": {
            "TranscriptFileUri": "https://Amazon-S3-file-location-of-transcription-output"
        },
        "StartTime": "2020-09-18T22:27:23.970000+00:00",
        "CreationTime": "2020-09-18T22:27:23.948000+00:00",
        "CompletionTime": "2020-09-18T22:28:21.197000+00:00",
        "Settings": {
            "ChannelIdentification": false,
            "ShowAlternatives": false
        },
        "IdentifyLanguage": true,
        "IdentifiedLanguageScore": 0.8672199249267578
    }
}

Дополнительную информацию см. в разделе Начало работы (AWS Command Line Interface) в Руководстве разработчика Amazon Transcribe.

Вывод

TranscriptionJob -> (структура)

Предоставляет подробную информацию о задании транскрипции, включая статус задания и, при необходимости, причину ошибки.

TranscriptionJobName -> (строка)

Имя задания транскрипции. Имена заданий чувствительны к регистру и должны быть уникальными в рамках учетной записи Amazon Web Services.

TranscriptionJobStatus -> (строка)

Предоставляет статус указанного задания транскрипции.

Если статус равен COMPLETED, задание завершено, и результаты можно найти по адресу, указанному в TranscriptFileUri (или RedactedTranscriptFileUri, если была запрошена редакция транскрипта). Если статус равен FAILED, FailureReason предоставляет подробности о причинах сбоя задания транскрипции.

LanguageCode -> (строка)

Код языка, используемый для создания задания транскрипции. Этот параметр используется для одноязычного распознавания. Для запросов распознавания по нескольким языкам следует обратиться к множественной версии этого параметра, LanguageCodes.

MediaSampleRateHertz -> (целое число)

Частота дискретизации, в герцах, аудиодорожки в вашем файле входных данных.

MediaFormat -> (строка)

Формат файла входных данных.

Media -> (структура)

Предоставляет расположение файла медиа в Amazon S3, которое использовалось в вашем запросе.

MediaFileUri -> (строка)

Расположение файла медиа в Amazon S3, который вы хотите транскрибировать. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что хранилище Amazon S3, содержащее ваши входные данные, должно находиться в той же области Amazon Web Services, где вы отправляете запрос на транскрипцию.

RedactedMediaFileUri -> (строка)

Расположение файла медиа в Amazon S3, который вы хотите отредактировать. Например:

  • s3://DOC-EXAMPLE-BUCKET/my-media-file.flac
  • s3://DOC-EXAMPLE-BUCKET/media-files/my-media-file.flac

Обратите внимание, что хранилище Amazon S3, содержащее ваши входные данные, должно находиться в той же области Amazon Web Services, где вы отправляете запрос на транскрипцию.

Предупреждение

RedactedMediaFileUri создаёт отредактированный аудиофайл в дополнение к отредактированному транскрипту. Он поддерживается только для запросов транскрипции Call Analytics (StartCallAnalyticsJob).

Transcript -> (структура)

Предоставляет вам URI Amazon S3, который можно использовать для доступа к вашей транскрипции.

TranscriptFileUri -> (строка)

Расположение вашей транскрипции в Amazon S3. Вы можете использовать этот URI для доступа к вашей транскрипции или её скачивания.

Если вы включили OutputBucketName в свой запрос на задание транскрипции, это URI этого хранилища. Если вы также включили OutputKey в свой запрос, выходные данные находятся по указанному вами пути.

Если вы не включили OutputBucketName в свой запрос на задание транскрипции, ваша транскрипция хранится в управляемом сервисом хранилище, и TranscriptFileUri предоставляет вам временный URI для безопасного доступа к вашей транскрипции.

Примечание

Временные URI для управляемых сервисом хранилищ Amazon S3 действительны только 15 минут. Если вы получите ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

RedactedTranscriptFileUri -> (строка)

Расположение вашей отредактированной транскрипции в Amazon S3. Вы можете использовать этот URI для доступа к вашей транскрипции или её скачивания.

Если вы включили OutputBucketName в свой запрос на задание транскрипции, это URI этого хранилища. Если вы также включили OutputKey в свой запрос, выходные данные находятся по указанному вами пути.

Если вы не включили OutputBucketName в свой запрос на задание транскрипции, ваша транскрипция хранится в управляемом сервисом хранилище, и RedactedTranscriptFileUri предоставляет вам временный URI для безопасного доступа к вашей транскрипции.

Примечание

Временные URI для управляемых сервисом хранилищ Amazon S3 действительны только 15 минут. Если вы получите ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

StartTime -> (временная метка)

Дата и время начала обработки указанного задания транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:32:58.789000-07:00 представляет собой задание транскрипции, которое начало обработку в 12:32 по UTC-7 4 мая 2022 года.

CreationTime -> (временная метка)

Дата и время создания запроса на указанное задание транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:32:58.761000-07:00 представляет собой задание транскрипции, которое начало обработку в 12:32 по UTC-7 4 мая 2022 года.

CompletionTime -> (временная метка)

Дата и время завершения обработки указанного задания транскрипции.

Временные метки имеют формат YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:33:13.922000-07:00 представляет собой задание транскрипции, которое начало обработку в 12:33 по UTC-7 4 мая 2022 года.

FailureReason -> (строка)

Если TranscriptionJobStatus имеет значение FAILED, FailureReason содержит информацию о причинах сбоя запроса на задание транскрипции.

Поле FailureReason содержит одно из следующих значений:

  • Unsupported media format. Указанный в MediaFormat формат медиа недействителен. Обратитесь к параметру MediaFormat для получения списка поддерживаемых форматов.
  • The media format provided does not match the detected media format. Указанный в MediaFormat формат медиа не соответствует формату входного файла. Проверьте формат медиа вашего файла и исправьте указанное значение.
  • Invalid sample rate for audio file. Указанная в MediaSampleRateHertz частота дискретизации недействительна. Частота дискретизации должна быть между 8000 и 48000 герц.
  • The sample rate provided does not match the detected sample rate. Указанная в MediaSampleRateHertz частота дискретизации не соответствует частоте дискретизации, обнаруженной в вашем файле входных данных. Проверьте частоту дискретизации вашего файла медиа и исправьте указанное значение.
  • Invalid file size: file size too large. Размер вашего файла медиа превышает предел, обрабатываемый Amazon Transcribe. Для получения дополнительной информации обратитесь к квотам сервиса.
  • Invalid number of channels: number of channels too large. Ваш аудиофайл содержит больше каналов, чем может обработать Amazon Transcribe. Для получения дополнительной информации обратитесь к квотам сервиса.

Settings -> (структура)

Предоставляет информацию о дополнительных параметрах, включённых в ваш запрос. Дополнительные параметры включают идентификацию каналов, альтернативные транскрипции, разделение говорящих, пользовательские словари и фильтры пользовательских словарей.

VocabularyName -> (строка)

Имя пользовательского словаря, который вы хотите использовать в своём запросе на задание транскрипции. Это имя чувствительно к регистру, не может содержать пробелов и должно быть уникальным в пределах вашей учетной записи Amazon Web Services.

ShowSpeakerLabels -> (булево значение)

Включает разделение говорящих (диарризацию) в выходных данных транскрипции. Разделение говорящих отмечает речь отдельных говорящих в вашем файле медиа.

Если вы включили ShowSpeakerLabels в своём запросе, вы также должны включить MaxSpeakerLabels.

Для получения дополнительной информации см. Разделение говорящих (диарризация).

MaxSpeakerLabels -> (целое число)

Укажите максимальное количество говорящих, которые вы хотите разделить в своём медиа.

Обратите внимание, что если ваше медиа содержит больше говорящих, чем указанное число, несколько говорящих обрабатываются как один.

Если вы указываете поле MaxSpeakerLabels, вы должны установить поле ShowSpeakerLabels в значение true.

ChannelIdentification -> (булево значение)

Включает идентификацию каналов в аудио с несколькими каналами.

Идентификация каналов транскрибирует аудио на каждом канале независимо, а затем добавляет выходные данные каждого канала в одну транскрипцию.

Для получения дополнительной информации см. Транскрибирование аудио с несколькими каналами.

ShowAlternatives -> (булево значение)

Чтобы включить альтернативные транскрипции в выходные данные транскрипции, включите ShowAlternatives в свой запрос на транскрипцию.

Если у вас многоканальное аудио и вы не включили идентификацию каналов, аудио транскрибируется непрерывно, и ваша транскрипция не разделяет речь по каналам.

Если вы включите ShowAlternatives, вы также должны включить MaxAlternatives, что является максимальным количеством альтернативных транскрипций, которые вы хотите сгенерировать Amazon Transcribe.

Для получения дополнительной информации см. Альтернативные транскрипции.

MaxAlternatives -> (целое число)

Укажите максимальное количество альтернативных транскрипций, которые вы хотите включить в свою транскрипцию.

Если вы выберете число, большее, чем количество альтернативных транскрипций, сгенерированных Amazon Transcribe, будут включены только фактическое количество альтернативных транскрипций.

Если вы включили MaxAlternatives в своём запросе, вы также должны включить ShowAlternatives со значением true.

Для получения дополнительной информации см. Альтернативные транскрипции.

VocabularyFilterName -> (строка)

Имя фильтра пользовательского словаря, который вы хотите использовать в своём запросе на задание транскрипции. Это имя чувствительно к регистру, не может содержать пробелов и должно быть уникальным в рамках вашей учетной записи Amazon Web Services.

Обратите внимание, что если вы включили VocabularyFilterName в своём запросе, вы также должны включить VocabularyFilterMethod.

VocabularyFilterMethod -> (строка)

Укажите, как вы хотите применить фильтр пользовательского словаря к вашей транскрипции.

Чтобы заменить слова ***, выберите mask.

Чтобы удалить слова, выберите remove.

Чтобы пометить слова без их изменения, выберите tag.

ModelSettings -> (структура)

Предоставляет информацию о пользовательской языковой модели, включённой в ваш запрос.

LanguageModelName -> (строка)

Имя пользовательской языковой модели, которую вы хотите использовать при обработке вашего задания транскрипции. Обратите внимание, что имена пользовательских языковых моделей чувствительны к регистру.

Язык указанной пользовательской языковой модели должен совпадать с кодом языка, который вы указываете в своём запросе на транскрипцию. Если языки не совпадают, пользовательская языковая модель не применяется. Несоответствие языков не сопровождается ошибками или предупреждениями.

JobExecutionSettings -> (структура)

Предоставляет информацию о том, как обрабатывался ваш транскрипционный запрос. Этот параметр показывает, был ли ваш запрос помещен в очередь и какая роль доступа к данным была использована.

AllowDeferredExecution -> (boolean)

Позволяет включить помещение задания в очередь, когда превзойден лимит одновременных запросов. Когда AllowDeferredExecution установлен в значение true, запросы на транскрипционные задания помещаются в очередь до тех пор, пока количество заданий не снизится ниже лимита одновременных запросов. Если AllowDeferredExecution установлен в значение false, и количество запросов на транскрипционные задания превышает лимит одновременных запросов, вы получаете ошибку LimitExceededException.

Если вы включаете AllowDeferredExecution в свой запрос, вы также должны включить DataAccessRoleArn.

DataAccessRoleArn -> (string)

Идентификатор ресурса Amazon (ARN) роли IAM, имеющей разрешения на доступ к ведру Amazon S3, содержащему ваши входные файлы. Если у указанной роли нет необходимых разрешений на доступ к указанному расположению Amazon S3, ваш запрос завершится неудачей.

ARN ролей IAM имеют формат arn:partition:iam::account:role/role-name-with-path. Например: arn:aws:iam::111122223333:role/Admin. Для получения дополнительной информации см. IAM ARN.

Обратите внимание, что если вы включаете DataAccessRoleArn в свой запрос, вы также должны включить AllowDeferredExecution.

ContentRedaction -> (structure)

Указывает, было ли включено удаление контента в вашей транскрипции.

RedactionType -> (string)

Укажите категорию информации, которую вы хотите удалить; PII (лично идентифицируемая информация) — единственное допустимое значение. Вы можете использовать PiiEntityTypes для выбора типов ПИИ, которые вы хотите удалить. Если вы не включите PiiEntityTypes в свой запрос, вся ПИИ будет удалена.

RedactionOutput -> (string)

Укажите, хотите ли вы только отформатированную транскрипцию или отформатированную и неотформатированную транскрипцию.

Если вы выберете redacted, Amazon Transcribe создаст только отформатированную транскрипцию.

Если вы выберете redacted_and_unredacted, Amazon Transcribe создаст отформатированную и неотформатированную транскрипцию (как два отдельных файла).

PiiEntityTypes -> (list)

Укажите типы лично идентифицируемой информации (ПИИ), которые вы хотите удалить в своей транскрипции. Вы можете включить любое количество типов или выбрать ALL. Если вы не включите PiiEntityTypes в свой запрос, вся ПИИ будет удалена.

(string)

IdentifyLanguage -> (boolean)

Указывает, было ли включено автоматическое определение языка (TRUE) для указанного транскрипционного задания.

IdentifyMultipleLanguages -> (boolean)

Указывает, было ли включено автоматическое определение нескольких языков (TRUE) для указанного транскрипционного задания.

LanguageOptions -> (list)

Предоставляет языковые коды, которые вы указали в своем запросе.

(string)

IdentifiedLanguageScore -> (float)

Счет уверенности, связанный с языком, определенным в вашем медиафайле.

Счет уверенности — это значения от 0 до 1; более высокое значение указывает на более высокую вероятность того, что определенный язык соответствует языку, на котором произносится ваш медиафайл.

LanguageCodes -> (list)

Языковые коды, использованные для создания вашего транскрипционного задания. Этот параметр используется с определением нескольких языков. Для запросов определения одного языка см. единственное значение этого параметра, LanguageCode.

(structure)

Предоставляет информацию о речи, содержащейся в отдельном высказывании, когда в вашем запросе включено определение нескольких языков. Это высказывание представляет собой блок речи, состоящий из одного языка, предшествующий или следующий за блоком речи на другом языке.

LanguageCode -> (string)

Предоставляет языковой код для каждого идентифицированного языка в вашем медиафайле.

DurationInSeconds -> (float)

Предоставляет общее время, в секундах, которое каждый идентифицированный язык произносится в вашем медиафайле.

Tags -> (list)

Теги, каждый в виде пары ключ:значение, назначенные указанному транскрипционному заданию.

(structure)

Добавляет метаданные в виде пары ключ:значение к указанному ресурсу.

Например, вы можете добавить тег Department:Sales к ресурсу, чтобы указать, что он относится к отделу продаж вашей организации. Вы также можете использовать теги для управления доступом на основе тегов.

Дополнительную информацию о тегах см. в разделе Тегирование ресурсов.

Key -> (string)

Первая часть пары ключ:значение, которая образует тег, связанный с данным ресурсом. Например, в теге Department:Sales ключом является «Отдел».

Value -> (string)

Вторая часть пары ключ:значение, которая образует тег, связанный с данным ресурсом. Например, в теге Department:Sales значением является «Продажи».

Обратите внимание, что вы можете установить значение тега в пустую строку, но не можете установить значение тега в null. Пропуск значения тега эквивалентно использованию пустой строки.

Subtitles -> (structure)

Указывает, были ли сгенерированы субтитры с вашей транскрипцией.

Formats -> (list)

Предоставляет формат ваших файлов субтитров. Если ваш запрос включал форматы WebVTT (vtt) и SubRip (srt), оба формата отображаются.

(string)

SubtitleFileUris -> (list)

Расположение Amazon S3 вашей транскрипции. Вы можете использовать этот URI для доступа к файлу субтитров или его загрузки. Файл субтитров хранится в том же месте, что и ваша транскрипция. Если вы указали форматы субтитров WebVTT и SubRip, предоставляются два URI.

Если вы включили OutputBucketName в запрос на транскрипцию, это URI этого ведра. Если вы также включили OutputKey в свой запрос, выходные данные находятся в указанном вами пути.

Если вы не включили OutputBucketName в запрос на транскрипцию, ваш файл субтитров хранится в ведре, управляемом службой, и TranscriptFileUri предоставляет вам временный URI, который вы можете использовать для безопасного доступа к файлу субтитров.

Примечание

Временные URI для ведер Amazon S3, управляемых службой, действительны только в течение 15 минут. Если вы получаете ошибку AccesDenied, вы можете получить новый временный URI, выполнив запрос GetTranscriptionJob или ListTranscriptionJob.

(string)

OutputStartIndex -> (integer)

Предоставляет начальное значение индекса для ваших файлов субтитров. Если вы не указали значение в запросе, используется значение по умолчанию 0.

LanguageIdSettings -> (map)

Предоставляет имя и язык всех пользовательских языковых моделей, пользовательских словарей и пользовательских фильтров словарей, которые вы включили в свой запрос.

key -> (string)

value -> (structure)

Если вы используете автоматическое определение языка в запросе и хотите применить пользовательскую языковую модель, пользовательский словарь или пользовательский фильтр словаря, включите LanguageIdSettings с соответствующими подпараметрами (VocabularyName, LanguageModelName и VocabularyFilterName). Обратите внимание, что определение нескольких языков (IdentifyMultipleLanguages) не поддерживает пользовательские языковые модели.

LanguageIdSettings поддерживает от двух до пяти языковых кодов. Каждый включенный вами языковой код может иметь связанную пользовательскую языковую модель, пользовательский словарь и пользовательский фильтр словаря. Указанные вами языковые коды должны соответствовать языкам связанных пользовательских языковых моделей, пользовательских словарей и пользовательских фильтров словарей.

Рекомендуется включить LanguageOptions при использовании LanguageIdSettings, чтобы гарантировать, что будет определен правильный диалект языка. Например, если вы указываете пользовательский словарь, который на языке en-US, но Amazon Transcribe определит, что язык, на котором произносится ваш медиафайл, — en-AU, ваш пользовательский словарь не будет применен к вашей транскрипции. Если вы включите LanguageOptions и укажете en-US как единственный диалект английского языка, ваш пользовательский словарь будет применён к вашей транскрипции.

Если вы хотите включить пользовательскую языковую модель со своим запросом, но не хотите использовать автоматическое определение языка, используйте вместо этого параметр с подпараметром LanguageModelName. Если вы хотите включить пользовательский словарь или пользовательский фильтр словаря (или оба) со своим запросом, но не хотите использовать автоматическое определение языка, используйте вместо этого параметр с подпараметром VocabularyName или VocabularyFilterName (или оба).

VocabularyName -> (string)

Имя пользовательского словаря, которое вы хотите использовать при обработке вашего транскрипционного задания. Имена пользовательских словарей чувствительны к регистру.

Язык указанного пользовательского словаря должен соответствовать языковому коду, который вы указываете в своем запросе на транскрипцию. Если языки не совпадают, пользовательский словарь не применяется. Соответствия языков не сопровождаются ошибками или предупреждениями.

VocabularyFilterName -> (string)

Имя пользовательского фильтра словаря, которое вы хотите использовать при обработке вашего транскрипционного задания. Имена пользовательских фильтров словарей чувствительны к регистру.

Язык указанного пользовательского фильтра словаря должен соответствовать языковому коду, который вы указываете в своем запросе на транскрипцию. Если языки не совпадают, пользовательский фильтр словаря не применяется. Соответствия языков не сопровождаются ошибками или предупреждениями.

Обратите внимание, что если вы включаете VocabularyFilterName в свой запрос, вы также должны включить VocabularyFilterMethod.

LanguageModelName -> (string)

Имя пользовательской языковой модели, которую вы хотите использовать при обработке вашего транскрипционного задания. Обратите внимание, что имена пользовательских языковых моделей чувствительны к регистру.

Язык указанной пользовательской языковой модели должен соответствовать языковому коду, который вы указываете в запросе на транскрипцию. Если языки не совпадают, пользовательская языковая модель не применяется. Соответствия языков не сопровождаются ошибками или предупреждениями.

ToxicityDetection -> (list)

Предоставляет информацию о настройках обнаружения токсичности, примененных к вашей транскрипции.

(structure)

Содержит ToxicityCategories, который является обязательным параметром, если вы хотите включить обнаружение токсичности (ToxicityDetection) в своем запросе на транскрипцию.

ToxicityCategories -> (list)

Если вы включаете ToxicityDetection в свой запрос на транскрипцию, вы также должны включить ToxicityCategories. Единственное допустимое значение для этого параметра — ALL.

(string)

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API