[ aws . transcribe ]
create-vocabulary
Описание
Создаёт новый пользовательский словарь.
При создании нового пользовательского словаря можно загрузить текстовый файл, содержащий новые записи, фразы и термины, в ведро Amazon S3 и указать URI в запросе. Или можно включить список терминов непосредственно в запрос, используя флаг Phrases.
Каждый язык имеет набор символов, который содержит все разрешённые символы для этого языка. Если вы используете неподдерживаемые символы, запрос пользовательского словаря завершается ошибкой. Обратитесь к Наборам символов для пользовательских словарей, чтобы получить набор символов для вашего языка.
Для получения дополнительной информации см. Пользовательские словари.
См. также: Документация API AWS
Синтаксис
create-vocabulary
--vocabulary-name <value>
--language-code <value>
[--phrases <value>]
[--vocabulary-file-uri <value>]
[--tags <value>]
[--data-access-role-arn <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--vocabulary-name (строка)
Уникальное имя для нового пользовательского словаря, выбранное вами.
Это имя чувствительно к регистру, не может содержать пробелы и должно быть уникальным в рамках учетной записи Amazon Web Services. Если вы попытаетесь создать новый пользовательский словарь с тем же именем, что и существующий, будет получена ошибка ConflictException.
--language-code (строка)
Код языка, представляющий язык записей в пользовательском словаре. Каждый пользовательский словарь должен содержать термины только на одном языке.
Пользовательский словарь можно использовать только для транскрибирования файлов на том же языке, что и пользовательский словарь. Например, если вы создаёте пользовательский словарь на английском языке США (en-US), вы можете применить этот пользовательский словарь только к файлам, содержащим аудио на английском языке.
Список поддерживаемых языков и соответствующих кодов языков см. в таблице Поддерживаемые языки.
Возможные значения:
af-ZAar-AEar-SAda-DKde-CHde-DEen-ABen-AUen-GBen-IEen-INen-USen-WLes-ESes-USfa-IRfr-CAfr-FRhe-ILhi-INid-IDit-ITja-JPko-KRms-MYnl-NLpt-BRpt-PTru-RUta-INte-INtr-TRzh-CNzh-TWth-THen-ZAen-NZvi-VNsv-SEab-GEast-ESaz-AZba-RUbe-BYbg-BGbn-INbs-BAca-ESckb-IQckb-IRcs-CZcy-WLel-GRet-ETeu-ESfi-FIgl-ESgu-INha-NGhr-HRhu-HUhy-AMis-ISka-GEkab-DZkk-KZkn-INky-KGlg-INlt-LTlv-LVmhr-RUmi-NZmk-MKml-INmn-MNmr-INmt-MTno-NOor-INpa-INpl-PLps-AFro-ROrw-RWsi-LKsk-SKsl-SIso-SOsr-RSsu-IDsw-BIsw-KEsw-RWsw-TZsw-UGtl-PHtt-RUug-CNuk-UAuz-UZwo-SNzh-HKzu-ZA
--phrases (список)
Используйте этот параметр, если вы хотите создать пользовательский словарь, включив все необходимые термины в виде значений, разделённых запятыми, в ваш запрос. Другой вариант создания пользовательского словаря — сохранить записи в текстовом файле и загрузить их в ведро Amazon S3, а затем указать расположение файла, используя параметр VocabularyFileUri.
Обратите внимание, что если вы включаете Phrases в ваш запрос, вы не можете использовать VocabularyFileUri; вы должны выбрать один из них.
Каждый язык имеет набор символов, который содержит все разрешённые символы для этого языка. Если вы используете неподдерживаемые символы, запрос фильтра пользовательского словаря завершается ошибкой. Обратитесь к Наборам символов для пользовательских словарей, чтобы получить набор символов для вашего языка.
(строка)
Синтаксис:
"string" "string" ...
--vocabulary-file-uri (строка)
Расположение в Amazon S3 текстового файла, содержащего пользовательский словарь. URI должен находиться в той же области Amazon Web Services, что и ресурс, к которому вы обращаетесь.
Вот пример пути URI: s3://DOC-EXAMPLE-BUCKET/my-vocab-file.txt
Обратите внимание, что если вы включаете VocabularyFileUri в свой запрос, вы не можете использовать флаг Phrases; вы должны выбрать один из них.
--tags (список)
Добавляет один или несколько пользовательских тегов, каждый в виде пары ключ:значение, к новому пользовательскому словарю во время создания этого словаря.
Дополнительные сведения об использовании тегов с Amazon Transcribe см. в разделе Тегирование ресурсов.
(структура)
Добавляет метаданные в виде пары ключ:значение к указанному ресурсу.
Например, вы можете добавить тег Department:Sales к ресурсу, чтобы указать, что он относится к отделу продаж вашей организации. Вы также можете использовать теги для управления доступом на основе тегов.
Дополнительные сведения о тегах см. в разделе Тегирование ресурсов.
Ключ -> (строка)
Department:Sales ключ — «Отдел».Значение -> (строка)
Вторая часть пары ключ:значение, которая образует тег, связанный с данным ресурсом. Например, в теге Department:Sales значение — «Продажи».
Обратите внимание, что вы можете задать значение тега как пустую строку, но не можете задать значение тега как null. Пропуск значения тега эквивалентен использованию пустой строки.
Сокращённый синтаксис:
Key=string,Value=string ...
Синтаксис JSON:
[
{
"Key": "string",
"Value": "string"
}
...
]
--data-access-role-arn (строка)
Идентификатор ресурса Amazon (ARN) роли IAM, у которой есть разрешения на доступ к ведру Amazon S3, содержащему входные файлы (в данном случае — ваш пользовательский словарь). Если у указанной роли нет соответствующих разрешений на доступ к указанному расположению Amazon S3, запрос завершается ошибкой.
ARN ролей IAM имеют формат arn:partition:iam::account:role/role-name-with-path. Например: arn:aws:iam::111122223333:role/Admin.
Дополнительные сведения см. в разделе ARN IAM.
--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, предоставленному в --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения переопределяют значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения с помощью значения, предоставленного в JSON, поскольку строка будет воспринята буквально. Это может не быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. При отсутствии значения или при значении input выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, при значении yaml-input он выведет пример входного YAML, который можно использовать с --cli-input-yaml. При значении output он валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет не является стабильным между версиями AWS CLI, и нет гарантии обратной совместимости в сгенерированном JSON-скелете.
Глобальные параметры
--debug (boolean)
Включить отладку логов.
--endpoint-url (string)
Переопределить стандартный URL команды заданным URL.
--no-verify-ssl (boolean)
По умолчанию, AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI проверяет SSL-сертификаты. Этот параметр переопределяет стандартное поведение проверки SSL-сертификатов.
--no-paginate (boolean)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (string)
Стиль форматирования вывода команд.
- json
- text
- table
- yaml
- yaml-stream
--query (string)
Запрос JMESPath для фильтрации данных ответа.
--profile (string)
Использовать определённый профиль из файла аутентификации.
--region (string)
Регион для использования. Переопределяет настройки из конфигурации/среды.
--version (string)
Показать версию этого инструмента.
--color (string)
Включить/выключить цветной вывод.
- on
- off
- auto
--no-sign-request (boolean)
Не подписывать запросы. Кредиты не будут загружены, если этот аргумент предоставлен.
--ca-bundle (string)
Файл сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки из конфигурации/среды.
--cli-read-timeout (int)
Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет выполняться без ограничения по времени. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (int)
Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет выполняться без ограничения по времени. Значение по умолчанию — 60 секунд.
--cli-binary-format (string)
Стиль форматирования для двоичных блоков. По умолчанию используется формат base64. Формат base64 ожидает, что двоичные блоки будут предоставлены в виде закодированной в base64 строки. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны быть переданы буквально. При предоставлении содержимого из файла, которое соответствует двоичному блоку, fileb:// всегда будет обрабатываться как двоичное и использовать содержимое файла напрямую независимо от настроек cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (boolean)
Отключить паджер CLI для вывода.
--cli-auto-prompt (boolean)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (boolean)
Отключить автоматическое запросы параметров ввода CLI.
Примеры
Примечание
Для использования следующих примеров, необходимо установить и настроить AWS CLI. Более подробную информацию см. в руководстве по началу работы в Руководстве пользователя AWS CLI.
Если не указано иное, все примеры используют правила цитирования, похожие на Unix. Эти примеры необходимо адаптировать к правилам цитирования вашей терминальной среды. Подробнее см. Раздел "Использование кавычек со строками" в Руководстве пользователя AWS CLI.
Создание пользовательского словаря
Следующий пример create-vocabulary создаёт пользовательский словарь. Для создания пользовательского словаря вам необходимо создать текстовый файл со всеми терминами, которые вы хотите транскрибировать более точно. Для vocabulary-file-uri укажите URI Amazon Simple Storage Service (Amazon S3) этого текстового файла. Для language-code укажите код языка, соответствующий языку вашего пользовательского словаря. Для vocabulary-name укажите желаемое имя вашего пользовательского словаря.
aws transcribe create-vocabulary \
--language-code language-code \
--vocabulary-name cli-vocab-example \
--vocabulary-file-uri s3://amzn-s3-demo-bucket/Amazon-S3-prefix/the-text-file-for-the-custom-vocabulary.txt
Вывод:
{
"VocabularyName": "cli-vocab-example",
"LanguageCode": "language-code",
"VocabularyState": "PENDING"
}
Дополнительную информацию см. в разделе "Пользовательские словари" в Руководстве разработчика Amazon Transcribe.
Вывод
VocabularyName -> (string)
LanguageCode -> (string)
VocabularyState -> (string)
READY, вы можете использовать пользовательский словарь в запросе StartTranscriptionJob.LastModifiedTime -> (timestamp)
Дата и время создания пользовательского словаря.
Формат временных меток: YYYY-MM-DD'T'HH:MM:SS.SSSSSS-UTC. Например, 2022-05-04T12:32:58.761000-07:00 соответствует 12:32 по UTC-7 4 мая 2022 года.
FailureReason -> (string)
VocabularyState равно FAILED, FailureReason содержит информацию о причинах неудачи запроса на создание пользовательского словаря. См. также: Распространённые ошибки.
© Copyright 2025, Amazon Web Services. Created using Sphinx.