Spec-Zone.ru › AWS CLI v2

[ aws . comprehend ]

list-document-classification-jobs

Описание

Получает список заданий классификации документов, которые вы отправили.

См. также: Документацию API AWS

list-document-classification-jobs — это операции с постраничной выборкой. Для получения всего набора результатов могут быть выполнены несколько вызовов API. Вы можете отключить постраничную выборку, указав аргумент --no-paginate. При использовании --output text и аргумента --query в ответе с постраничной выборкой аргумент --query должен извлекать данные из результатов следующих выражений запроса: DocumentClassificationJobPropertiesList

Синтаксис

  list-document-classification-jobs
[--filter <value>]
[--cli-input-json | --cli-input-yaml]
[--starting-token <value>]
[--page-size <value>]
[--max-items <value>]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--filter (структура)

Фильтрует возвращаемые задания. Вы можете фильтровать задания по их именам, статусам или дате и времени их отправки. Вы можете задать только один фильтр за раз.

JobName -> (строка)

Фильтрует по имени задания.

JobStatus -> (строка)

Фильтрует список на основе статуса задания. Возвращает только задания с указанным статусом.

SubmitTimeBefore -> (метка времени)

Фильтрует список заданий на основе времени, когда задание было отправлено на обработку. Возвращает только задания, отправленные до указанного времени. Задания возвращаются в порядке возрастания, от старейшего к новейшему.

SubmitTimeAfter -> (метка времени)

Фильтрует список заданий на основе времени, когда задание было отправлено на обработку. Возвращает только задания, отправленные после указанного времени. Задания возвращаются в порядке убывания, от новейшего к старейшему.

Сокращенный синтаксис:

JobName=string,JobStatus=string,SubmitTimeBefore=timestamp,SubmitTimeAfter=timestamp

Синтаксис JSON:

{
  "JobName": "string",
  "JobStatus": "SUBMITTED"|"IN_PROGRESS"|"COMPLETED"|"FAILED"|"STOP_REQUESTED"|"STOPPED",
  "SubmitTimeBefore": timestamp,
  "SubmitTimeAfter": timestamp
}

--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON следует формату, предоставленному --generate-cli-skeleton. Если другие аргументы указаны в командной строке, эти значения переопределят значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения с помощью предоставленного значения JSON, так как строка будет взята буквально. Это может не быть указано вместе с --cli-input-yaml.

--starting-token (строка)

Маркер для указания места начала постраничной выборки. Это NextToken из ранее укороченного ответа.

Примеры использования см. в разделе Постраничная выборка в руководстве пользователя AWS CLI.

--page-size (целое число)

Размер каждой страницы для получения данных в вызове AWS-сервиса. Это не влияет на количество элементов, возвращаемых в выводе команды. Установка меньшего размера страницы приводит к большему количеству вызовов AWS-сервиса, получая меньше элементов в каждом вызове. Это может помочь предотвратить истечение времени ожидания вызовов AWS-сервиса.

Примеры использования см. в разделе Постраничная выборка в руководстве пользователя AWS CLI.

--max-items (целое число)

Общее количество элементов для возврата в выводе команды. Если общее количество доступных элементов превышает указанное значение, в выводе команды предоставляется NextToken. Для возобновления постраничной выборки укажите значение NextToken в аргументе starting-token последующей команды. **Не** используйте элемент ответа NextToken напрямую вне AWS CLI.

Примеры использования см. в разделе Постраничная выборка в руководстве пользователя AWS CLI.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, оно выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, оно проверяет входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет не является стабильным между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.

Глобальные параметры

--debug (логическое значение)

Включает отладочную запись журнала.

--endpoint-url (строка)

Переопределяет URL по умолчанию команды указанным URL.

--no-verify-ssl (логическое значение)

По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет стандартное поведение проверки сертификатов SSL.

--no-paginate (логическое значение)

Отключает автоматическую постраничную выборку. Если автоматическая постраничная выборка отключена, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования вывода команды.

  • json
  • текст
  • таблица
  • yaml
  • yaml-поток

--query (строка)

Запрос JMESPath для использования при фильтрации данных ответа.

--profile (строка)

Использовать определенный профиль из файла учетных данных.

--region (строка)

Регион для использования. Переопределяет настройки конфигурации/среды.

--version (строка)

Отобразить версию данного инструмента.

--color (строка)

Включение/выключение цветного вывода.

  • включено
  • выключено
  • авто

--no-sign-request (логическое значение)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент указан.

--ca-bundle (строка)

Файл с пакетом сертификатов CA для использования при проверке сертификатов SSL. Переопределяет настройки конфигурации/среды.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет выполняться без блокировки и без таймаута. Значение по умолчанию составляет 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет выполняться без блокировки и без таймаута. Значение по умолчанию составляет 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, который используется для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны быть переданы буквально. При предоставлении содержимого из файла, отображающего двоичный блок, fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (логическое значение)

Отключить постраничную выборку CLI для вывода.

--cli-auto-prompt (логическое значение)

Автоматически запрашивать параметры ввода CLI.

--no-cli-auto-prompt (логическое значение)

Отключить автоматическое запросить параметров ввода CLI.

Примеры

Примечание

Для использования следующих примеров необходимо установить и настроить AWS CLI. Подробнее см. руководство по началу работы в руководстве пользователя AWS CLI.

Если не указано иное, все примеры используют правила цитирования, аналогичные unix-подобным. Эти примеры нужно будет адаптировать к правилам цитирования вашей оболочки терминала. См. Использование кавычек со строками в руководстве пользователя AWS CLI.

Чтобы получить список всех заданий классификации документов

Следующий list-document-classification-jobs пример перечисляет все задания классификации документов.

aws comprehend list-document-classification-jobs

Вывод:

{
    "DocumentClassificationJobPropertiesList": [
        {
            "JobId": "123456abcdeb0e11022f22a11EXAMPLE",
            "JobArn": "arn:aws:comprehend:us-west-2:1234567890101:document-classification-job/123456abcdeb0e11022f22a11EXAMPLE",
            "JobName": "exampleclassificationjob",
            "JobStatus": "COMPLETED",
            "SubmitTime": "2023-06-14T17:09:51.788000+00:00",
            "EndTime": "2023-06-14T17:15:58.582000+00:00",
            "DocumentClassifierArn": "arn:aws:comprehend:us-west-2:1234567890101:document-classifier/mymodel/version/12",
            "InputDataConfig": {
                "S3Uri": "s3://amzn-s3-demo-bucket/jobdata/",
                "InputFormat": "ONE_DOC_PER_LINE"
            },
            "OutputDataConfig": {
                "S3Uri": "s3://amzn-s3-demo-destination-bucket/thefolder/1234567890101-CLN-e758dd56b824aa717ceab551f11749fb/output/output.tar.gz"
            },
            "DataAccessRoleArn": "arn:aws:iam::1234567890101:role/service-role/AmazonComprehendServiceRole-example-role"
        },
        {
            "JobId": "123456abcdeb0e11022f22a1EXAMPLE2",
            "JobArn": "arn:aws:comprehend:us-west-2:1234567890101:document-classification-job/123456abcdeb0e11022f22a1EXAMPLE2",
            "JobName": "exampleclassificationjob2",
            "JobStatus": "COMPLETED",
            "SubmitTime": "2023-06-14T17:22:39.829000+00:00",
            "EndTime": "2023-06-14T17:28:46.107000+00:00",
            "DocumentClassifierArn": "arn:aws:comprehend:us-west-2:1234567890101:document-classifier/mymodel/version/12",
            "InputDataConfig": {
                "S3Uri": "s3://amzn-s3-demo-bucket/jobdata/",
                "InputFormat": "ONE_DOC_PER_LINE"
            },
            "OutputDataConfig": {
                "S3Uri": "s3://amzn-s3-demo-destination-bucket/thefolder/1234567890101-CLN-123456abcdeb0e11022f22a1EXAMPLE2/output/output.tar.gz"
            },
            "DataAccessRoleArn": "arn:aws:iam::1234567890101:role/service-role/AmazonComprehendServiceRole-example-role"
        }
    ]
}

Дополнительную информацию см. в разделе Настройка классификации в руководстве разработчика Amazon Comprehend.

Вывод

DocumentClassificationJobPropertiesList -> (список)

Список, содержащий свойства каждого задания.

(структура)

Предоставляет информацию о задании классификации документов.

JobId -> (строка)

Идентификатор, присвоенный заданию классификации документов.

JobArn -> (строка)

Amazon Resource Name (ARN) задания классификации документов. Это уникальный, полностью квалифицированный идентификатор задания. Он включает учетную запись Amazon Web Services, регион Amazon Web Services и идентификатор задания. Формат ARN следующий:

arn:<partition>:comprehend:<region>:<account-id>:document-classification-job/<job-id>

Вот пример ARN задания:

arn:aws:comprehend:us-west-2:111122223333:document-classification-job/1234abcd12ab34cd56ef1234567890ab

JobName -> (строка)

Имя, присвоенное вами заданию классификации документов.

JobStatus -> (строка)

Текущий статус задания классификации документов. Если статус FAILED, поле Message показывает причину ошибки.

Message -> (строка)

Описание статуса задания.

SubmitTime -> (метка времени)

Время подачи задания на обработку.

EndTime -> (метка времени)

Время завершения задания классификации документов.

DocumentClassifierArn -> (строка)

Amazon Resource Name (ARN), идентифицирующий классификатор документов.

InputDataConfig -> (структура)

Конфигурация входных данных, предоставленная вами при создании задания классификации документов.

S3Uri -> (строка)

Amazon S3 URI для входных данных. URI должен быть в том же регионе, что и вызываемый API-эндпоинт. URI может указывать на один входной файл или префикс для набора файлов данных.

Например, если вы используете URI S3://bucketName/prefix, если префикс является одним файлом, Amazon Comprehend использует этот файл в качестве входных данных. Если более одного файла начинается с префикса, Amazon Comprehend использует все их в качестве входных данных.

InputFormat -> (строка)

Определяет, как текст в входном файле должен обрабатываться:

  • ONE_DOC_PER_FILE - Каждый файл рассматривается как отдельный документ. Используйте этот вариант при обработке больших документов, таких как газетные статьи или научные статьи.
  • ONE_DOC_PER_LINE - Каждая строка в файле рассматривается как отдельный документ. Используйте этот вариант при обработке многих коротких документов, таких как текстовые сообщения.

DocumentReaderConfig -> (структура)

Предоставляет параметры конфигурации для переопределения стандартных действий по извлечению текста из PDF-документов и файлов изображений.

DocumentReadAction -> (строка)

Это поле определяет операцию API Amazon Textract, которую Amazon Comprehend использует для извлечения текста из PDF-файлов и файлов изображений. Введите одно из следующих значений:

  • TEXTRACT_DETECT_DOCUMENT_TEXT - Сервис Amazon Comprehend использует операцию API DetectDocumentText.
  • TEXTRACT_ANALYZE_DOCUMENT - Сервис Amazon Comprehend использует операцию API AnalyzeDocument.

DocumentReadMode -> (строка)

Определяет действия по извлечению текста для PDF-файлов. Введите одно из следующих значений:

  • SERVICE_DEFAULT - использовать параметры по умолчанию Amazon Comprehend для PDF-файлов.
  • FORCE_DOCUMENT_READ_ACTION - Amazon Comprehend использует API Textract, указанный в DocumentReadAction, для всех PDF-файлов, включая цифровые PDF-файлы.

FeatureTypes -> (список)

Указывает тип функций Amazon Textract, которые нужно применить. Если вы выбрали TEXTRACT_ANALYZE_DOCUMENT в качестве действия чтения, вы должны указать одно или оба из следующих значений:

  • TABLES - Возвращает дополнительную информацию о любых таблицах, которые были обнаружены в документе.
  • FORMS - Возвращает дополнительную информацию о любых формах, которые были обнаружены в документе.

(строка)

TABLES или FORMS

OutputDataConfig -> (структура)

Конфигурация выходных данных, предоставленная вами при создании задания классификации документов.

S3Uri -> (строка)

Когда вы используете объект OutputDataConfig с асинхронными операциями, вы указываете расположение Amazon S3, куда хотите записать выходные данные. URI должен находиться в том же регионе, что и вызываемый API-эндпоинт. Расположение используется в качестве префикса для фактического расположения выходного файла.

Когда задание обнаружения тем завершено, служба создает выходной файл в каталоге, специфичном для задания. Поле S3Uri содержит расположение выходного файла, называемого output.tar.gz. Это сжатый архив, содержащий результат операции.

Для задания обнаружения сущностей PII выходной файл является обычным текстом, а не сжатым архивом. Имя выходного файла совпадает с именем входного файла, к которому добавлено .out.

KmsKeyId -> (строка)

Идентификатор ключа Amazon Web Services Key Management Service (KMS), который Amazon Comprehend использует для шифрования результатов анализа задания. Укажите идентификатор симметричного ключа, так как вы не можете использовать асимметричный ключ для загрузки данных в S3.

KmsKeyId может иметь один из следующих форматов:

  • Идентификатор ключа KMS: "1234abcd-12ab-34cd-56ef-1234567890ab"
  • Amazon Resource Name (ARN) ключа KMS: "arn:aws:kms:us-west-2:111122223333:key/1234abcd-12ab-34cd-56ef-1234567890ab"
  • Алиас ключа KMS: "alias/ExampleAlias"
  • ARN алиаса ключа KMS: "arn:aws:kms:us-west-2:111122223333:alias/ExampleAlias"

DataAccessRoleArn -> (строка)

Amazon Resource Name (ARN) роли IAM, предоставляющей Amazon Comprehend доступ для чтения к вашим входным данным.

VolumeKmsKeyId -> (строка)

Идентификатор ключа Amazon Web Services Key Management Service (KMS), который Amazon Comprehend использует для шифрования данных на объеме хранилища, подключенном к экземпляру вычислительных ресурсов ML, обрабатывающему задание анализа. VolumeKmsKeyId может иметь один из следующих форматов:

  • Идентификатор ключа KMS: "1234abcd-12ab-34cd-56ef-1234567890ab"
  • Amazon Resource Name (ARN) ключа KMS: "arn:aws:kms:us-west-2:111122223333:key/1234abcd-12ab-34cd-56ef-1234567890ab"

VpcConfig -> (структура)

Параметры конфигурации для частного виртуального частного облака (VPC), содержащего ресурсы, которые вы используете для задания классификации документов. Дополнительную информацию см. в Amazon VPC.

SecurityGroupIds -> (список)

Идентификационный номер группы безопасности на экземпляре вашего частного VPC. Группы безопасности в вашем VPC выполняют функцию виртуального брандмауэра, контролируя входящий и исходящий трафик и обеспечивая безопасность ресурсов, к которым вы будете обращаться в VPC. Этот идентификационный номер предваряется «sg-», например: «sg-03b388029b0a285ea». Дополнительную информацию см. в Группы безопасности для вашей VPC.

(строка)

Subnets -> (список)

Идентификатор каждого подсети, используемого в вашем частном VPC. Эта подсеть является подмножеством диапазона адресов IPv4, используемых VPC, и специфична для определенной зоны доступности в регионе VPC. Этот идентификационный номер предваряется «subnet-», например: «subnet-04ccf456919e69055». Дополнительную информацию см. в VPC и подсети.

(строка)

FlywheelArn -> (строка)

Amazon Resource Number (ARN) флайвела

NextToken -> (строка)

Идентификатор следующей страницы результатов.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API