Spec-Zone.ru › AWS CLI v2

[ aws . sagemaker ]

describe-inference-recommendations-job

Описание

Предоставляет результаты работы задания Inference Recommender. Возвращаются одно или несколько заданий рекомендаций.

См. также: Документацию API AWS

Синтаксис

  describe-inference-recommendations-job
--job-name <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--job-name (строка)

Название задания. Название должно быть уникальным в данной области Amazon Web Services в рамках учетной записи Amazon Web Services.

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному в --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения переопределят значения, предоставленные в JSON. Передача произвольных двоичных значений с помощью значения, предоставленного в JSON, невозможна, так как строка будет интерпретирована буквально. Это параметр не может быть указан вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он проверит входные данные команды и вернёт JSON-пример выходных данных для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI и не гарантируется обратная совместимость с JSON-скелетом, сгенерированным в прошлых версиях.

Глобальные параметры

--debug (булево)

Включить отладочную регистрацию.

--endpoint-url (строка)

Переопределить адрес по умолчанию команды заданным адресом.

--no-verify-ssl (булево)

По умолчанию, AWS CLI использует SSL при общении с сервисами AWS. Для каждого SSL-соединения, AWS CLI проверит SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.

--no-paginate (булево)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования для вывода команды.

  • json
  • text
  • таблица
  • yaml
  • yaml-поток

--query (строка)

Запрос JMESPath для фильтрации данных ответа.

--profile (строка)

Использовать определённый профиль из файла учетных данных.

--region (строка)

Область, которую использовать. Переопределяет настройки из конфигурации/окружения.

--version (строка)

Отобразить версию этого инструмента.

--color (строка)

Включить/выключить цветной вывод.

  • включено
  • выключено
  • автоматически

--no-sign-request (булево)

Не подписывать запросы. Кредиты не будут загружены, если этот аргумент предоставлен.

--ca-bundle (строка)

Файл с набором CA-сертификатов для проверки SSL-сертификатов. Переопределяет настройки из конфигурации/окружения.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как base64-кодированная строка. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI версии 1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, соответствующего двоичному блоку, fileb:// всегда будет обрабатываться как двоичное и использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для заданной настройки cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (булево)

Отключить пейджер для вывода.

--cli-auto-prompt (булево)

Автоматически запрашивать параметры входных данных CLI.

--no-cli-auto-prompt (булево)

Отключить автоматическое запросы параметров входных данных CLI.

Вывод

JobName -> (строка)

Имя задачи. Имя должно быть уникальным в регионе Amazon Web Services и учетной записи Amazon Web Services.

JobDescription -> (строка)

Описание задачи, предоставленное вами при ее запуске.

JobType -> (строка)

Тип задачи, предоставленный вами при ее запуске.

JobArn -> (строка)

Amazon Resource Name (ARN) задачи.

RoleArn -> (строка)

Amazon Resource Name (ARN) роли Amazon Web Services Identity and Access Management (IAM), предоставленной вами при запуске задачи.

Status -> (строка)

Статус задачи.

CreationTime -> (метка времени)

Метка времени создания задачи.

CompletionTime -> (метка времени)

Метка времени завершения задачи.

LastModifiedTime -> (метка времени)

Метка времени последнего изменения задачи.

FailureReason -> (строка)

Если задача завершилась неудачно, содержит информацию о причинах.

InputConfig -> (структура)

Возвращает информацию о версии пакета модели Amazon Resource Name (ARN), схеме трафика и конфигурациях конечных точек, предоставленных вами при запуске задачи.

ModelPackageVersionArn -> (строка)

Amazon Resource Name (ARN) версии пакета модели.

ModelName -> (строка)

Имя созданной модели.

JobDurationInSeconds -> (целое число)

Указывает максимальную продолжительность задачи в секундах. Максимальное значение — 18 000 секунд.

TrafficPattern -> (структура)

Указывает схему трафика задачи.

TrafficType -> (строка)

Определяет схемы трафика. Выберите либо PHASES, либо STAIRS.

Phases -> (список)

Определяет спецификацию фаз трафика.

(структура)

Определяет схему трафика.

InitialNumberOfUsers -> (целое число)

Указывает количество одновременных пользователей, с которых следует начать. Значение должно быть от 1 до 3.

SpawnRate -> (целое число)

Указывает, сколько новых пользователей следует запускать в минуту.

DurationInSeconds -> (целое число)

Указывает, как долго должна длиться фаза трафика. Для пользовательских нагрузочных тестов значение должно быть от 120 до 3600. Это значение не должно превышать JobDurationInSeconds.

Stairs -> (структура)

Определяет схему трафика «лестница».

DurationInSeconds -> (целое число)

Определяет, как долго должна длиться каждая ступень трафика.

NumberOfSteps -> (целое число)

Указывает количество ступеней, которые необходимо выполнить во время трафика.

UsersPerStep -> (целое число)

Указывает количество новых пользователей, которые необходимо запускать на каждой ступени.

ResourceLimit -> (структура)

Определяет лимит ресурсов задачи.

MaxNumberOfTests -> (целое число)

Определяет максимальное количество нагрузочных тестов.

MaxParallelOfTests -> (целое число)

Определяет максимальное количество параллельных нагрузочных тестов.

EndpointConfigurations -> (список)

Указывает конфигурацию конечной точки, которую нужно использовать для задачи.

(структура)

Конфигурация конечной точки для нагрузочного теста.

InstanceType -> (строка)

Типы экземпляров, которые нужно использовать для нагрузочного теста.

ServerlessConfig -> (структура)

Указывает конфигурацию серверного решения для варианта конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверной конечной точки. Допустимые значения увеличиваются на 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверная конечная точка.

ProvisionedConcurrency -> (целое число)

Количество выделенного одновременного доступа, который нужно выделить для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверных конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .

InferenceSpecificationName -> (строка)

Имя спецификации вывода в версии пакета модели.

EnvironmentParameterRanges -> (структура)

Параметр, который вы хотите использовать для сравнения.

CategoricalParameterRanges -> (список)

Указывает список параметров для каждой категории.

(структура)

Параметры среды, которые вы хотите использовать для сравнения нагрузочного теста.

Name -> (строка)

Имя переменной среды.

Value -> (список)

Список значений, которые можно передать.

(строка)

VolumeKmsKeyId -> (строка)

Amazon Resource Name (ARN) ключа Amazon Web Services Key Management Service (Amazon Web Services KMS), который Amazon SageMaker использует для шифрования данных на томе хранения, подключенном к экземпляру вычислительных ресурсов ML, на котором размещена конечная точка. Этот ключ будет передан SageMaker Hosting для создания конечной точки.

Роль выполнения SageMaker должна иметь разрешение kms:CreateGrant для шифрования данных на томе хранения конечных точек, созданных для рекомендаций вывода. Задача рекомендации вывода завершится асинхронно во время создания конфигурации конечной точки, если указанная роль не имеет разрешения kms:CreateGrant.

KmsKeyId может быть в одном из следующих форматов:

  • // Идентификатор ключа KMS "1234abcd-12ab-34cd-56ef-1234567890ab"
  • // Amazon Resource Name (ARN) ключа KMS "arn:aws:kms:<region>:<account>:key/<key-id-12ab-34cd-56ef-1234567890ab>"
  • // Псевдоним ключа KMS "alias/ExampleAlias"
  • // Amazon Resource Name (ARN) псевдонима ключа KMS "arn:aws:kms:<region>:<account>:alias/<ExampleAlias>"

Дополнительную информацию об идентификаторах ключей см. в документации Amazon Web Services Key Management Service (Amazon Web Services KMS) — Идентификаторы ключей (KeyID).

ContainerConfig -> (структура)

Указывает обязательные поля для запуска задачи Inference Recommender. Поля, указанные в ContainerConfig, переопределяют соответствующие поля в пакете модели.

Domain -> (строка)

Область машинного обучения модели и ее компонентов.

Допустимые значения: COMPUTER_VISION | NATURAL_LANGUAGE_PROCESSING | MACHINE_LEARNING

Task -> (строка)

Задача машинного обучения, которую выполняет модель.

Допустимые значения: IMAGE_CLASSIFICATION | OBJECT_DETECTION | TEXT_GENERATION | IMAGE_SEGMENTATION | FILL_MASK | CLASSIFICATION | REGRESSION | OTHER

Framework -> (строка)

Фреймворк машинного обучения образа контейнера.

Допустимые значения: TENSORFLOW | PYTORCH | XGBOOST | SAGEMAKER-SCIKIT-LEARN

FrameworkVersion -> (строка)

Версия фреймворка образа контейнера.

PayloadConfig -> (структура)

Указывает SamplePayloadUrl и все другие поля, относящиеся к образцу данных.

SamplePayloadUrl -> (строка)

Путь Amazon Simple Storage Service (Amazon S3), где хранится образец данных. Этот путь должен указывать на один сжатый в формате gzip архив tar (.tar.gz).

SupportedContentTypes -> (список)

Поддерживаемые MIME-типы входных данных.

(строка)

NearestModelName -> (строка)

Имя предварительно обученной модели машинного обучения, сравненной Amazon SageMaker Inference Recommender, которая соответствует вашей модели.

Допустимые значения: efficientnetb7 | unet | xgboost | faster-rcnn-resnet101 | nasnetlarge | vgg16 | inception-v3 | mask-rcnn | sagemaker-scikit-learn | densenet201-gluon | resnet18v2-gluon | xception | densenet201 | yolov4 | resnet152 | bert-base-cased | xceptionV1-keras | resnet50 | retinanet

SupportedInstanceTypes -> (список)

Список типов экземпляров, которые используются для генерации выводов в реальном времени.

(строка)

SupportedEndpointType -> (строка)

Тип конечной точки, для которого нужно получить рекомендации. По умолчанию это null, и результаты работы задачи Inference Recommendation возвращают объединенный список тестов для реального времени и серверных решений. Указав значение для этого поля, вы получите более длинный список тестов для нужного типа конечной точки.

DataInputConfig -> (строка)

Указывает имя и форму ожидаемых входных данных для обученной модели в формате JSON-словаря. Это поле используется для оптимизации модели с помощью SageMaker Neo. Дополнительную информацию см. в разделе DataInputConfig.

SupportedResponseMIMETypes -> (список)

Поддерживаемые MIME-типы выходных данных.

(строка)

Endpoints -> (список)

Существующие конечные точки клиентов, для которых нужно запустить задачу Inference Recommender.

(структура)

Подробная информация о конечной точке клиента, которая была сравнена в задаче Inference Recommender.

EndpointName -> (строка)

Имя конечной точки клиента.

VpcConfig -> (структура)

Inference Recommender предоставляет конечным точкам SageMaker доступ к VPC в задаче рекомендации вывода.

SecurityGroupIds -> (список)

Идентификаторы групп безопасности VPC. Идентификаторы имеют вид sg-xxxxxxxx. Укажите группы безопасности для VPC, указанной в поле Subnets.

(строка)

Subnets -> (список)

Идентификатор подсетей в VPC, к которому вы хотите подключить свою модель.

(строка)

StoppingConditions -> (структура)

Условия остановки, которые вы указали при запуске задачи.

MaxInvocations -> (целое число)

Максимальное количество запросов в минуту, ожидаемое для конечной точки.

ModelLatencyThresholds -> (список)

Интервал времени, затрачиваемый моделью на ответ с точки зрения SageMaker. Интервал включает время локального взаимодействия для отправки запроса и получения ответа из контейнера модели, а также время, затраченное на завершение вывода в контейнере.

(структура)

Пороговое значение задержки модели.

Percentile -> (строка)

Пороговое значение процентиля задержки модели. Допустимые значения — P95 и P99. Для пользовательских нагрузочных тестов укажите значение P95.

ValueInMilliseconds -> (целое число)

Значение процентиля задержки модели в миллисекундах.

FlatInvocations -> (строка)

Останавливает нагрузочный тест, когда количество вызовов (TPS) достигает пика и становится плоским, что означает, что экземпляр достиг максимальной емкости. Значение по умолчанию — Stop. Если вы хотите, чтобы нагрузочный тест продолжался после того, как вызовы стали плоскими, установите значение Continue.

InferenceRecommendations -> (список)

Рекомендации, сделанные Inference Recommender.

(структура)

Список рекомендаций, сделанных Amazon SageMaker Inference Recommender.

RecommendationId -> (строка)

Идентификатор рекомендации, уникально определяющий каждую рекомендацию.

Metrics -> (структура)

Метрики, используемые для принятия рекомендаций.

CostPerHour -> (вещественное число)

Определяет стоимость за час для экземпляра.

CostPerInference -> (вещественное число)

Определяет стоимость за вызов для экземпляра.

MaxInvocations -> (целое число)

Ожидаемое максимальное количество запросов в минуту для экземпляра.

ModelLatency -> (целое число)

Ожидаемая задержка модели при максимальном количестве вызовов в минуту для экземпляра.

CpuUtilization -> (вещественное число)

Ожидаемая загрузка процессора при максимальном количестве вызовов в минуту для экземпляра.

NaN указывает, что значение недоступно.

MemoryUtilization -> (вещественное число)

Ожидаемая загрузка памяти при максимальном количестве вызовов в минуту для экземпляра.

NaN указывает, что значение недоступно.

ModelSetupTime -> (целое число)

Время, необходимое для запуска новых вычислительных ресурсов для серверного конечной точки. Время может варьироваться в зависимости от размера модели, времени загрузки модели и времени запуска контейнера.

NaN указывает, что значение недоступно.

EndpointConfiguration -> (структура)

Определяет параметры конфигурации конечной точки.

EndpointName -> (строка)

Имя конечной точки, созданной во время задания рекомендаций.

VariantName -> (строка)

Имя варианта производства (развёрнутой модели), созданного во время задания рекомендаций.

InstanceType -> (строка)

Тип экземпляра, рекомендованный Amazon SageMaker Inference Recommender.

InitialInstanceCount -> (целое число)

Количество экземпляров, которые рекомендуется запустить изначально.

ServerlessConfig -> (структура)

Указывает конфигурацию серверного варианта для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверной конечной точки. Допустимые значения увеличиваются на 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверная конечная точка.

ProvisionedConcurrency -> (целое число)

Количество выделенного конкурентного выполнения для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверных конечных точек для заданий Inference Recommender. Для получения дополнительной информации о создании задания Inference Recommender см. CreateInferenceRecommendationsJobs.

ModelConfiguration -> (структура)

Определяет конфигурацию модели.

InferenceSpecificationName -> (строка)

Имя спецификации вычисления в версии пакета модели.

EnvironmentParameters -> (список)

Определяет параметры среды, включая типы ключей, значений и значения.

(структура)

Список параметров среды, предложенных Amazon SageMaker Inference Recommender.

Key -> (строка)

Ключ среды, предложенный Amazon SageMaker Inference Recommender.

ValueType -> (строка)

Тип значения, предложенный Amazon SageMaker Inference Recommender.

Value -> (строка)

Значение, предложенное Amazon SageMaker Inference Recommender.

CompilationJobName -> (строка)

Имя задания компиляции, используемого для создания рекомендуемых артефактов модели.

InvocationEndTime -> (временная метка)

Временная метка, показывающая время завершения этапа.

InvocationStartTime -> (временная метка)

Временная метка, показывающая время начала этапа.

EndpointPerformances -> (список)

Результаты работы задания Inference Recommender на существующей конечной точке.

(структура)

Результаты выполнения задания Inference Recommender на существующей конечной точке.

Metrics -> (структура)

Метрики для существующей конечной точки.

MaxInvocations -> (целое число)

Ожидаемое максимальное количество запросов в минуту для экземпляра.

ModelLatency -> (целое число)

Ожидаемая задержка модели при максимальном количестве вызовов в минуту для экземпляра.

EndpointInfo -> (структура)

Подробная информация о конечной точке клиента, которая сравнивалась в задании Inference Recommender.

EndpointName -> (строка)

Имя конечной точки клиента.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API