describe-inference-recommendations-job
Описание
Предоставляет результаты работы задания Inference Recommender. Возвращаются одно или несколько заданий рекомендаций.
См. также: Документацию API AWS
Синтаксис
describe-inference-recommendations-job
--job-name <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--job-name (строка)
--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному в --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения переопределят значения, предоставленные в JSON. Передача произвольных двоичных значений с помощью значения, предоставленного в JSON, невозможна, так как строка будет интерпретирована буквально. Это параметр не может быть указан вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он проверит входные данные команды и вернёт JSON-пример выходных данных для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI и не гарантируется обратная совместимость с JSON-скелетом, сгенерированным в прошлых версиях.
Глобальные параметры
--debug (булево)
Включить отладочную регистрацию.
--endpoint-url (строка)
Переопределить адрес по умолчанию команды заданным адресом.
--no-verify-ssl (булево)
По умолчанию, AWS CLI использует SSL при общении с сервисами AWS. Для каждого SSL-соединения, AWS CLI проверит SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.
--no-paginate (булево)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования для вывода команды.
- json
- text
- таблица
- yaml
- yaml-поток
--query (строка)
Запрос JMESPath для фильтрации данных ответа.
--profile (строка)
Использовать определённый профиль из файла учетных данных.
--region (строка)
Область, которую использовать. Переопределяет настройки из конфигурации/окружения.
--version (строка)
Отобразить версию этого инструмента.
--color (строка)
Включить/выключить цветной вывод.
- включено
- выключено
- автоматически
--no-sign-request (булево)
Не подписывать запросы. Кредиты не будут загружены, если этот аргумент предоставлен.
--ca-bundle (строка)
Файл с набором CA-сертификатов для проверки SSL-сертификатов. Переопределяет настройки из конфигурации/окружения.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как base64-кодированная строка. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI версии 1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, соответствующего двоичному блоку, fileb:// всегда будет обрабатываться как двоичное и использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для заданной настройки cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (булево)
Отключить пейджер для вывода.
--cli-auto-prompt (булево)
Автоматически запрашивать параметры входных данных CLI.
--no-cli-auto-prompt (булево)
Отключить автоматическое запросы параметров входных данных CLI.
Вывод
JobName -> (строка)
JobDescription -> (строка)
JobType -> (строка)
JobArn -> (строка)
RoleArn -> (строка)
Status -> (строка)
CreationTime -> (метка времени)
CompletionTime -> (метка времени)
LastModifiedTime -> (метка времени)
FailureReason -> (строка)
InputConfig -> (структура)
Возвращает информацию о версии пакета модели Amazon Resource Name (ARN), схеме трафика и конфигурациях конечных точек, предоставленных вами при запуске задачи.
ModelPackageVersionArn -> (строка)
ModelName -> (строка)
JobDurationInSeconds -> (целое число)
TrafficPattern -> (структура)
Указывает схему трафика задачи.
TrafficType -> (строка)
PHASES, либо STAIRS.Phases -> (список)
Определяет спецификацию фаз трафика.
(структура)
Определяет схему трафика.
InitialNumberOfUsers -> (целое число)
SpawnRate -> (целое число)
DurationInSeconds -> (целое число)
JobDurationInSeconds.Stairs -> (структура)
Определяет схему трафика «лестница».
DurationInSeconds -> (целое число)
NumberOfSteps -> (целое число)
UsersPerStep -> (целое число)
ResourceLimit -> (структура)
Определяет лимит ресурсов задачи.
MaxNumberOfTests -> (целое число)
MaxParallelOfTests -> (целое число)
EndpointConfigurations -> (список)
Указывает конфигурацию конечной точки, которую нужно использовать для задачи.
(структура)
Конфигурация конечной точки для нагрузочного теста.
InstanceType -> (строка)
ServerlessConfig -> (структура)
Указывает конфигурацию серверного решения для варианта конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного одновременного доступа, который нужно выделить для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверных конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .InferenceSpecificationName -> (строка)
EnvironmentParameterRanges -> (структура)
Параметр, который вы хотите использовать для сравнения.
CategoricalParameterRanges -> (список)
Указывает список параметров для каждой категории.
(структура)
Параметры среды, которые вы хотите использовать для сравнения нагрузочного теста.
Name -> (строка)
Value -> (список)
Список значений, которые можно передать.
(строка)
VolumeKmsKeyId -> (строка)
Amazon Resource Name (ARN) ключа Amazon Web Services Key Management Service (Amazon Web Services KMS), который Amazon SageMaker использует для шифрования данных на томе хранения, подключенном к экземпляру вычислительных ресурсов ML, на котором размещена конечная точка. Этот ключ будет передан SageMaker Hosting для создания конечной точки.
Роль выполнения SageMaker должна иметь разрешение kms:CreateGrant для шифрования данных на томе хранения конечных точек, созданных для рекомендаций вывода. Задача рекомендации вывода завершится асинхронно во время создания конфигурации конечной точки, если указанная роль не имеет разрешения kms:CreateGrant.
KmsKeyId может быть в одном из следующих форматов:
- // Идентификатор ключа KMS
"1234abcd-12ab-34cd-56ef-1234567890ab" - // Amazon Resource Name (ARN) ключа KMS
"arn:aws:kms:<region>:<account>:key/<key-id-12ab-34cd-56ef-1234567890ab>" - // Псевдоним ключа KMS
"alias/ExampleAlias" - // Amazon Resource Name (ARN) псевдонима ключа KMS
"arn:aws:kms:<region>:<account>:alias/<ExampleAlias>"
Дополнительную информацию об идентификаторах ключей см. в документации Amazon Web Services Key Management Service (Amazon Web Services KMS) — Идентификаторы ключей (KeyID).
ContainerConfig -> (структура)
Указывает обязательные поля для запуска задачи Inference Recommender. Поля, указанные в ContainerConfig, переопределяют соответствующие поля в пакете модели.
Domain -> (строка)
Область машинного обучения модели и ее компонентов.
Допустимые значения: COMPUTER_VISION | NATURAL_LANGUAGE_PROCESSING | MACHINE_LEARNING
Task -> (строка)
Задача машинного обучения, которую выполняет модель.
Допустимые значения: IMAGE_CLASSIFICATION | OBJECT_DETECTION | TEXT_GENERATION | IMAGE_SEGMENTATION | FILL_MASK | CLASSIFICATION | REGRESSION | OTHER
Framework -> (строка)
Фреймворк машинного обучения образа контейнера.
Допустимые значения: TENSORFLOW | PYTORCH | XGBOOST | SAGEMAKER-SCIKIT-LEARN
FrameworkVersion -> (строка)
PayloadConfig -> (структура)
Указывает SamplePayloadUrl и все другие поля, относящиеся к образцу данных.
SamplePayloadUrl -> (строка)
SupportedContentTypes -> (список)
Поддерживаемые MIME-типы входных данных.
(строка)
NearestModelName -> (строка)
Имя предварительно обученной модели машинного обучения, сравненной Amazon SageMaker Inference Recommender, которая соответствует вашей модели.
Допустимые значения: efficientnetb7 | unet | xgboost | faster-rcnn-resnet101 | nasnetlarge | vgg16 | inception-v3 | mask-rcnn | sagemaker-scikit-learn | densenet201-gluon | resnet18v2-gluon | xception | densenet201 | yolov4 | resnet152 | bert-base-cased | xceptionV1-keras | resnet50 | retinanet
SupportedInstanceTypes -> (список)
Список типов экземпляров, которые используются для генерации выводов в реальном времени.
(строка)
SupportedEndpointType -> (строка)
DataInputConfig -> (строка)
SupportedResponseMIMETypes -> (список)
Поддерживаемые MIME-типы выходных данных.
(строка)
Endpoints -> (список)
Существующие конечные точки клиентов, для которых нужно запустить задачу Inference Recommender.
(структура)
Подробная информация о конечной точке клиента, которая была сравнена в задаче Inference Recommender.
EndpointName -> (строка)
VpcConfig -> (структура)
Inference Recommender предоставляет конечным точкам SageMaker доступ к VPC в задаче рекомендации вывода.
SecurityGroupIds -> (список)
Идентификаторы групп безопасности VPC. Идентификаторы имеют вид sg-xxxxxxxx. Укажите группы безопасности для VPC, указанной в поле Subnets.
(строка)
Subnets -> (список)
Идентификатор подсетей в VPC, к которому вы хотите подключить свою модель.
(строка)
StoppingConditions -> (структура)
Условия остановки, которые вы указали при запуске задачи.
MaxInvocations -> (целое число)
ModelLatencyThresholds -> (список)
Интервал времени, затрачиваемый моделью на ответ с точки зрения SageMaker. Интервал включает время локального взаимодействия для отправки запроса и получения ответа из контейнера модели, а также время, затраченное на завершение вывода в контейнере.
(структура)
Пороговое значение задержки модели.
Percentile -> (строка)
P95 и P99. Для пользовательских нагрузочных тестов укажите значение P95.ValueInMilliseconds -> (целое число)
FlatInvocations -> (строка)
Stop. Если вы хотите, чтобы нагрузочный тест продолжался после того, как вызовы стали плоскими, установите значение Continue.InferenceRecommendations -> (список)
Рекомендации, сделанные Inference Recommender.
(структура)
Список рекомендаций, сделанных Amazon SageMaker Inference Recommender.
RecommendationId -> (строка)
Metrics -> (структура)
Метрики, используемые для принятия рекомендаций.
CostPerHour -> (вещественное число)
CostPerInference -> (вещественное число)
MaxInvocations -> (целое число)
ModelLatency -> (целое число)
CpuUtilization -> (вещественное число)
Ожидаемая загрузка процессора при максимальном количестве вызовов в минуту для экземпляра.
NaN указывает, что значение недоступно.MemoryUtilization -> (вещественное число)
Ожидаемая загрузка памяти при максимальном количестве вызовов в минуту для экземпляра.
NaN указывает, что значение недоступно.ModelSetupTime -> (целое число)
Время, необходимое для запуска новых вычислительных ресурсов для серверного конечной точки. Время может варьироваться в зависимости от размера модели, времени загрузки модели и времени запуска контейнера.
NaN указывает, что значение недоступно.EndpointConfiguration -> (структура)
Определяет параметры конфигурации конечной точки.
EndpointName -> (строка)
VariantName -> (строка)
InstanceType -> (строка)
InitialInstanceCount -> (целое число)
ServerlessConfig -> (структура)
Указывает конфигурацию серверного варианта для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного конкурентного выполнения для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверных конечных точек для заданий Inference Recommender. Для получения дополнительной информации о создании задания Inference Recommender см. CreateInferenceRecommendationsJobs.ModelConfiguration -> (структура)
Определяет конфигурацию модели.
InferenceSpecificationName -> (строка)
EnvironmentParameters -> (список)
Определяет параметры среды, включая типы ключей, значений и значения.
(структура)
Список параметров среды, предложенных Amazon SageMaker Inference Recommender.
Key -> (строка)
ValueType -> (строка)
Value -> (строка)
CompilationJobName -> (строка)
InvocationEndTime -> (временная метка)
InvocationStartTime -> (временная метка)
EndpointPerformances -> (список)
Результаты работы задания Inference Recommender на существующей конечной точке.
(структура)
Результаты выполнения задания Inference Recommender на существующей конечной точке.
Metrics -> (структура)
Метрики для существующей конечной точки.
MaxInvocations -> (целое число)
ModelLatency -> (целое число)
EndpointInfo -> (структура)
Подробная информация о конечной точке клиента, которая сравнивалась в задании Inference Recommender.
EndpointName -> (строка)
© Copyright 2025, Amazon Web Services. Created using Sphinx.