list-inference-recommendations-job-steps
Описание
Возвращает список подзадач для работы Inference Recommender.
Поддерживаемые подзадачи — это эталонные тесты, которые оценивают производительность вашей модели на различных типах экземпляров.
См. также: Документация API AWS
list-inference-recommendations-job-steps — это операция с постраничной выборкой. Для получения всего набора результатов могут потребоваться несколько вызовов API. Вы можете отключить постраничную выборку, указав аргумент --no-paginate. При использовании --output text и аргумента --query в ответе с постраничной выборкой, аргумент --query должен извлекать данные из результатов следующих выражений запроса: Steps
Синтаксис
list-inference-recommendations-job-steps
--job-name <value>
[--status <value>]
[--step-type <value>]
[--cli-input-json | --cli-input-yaml]
[--starting-token <value>]
[--page-size <value>]
[--max-items <value>]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--job-name (строка)
--status (строка)
Фильтр для возврата эталонных тестов с указанным статусом. Если это поле пустое, возвращаются все эталонные тесты.
Возможные значения:
PENDINGIN_PROGRESSCOMPLETEDFAILEDSTOPPINGSTOPPEDDELETINGDELETED
--step-type (строка)
Фильтр для возврата данных о заданном типе подзадачи.
BENCHMARK : Оценка производительности вашей модели на различных типах экземпляров.Возможные значения:
BENCHMARK
--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка следует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения, используя значение, предоставленное в JSON, так как строка будет взята буквально. Это не может быть указано вместе с --cli-input-yaml.
--starting-token (строка)
Маркер для указания места начала постраничной выборки. Это NextToken из ранее усеченного ответа.
Примеры использования см. в разделе «Постраничная выборка» в Руководстве пользователя AWS Command Line Interface.
--page-size (целое число)
Размер каждой страницы для получения в вызове AWS-сервиса. Это не влияет на количество элементов, возвращаемых в выводе команды. Установка меньшего размера страницы приводит к большему количеству вызовов AWS-сервиса, получая меньше элементов в каждом вызове. Это может помочь предотвратить таймаут вызовов AWS-сервиса.
Примеры использования см. в разделе «Постраничная выборка» в Руководстве пользователя AWS Command Line Interface.
--max-items (целое число)
Общее количество элементов для возврата в выводе команды. Если общее количество доступных элементов больше, чем указанное значение, в выводе команды предоставляется NextToken. Для возобновления постраничной выборки укажите значение NextToken в аргументе starting-token последующей команды. Не используйте элемент ответа NextToken напрямую вне AWS CLI.
Примеры использования см. в разделе «Постраничная выборка» в Руководстве пользователя AWS Command Line Interface.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. Если предоставлено без значения или со значением input, выводит пример JSON-ввода, который можно использовать как аргумент для --cli-input-json. Аналогично, если предоставлено yaml-input, он выведет пример YAML-ввода, который можно использовать с --cli-input-yaml. Если предоставлено значение output, он проверит входные данные команды и вернет пример выходного JSON для этой команды. Сгенерированный JSON-скелет не является стабильным между версиями AWS CLI, и нет гарантии обратной совместимости в сгенерированном JSON-скелете.
Глобальные параметры
--debug (булево)
Включить отладочную регистрацию.
--endpoint-url (строка)
Переопределить URL по умолчанию команды указанным URL.
--no-verify-ssl (булево)
По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого соединения SSL AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет поведение по умолчанию, проверяющее сертификаты SSL.
--no-paginate (булево)
Отключить автоматическую постраничную выборку. Если автоматическая постраничная выборка отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования для вывода команд.
- json
- text
- table
- yaml
- yaml-stream
--query (строка)
Запрос JMESPath для использования в фильтрации данных ответа.
--profile (строка)
Использовать определённый профиль из файла учетных данных.
--region (строка)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (строка)
Отобразить версию этого инструмента.
--color (строка)
Включить/выключить вывод в цвете.
- on
- off
- auto
--no-sign-request (булево)
Не подписывать запросы. Учетные данные не будут загружаться, если этот аргумент указан.
--ca-bundle (строка)
Файл сертификатов CA для использования при проверке сертификатов SSL. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения к сокету в секундах. Если значение установлено в 0, подключение к сокету будет блокирующим и не будет иметь таймаута. Значение по умолчанию — 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, который будет использоваться для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, а двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, отображающего двоичный блок, fileb:// всегда будет обрабатываться как двоичный и использовать содержимое файла непосредственно, независимо от значения cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (булево)
Отключить пейджер CLI для вывода.
--cli-auto-prompt (булево)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (булево)
Отключить автоматическое запросы параметров ввода CLI.
Вывод
Шаги -> (список)
Список всех подробностей подзадач в Инференс Рекоммендере.
(структура)
Возвращаемый массив объектов для поля ответа Steps в команде API ListInferenceRecommendationsJobSteps.
ТипШага -> (строка)
Тип подзадачи.
BENCHMARK : Оцените производительность вашей модели на различных типах экземпляров.ИмяЗадания -> (строка)
Статус -> (строка)
InferenceBenchmark -> (структура)
Подробности для конкретного эталона.
Метрики -> (структура)
Метрики рекомендаций.
СтоимостьЗаЧас -> (число с плавающей точкой)
СтоимостьЗаИнференс -> (число с плавающей точкой)
МаксимальноеКоличествоВызовов -> (целое число)
ЗадержкаМодели -> (целое число)
ИспользованиеЦП -> (число с плавающей точкой)
Ожидаемое использование ЦП при максимальном количестве вызовов в минуту для экземпляра.
NaN указывает, что значение недоступно.ИспользованиеОЗУ -> (число с плавающей точкой)
Ожидаемое использование ОЗУ при максимальном количестве вызовов в минуту для экземпляра.
NaN указывает, что значение недоступно.ВремяНастройкиМодели -> (целое число)
Время, необходимое для запуска новых вычислительных ресурсов для серверного конечной точки. Время может варьироваться в зависимости от размера модели, времени загрузки модели и времени запуска контейнера.
NaN указывает, что значение недоступно.МетрикиКонечнойТочки -> (структура)
Метрики для существующей конечной точки, сравниваемые в задании Inference Recommender.
МаксимальноеКоличествоВызовов -> (целое число)
ЗадержкаМодели -> (целое число)
КонфигурацияКонечнойТочки -> (структура)
Конфигурация конечной точки, созданная Inference Recommender во время задания рекомендации.
ИмяКонечнойТочки -> (строка)
ИмяВарианта -> (строка)
ТипЭкземпляра -> (строка)
НачальноеКоличествоЭкземпляров -> (целое число)
КонфигурацияServerless -> (структура)
Указывает конфигурацию серверного приложения для варианта конечной точки.
РазмерОЗУВМБ -> (целое число)
МаксимальнаяКонкуррентность -> (целое число)
ПриоритетизированнаяКонкуррентность -> (целое число)
Количество приоритетизированной конкуррентности для выделения серверной конечной точке. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверной конечной точки для заданий Inference Recommender. Для получения дополнительной информации о создании задания Inference Recommender см. CreateInferenceRecommendationsJobs.КонфигурацияМодели -> (структура)
Определяет конфигурацию модели. Включает имя спецификации и параметры среды.
ИмяСпецификацииИнференса -> (строка)
ПараметрыСреды -> (список)
Определяет параметры среды, которые включают тип ключа, значения и значения.
(структура)
Список параметров среды, предложенных Amazon SageMaker Inference Recommender.
Ключ -> (строка)
ТипЗначения -> (строка)
Значение -> (строка)
ИмяЗаданияКомпиляции -> (строка)
ПричинаНеудачи -> (строка)
ВремяЗавершенияВызова -> (временная метка)
ВремяНачалаВызова -> (временная метка)
МаркерСледующейОбработки -> (строка)
© Copyright 2025, Amazon Web Services. Created using Sphinx.