обновить-компонент-вывода
Описание
Обновляет компонент вывода.
См. также: Документацию API AWS
Синтаксис
update-inference-component
--inference-component-name <value>
[--specification <value>]
[--runtime-config <value>]
[--deployment-config <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--inference-component-name (строка)
--specification (структура)
Подробности о ресурсах, которые необходимо развернуть с этим компонентом вывода, включая модель, контейнер и вычислительные ресурсы.
ModelName -> (строка)
Container -> (структура)
Определяет контейнер, который предоставляет среду выполнения для модели, которую вы развертываете с компонентом вывода.
Image -> (строка)
ArtifactUrl -> (строка)
Environment -> (карта)
Переменные среды, которые нужно установить в Docker-контейнере. Каждый ключ и значение в карте «строка-строка» Environment могут иметь длину до 1024. Мы поддерживаем до 16 записей в карте.
key -> (строка)
value -> (строка)
StartupParameters -> (структура)
Настройки, которые применяются при запуске контейнера модели.
ModelDataDownloadTimeoutInSeconds -> (целое число)
ContainerStartupHealthCheckTimeoutInSeconds -> (целое число)
ComputeResourceRequirements -> (структура)
Вычислительные ресурсы, выделенные для запуска модели, а также любых адаптерных моделей, которые вы назначаете компоненту вывода.
Опустите этот параметр, если ваш запрос предназначен для создания адаптерного компонента вывода. Адаптерный компонент вывода загружается базовым компонентом вывода и использует вычислительные ресурсы базового компонента вывода.
NumberOfCpuCoresRequired -> (вещественное число)
NumberOfAcceleratorDevicesRequired -> (вещественное число)
MinMemoryRequiredInMb -> (целое число)
MaxMemoryRequiredInMb -> (целое число)
BaseInferenceComponentName -> (строка)
Имя существующего компонента вывода, который должен содержать компонент вывода, который вы создаёте с помощью вашего запроса.
Укажите этот параметр только в том случае, если ваш запрос предназначен для создания адаптерного компонента вывода. Адаптерный компонент вывода содержит путь к адаптерной модели. Цель адаптерной модели — настроить вывод вывода базовой основной модели, который размещается базовым компонентом вывода. Адаптерный компонент вывода использует вычислительные ресурсы, которые вы назначили базовому компоненту вывода.
При создании адаптерного компонента вывода используйте параметр Container для указания местоположения адаптерных артефактов. В значении параметра используйте параметр ArtifactUrl типа данных InferenceComponentContainerSpecification.
Прежде чем вы сможете создать адаптерный компонент вывода, у вас должен быть существующий компонент вывода, содержащий основную модель, которую вы хотите адаптировать.
Упрощенный синтаксис:
ModelName=string,Container={Image=string,ArtifactUrl=string,Environment={KeyName1=string,KeyName2=string}},StartupParameters={ModelDataDownloadTimeoutInSeconds=integer,ContainerStartupHealthCheckTimeoutInSeconds=integer},ComputeResourceRequirements={NumberOfCpuCoresRequired=float,NumberOfAcceleratorDevicesRequired=float,MinMemoryRequiredInMb=integer,MaxMemoryRequiredInMb=integer},BaseInferenceComponentName=string
Синтаксис JSON:
{
"ModelName": "string",
"Container": {
"Image": "string",
"ArtifactUrl": "string",
"Environment": {"string": "string"
...}
},
"StartupParameters": {
"ModelDataDownloadTimeoutInSeconds": integer,
"ContainerStartupHealthCheckTimeoutInSeconds": integer
},
"ComputeResourceRequirements": {
"NumberOfCpuCoresRequired": float,
"NumberOfAcceleratorDevicesRequired": float,
"MinMemoryRequiredInMb": integer,
"MaxMemoryRequiredInMb": integer
},
"BaseInferenceComponentName": "string"
}
--runtime-config (структура)
Параметры выполнения для модели, развернутой с помощью компонента вывода.
CopyCount -> (целое число)
Упрощенный синтаксис:
CopyCount=integer
Синтаксис JSON:
{
"CopyCount": integer
}
--deployment-config (структура)
Настройки развертывания для компонента вывода. Конфигурация содержит желаемую стратегию развертывания и настройки отката.
RollingUpdatePolicy -> (структура)
Определяет стратегию развёртывания с постепенной заменой для обновления конечной точки SageMaker AI.
MaximumBatchSize -> (структура)
Размер пакета для каждого шага развёртывания с постепенной заменой. На каждом шаге SageMaker AI выделяет ресурсы на новой группе конечных точек, перенаправляет трафик на эту группу и завершает выделение ресурсов на старой группе конечных точек. Значение должно находиться в диапазоне от 5% до 50% от количества копий компонента вывода.
Type -> (строка)
Определяет тип ресурсов конечной точки.
Конечная точка активируется на основе количества копий компонента вывода.
Конечная точка активируется на основе указанного процента ресурсов.
Value -> (целое число)
WaitIntervalInSeconds -> (целое число)
MaximumExecutionTimeoutInSeconds -> (целое число)
RollbackMaximumBatchSize -> (структура)
Размер пакета для отката к старой группе конечных точек. Если этот параметр отсутствует, значение устанавливается по умолчанию, равное 100% от общего объема ресурсов. Если используется значение по умолчанию, SageMaker AI выделяет все ресурсы старой группы конечных точек сразу при откате.
Type -> (строка)
Определяет тип ресурсов конечной точки.
Конечная точка активируется на основе количества копий компонента вывода.
Конечная точка активируется на основе указанного процента ресурсов.
Value -> (целое число)
AutoRollbackConfiguration -> (структура)
Настройка автоматического отката для обработки сбоев развертывания конечной точки и восстановления.
Alarms -> (список)
Список CloudWatch тревог в вашем аккаунте, настроенных для мониторинга метрик конечной точки. Если какая-либо тревога срабатывает во время развертывания, SageMaker откатывает развертывание.
(структура)
CloudWatch тревога, настроенная для мониторинга метрик конечной точки.
AlarmName -> (строка)
{ "RollingUpdatePolicy": { "MaximumBatchSize": { "Type": "COPY_COUNT"|"CAPACITY_PERCENT", "Value": integer }, "WaitIntervalInSeconds": integer, "MaximumExecutionTimeoutInSeconds": integer, "RollbackMaximumBatchSize": { "Type": "COPY_COUNT"|"CAPACITY_PERCENT", "Value": integer } }, "AutoRollbackConfiguration": { "Alarms": [ { "AlarmName": "string" } ... ] } }|
--cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка следует формату, предоставленному --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения перепишут значения из JSON. Невозможно передавать произвольные двоичные значения с помощью значения JSON, поскольку строка будет взята буквально. Это не может быть указано вместе с --cli-input-yaml. --generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, выполняет проверку входных данных команды и возвращает JSON-пример выходного результата для этой команды. Сгенерированный JSON-скелет нестабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.
Общие параметры
--debug (boolean)
Включить отладку логов.
--endpoint-url (string)
Переопределить стандартный URL команды заданным URL.
--no-verify-ssl (boolean)
По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет стандартное поведение проверки SSL-сертификатов.
--no-paginate (boolean)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI сделает только один вызов для первой страницы результатов.
--output (string)
Стиль форматирования вывода команды.
- json
- text
- table
- yaml
- yaml-stream
--query (string)
Запрос JMESPath для фильтрации данных ответа.
--profile (string)
Использовать определённый профиль из файла ключей.
--region (string)
Регион для использования. Переопределяет настройки из конфигурации/окружения.
--version (string)
Показать версию этого инструмента.
--color (string)
Включить/выключить цветной вывод.
- on
- off
- auto
--no-sign-request (boolean)
Не подписывать запросы. Ключи не будут загружены, если этот аргумент указан.
--ca-bundle (string)
Файл сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки из конфигурации/окружения.
--cli-read-timeout (int)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет выполняться без таймаута. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (int)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет выполняться без таймаута. Значение по умолчанию — 60 секунд.
--cli-binary-format (string)
Стиль форматирования для двоичных блоков. По умолчанию используется формат base64. Формат base64 ожидает, что двоичные блоки будут предоставлены в виде закодированной строкой base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, которое соответствует двоичному блоку fileb:// всегда будет обрабатываться как двоичное и использовать содержимое файла непосредственно независимо от cli-binary-format настройки. При использовании file:// содержимое файла необходимо должным образом отформатировать для заданного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (boolean)
Отключить кли паджер для вывода.
--cli-auto-prompt (boolean)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (boolean)
Отключить автоматическое запросы параметров ввода CLI.
Вывод
InferenceComponentArn -> (string)
© Copyright 2025, Amazon Web Services. Created using Sphinx.