describe-endpoint
Описание
Возвращает описание конечной точки.
См. также: Документацию API AWS
Синтаксис
describe-endpoint
--endpoint-name <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--endpoint-name (строка)
--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения с помощью предоставленного значения JSON, поскольку строка будет интерпретироваться буквально. Это не может быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, будет выведен пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет нестабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.
Глобальные параметры
--debug (логическое)
Включить отладочную запись журнала.
--endpoint-url (строка)
Переопределить URL по умолчанию команды указанным URL.
--no-verify-ssl (логическое)
По умолчанию AWS CLI использует SSL при взаимодействии с AWS-сервисами. Для каждого SSL-соединения AWS CLI будет проверять SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.
--no-paginate (логическое)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования для вывода команды.
- json
- text
- таблица
- yaml
- yaml-поток
--query (строка)
Запрос JMESPath для фильтрации данных ответа.
--profile (строка)
Использовать определенный профиль из файла учетных данных.
--region (строка)
Регион для использования. Переопределяет параметры конфигурации/среды.
--version (строка)
Отобразить версию этого инструмента.
--color (строка)
Включить/выключить цветной вывод.
- включено
- выключено
- автоматически
--no-sign-request (логическое)
Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.
--ca-bundle (строка)
Файл сертификата CA для проверки SSL-сертификатов. Переопределяет параметры конфигурации/среды.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет выполняться блокирующим образом без таймаута. Значение по умолчанию составляет 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет выполняться блокирующим образом без таймаута. Значение по умолчанию составляет 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 предполагает, что двоичные блоки предоставляются как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, сопоставляемого с двоичным блоком, fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от параметра cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (логическое)
Отключить кли-пагинатор для вывода.
--cli-auto-prompt (логическое)
Автоматически запросить параметры ввода CLI.
--no-cli-auto-prompt (логическое)
Отключить автоматическое запрошение параметров ввода CLI.
Вывод
EndpointName -> (строка)
EndpointArn -> (строка)
EndpointConfigName -> (строка)
ProductionVariants -> (список)
Массив объектов ProductionVariantSummary, по одному для каждой модели, размещенной за этой конечной точкой.
(структура)
Описание веса и мощностей для варианта производства, связанного с конечной точкой. Если вы отправили запрос к API UpdateEndpointWeightsAndCapacities, и статус конечной точки Updating, вы получите разные значения желаемого и текущего состояния.
VariantName -> (строка)
DeployedImages -> (список)
Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry для изображений вывода, развернутых на экземплярах этой ProductionVariant.
(структура)
Получает путь Amazon EC2 Container Registry для Docker-изображения модели, размещенной в ProductionVariant .
Если вы использовали форму registry/repository[:tag] для указания пути к изображению основного контейнера при создании модели, размещенной в этой ProductionVariant, путь будет соответствовать пути вида registry/repository[@digest]. Digest — это хеш-значение, которое идентифицирует конкретную версию изображения. Дополнительную информацию о путях Amazon ECR см. в руководстве пользователя Amazon ECR.
SpecifiedImage -> (строка)
ResolvedImage -> (строка)
ProductionVariant.ResolutionTime -> (отметка времени)
ResolvedImage.CurrentWeight -> (вещественное число)
DesiredWeight -> (вещественное число)
UpdateEndpointWeightsAndCapacities.CurrentInstanceCount -> (целое число)
DesiredInstanceCount -> (целое число)
UpdateEndpointWeightsAndCapacities.VariantStatus -> (список)
Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.
(структура)
Описание статуса варианта производства.
Status -> (строка)
Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.
-
Creating: Создание ресурсов вывода для варианта производства. -
Deleting: Завершение работы ресурсов вывода для варианта производства. -
Updating: Обновление емкости для варианта производства. -
ActivatingTraffic: Включение трафика для варианта производства. -
Baking: Период ожидания для мониторинга CloudWatch-сигналов тревоги в конфигурации автоматического отката.
StatusMessage -> (строка)
StartTime -> (отметка времени)
CurrentServerlessConfig -> (структура)
Конфигурация серверлеса для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного одновременного выполнения для серверлесс-конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверлесс-конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в CreateInferenceRecommendationsJobs.DesiredServerlessConfig -> (структура)
Конфигурация серверлеса, запрошенная для обновления конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного одновременного выполнения для серверлесс-конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверлесс-конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в CreateInferenceRecommendationsJobs.ManagedInstanceScaling -> (структура)
Настройки, которые контролируют диапазон количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для поддержки трафика.
Status -> (строка)
MinInstanceCount -> (целое число)
MaxInstanceCount -> (целое число)
RoutingConfig -> (структура)
Настройки, которые контролируют, как конечная точка направляет входящий трафик на экземпляры, которые размещает конечная точка.
RoutingStrategy -> (строка)
Устанавливает, как конечная точка направляет входящий трафик:
-
LEAST_OUTSTANDING_REQUESTS: Конечная точка направляет запросы на конкретные экземпляры, имеющие больше емкости для их обработки. -
RANDOM: Конечная точка направляет каждый запрос на случайным образом выбранный экземпляр.
DataCaptureConfig -> (структура)
Текущая активная конфигурация захвата данных, используемая вашей конечной точкой.
EnableCapture -> (булево)
CaptureStatus -> (строка)
CurrentSamplingPercentage -> (целое число)
DestinationS3Uri -> (строка)
KmsKeyId -> (строка)
EndpointStatus -> (строка)
Статус конечной точки.
-
OutOfService: Конечная точка недоступна для приема входящих запросов. -
Creating: Выполняется CreateEndpoint. -
Updating: Выполняется UpdateEndpoint или UpdateEndpointWeightsAndCapacities. -
SystemUpdating: Конечная точка проходит техническое обслуживание и не может быть обновлена, удалена или перемасштабирована, пока не завершит работу. Это техническое обслуживание не изменяет какие-либо значения, заданные клиентом, такие как конфигурация VPC, шифрование KMS, модель, тип экземпляра или количество экземпляров. -
RollingBack: Конечная точка не может выполнить масштабирование вверх или вниз или изменить вес и емкость варианта и находится в процессе отката к предыдущей конфигурации. После завершения отката конечная точка возвращается в статусInService. Этот переходный статус применяется только к конечной точке, у которой включено автоматическое масштабирование, и которая проходит изменение веса или емкости варианта в рамках вызова UpdateEndpointWeightsAndCapacities или при явном вызове операции UpdateEndpointWeightsAndCapacities. -
InService: Конечная точка доступна для обработки входящих запросов. -
Deleting: Выполняется DeleteEndpoint. -
Failed: Конечная точка не может быть создана, обновлена или перемасштабирована. Используйте значениеFailureReason, возвращаемое DescribeEndpoint, для получения информации об ошибке. DeleteEndpoint — единственная операция, которая может быть выполнена на конечной точке с ошибкой. -
UpdateRollbackFailed: Оба развертывания с отката и автоматический откат завершились неудачно. Ваша конечная точка находится в режиме обслуживания с комбинацией старой и новой конфигураций конечной точки. Дополнительную информацию о способе решения этой проблемы и восстановления статуса конечной точки доInServiceсм. в разделе Развертывание с отката.
FailureReason -> (строка)
Failed, причина неудачи.CreationTime -> (отметка времени)
LastModifiedTime -> (отметка времени)
LastDeploymentConfig -> (структура)
Настройка последнего развертывания конечной точки.
BlueGreenUpdatePolicy -> (структура)
Политика обновления для развертывания «синий/зелёный». Если эта политика указана, SageMaker создаёт новый флот во время развертывания, сохраняя при этом старый флот. SageMaker переключает трафик на новый флот в соответствии с указанной конфигурацией маршрутизации трафика. В конфигурации развертывания должна использоваться только одна политика обновления. Если политика обновления не указана, SageMaker по умолчанию использует стратегию развертывания «синий/зелёный» с переключением всего трафика сразу.
TrafficRoutingConfiguration -> (структура)
Определяет стратегию маршрутизации трафика для переключения трафика со старого флота на новый флот во время развертывания конечной точки.
Type -> (строка)
Тип стратегии маршрутизации трафика.
-
ALL_AT_ONCE: Трафик конечной точки переключается на новый флот в один шаг. -
CANARY: Трафик конечной точки переключается на новый флот в два шага. Первый шаг — это кэнион, представляющий собой небольшую часть трафика. Второй шаг — оставшаяся часть трафика. -
LINEAR: Трафик конечной точки переключается на новый флот в n шагов заданного размера.
WaitIntervalInSeconds -> (целое число)
CanarySize -> (структура)
Размер пакета для первого шага включения трафика на новый флот конечной точки. Value должен быть меньше или равен 50% от общего количества экземпляров варианта.
Type -> (строка)
Указывает тип ёмкости конечной точки.
-
INSTANCE_COUNT: Конечная точка активируется в зависимости от количества экземпляров. -
CAPACITY_PERCENT: Конечная точка активируется в зависимости от указанного процента ёмкости.
Value -> (целое число)
LinearStepSize -> (структура)
Размер пакета для каждого шага включения трафика на новый флот конечной точки. Value должен составлять 10-50% от общего количества экземпляров варианта.
Type -> (строка)
Указывает тип ёмкости конечной точки.
-
INSTANCE_COUNT: Конечная точка активируется в зависимости от количества экземпляров. -
CAPACITY_PERCENT: Конечная точка активируется в зависимости от указанного процента ёмкости.
Value -> (целое число)
TerminationWaitInSeconds -> (целое число)
MaximumExecutionTimeoutInSeconds -> (целое число)
TerminationWaitInSeconds и WaitIntervalInSeconds .RollingUpdatePolicy -> (структура)
Указывает стратегию развертывания в режиме непрерывного обновления для обновления конечной точки SageMaker.
MaximumBatchSize -> (структура)
Размер пакета для каждого шага непрерывного обновления для выделения ёмкости и включения трафика на новый флот конечной точки и завершения ёмкости на старом флоте конечной точки. Значение должно быть от 5% до 50% от общего количества экземпляров варианта.
Type -> (строка)
Указывает тип ёмкости конечной точки.
-
INSTANCE_COUNT: Конечная точка активируется в зависимости от количества экземпляров. -
CAPACITY_PERCENT: Конечная точка активируется в зависимости от указанного процента ёмкости.
Value -> (целое число)
WaitIntervalInSeconds -> (целое число)
MaximumExecutionTimeoutInSeconds -> (целое число)
RollbackMaximumBatchSize -> (структура)
Размер пакета для отката на старый флот конечной точки. Каждый шаг непрерывного обновления для выделения ёмкости и включения трафика на старый флот конечной точки и завершения ёмкости на новом флоте конечной точки. Если этот параметр отсутствует, по умолчанию будет установлено значение 100% от общей ёмкости, что означает запуск всей ёмкости старого флота сразу при отмене.
Type -> (строка)
Указывает тип ёмкости конечной точки.
-
INSTANCE_COUNT: Конечная точка активируется в зависимости от количества экземпляров. -
CAPACITY_PERCENT: Конечная точка активируется в зависимости от указанного процента ёмкости.
Value -> (целое число)
AutoRollbackConfiguration -> (структура)
Конфигурация автоматического отката для обработки сбоев и восстановления при развертывании конечной точки.
Alarms -> (список)
Список оповещений CloudWatch в вашей учётной записи, настроенных для мониторинга метрик конечной точки. Если любое из оповещений срабатывает во время развертывания, SageMaker отменяет развертывание.
(структура)
Оповещение Amazon CloudWatch, настроенное для мониторинга метрик конечной точки.
AlarmName -> (строка)
AsyncInferenceConfig -> (структура)
Возвращает описание конфигурации конечной точки, созданной с помощью API ` CreateEndpointConfig https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_CreateEndpointConfig.html`__.
ClientConfig -> (структура)
Настраивает поведение клиента, используемого SageMaker для взаимодействия с контейнером модели во время асинхронного вывода.
MaxConcurrentInvocationsPerInstance -> (целое число)
OutputConfig -> (структура)
Указывает конфигурацию для вывода вызовов асинхронного вывода.
KmsKeyId -> (строка)
S3OutputPath -> (строка)
NotificationConfig -> (структура)
Указывает конфигурацию уведомлений о результатах вывода для асинхронного вывода.
SuccessTopic -> (строка)
ErrorTopic -> (строка)
IncludeInferenceResponseIn -> (список)
Темы Amazon SNS, в которые вы хотите включить ответ вывода.
Примечание
Ответ вывода включается только в том случае, если размер ответа меньше или равен 128 КБ.(строка)
S3FailurePath -> (строка)
PendingDeploymentSummary -> (структура)
Возвращает сводку о развертывании в процессе. Это поле возвращается только тогда, когда конечная точка создает или обновляет конфигурацию новой конечной точки.
EndpointConfigName -> (строка)
ProductionVariants -> (список)
Массив объектов PendingProductionVariantSummary, по одному для каждой модели, размещенной за этой конечной точкой для развертывания в процессе.
(структура)
Сводка варианта производства для развертывания, когда конечная точка создается или обновляется операциями CreateEndpoint или UpdateEndpoint. Описывает VariantStatus, вес и емкость варианта производства, связанного с конечной точкой.
VariantName -> (строка)
DeployedImages -> (список)
Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry для изображений вывода, развернутых на экземплярах этой ProductionVariant.
(структура)
Получает путь Amazon EC2 Container Registry к изображению Docker модели, которая размещена в этом ProductionVariant.
Если вы использовали форму registry/repository[:tag] для указания пути изображения основного контейнера при создании модели, размещенной в этом ProductionVariant, путь разрешается в путь вида registry/repository[@digest]. Хеш-значение является значением дайджеста, которое идентифицирует определенную версию изображения. Сведения о путях Amazon ECR см. в разделе Вытягивание изображения в руководстве пользователя Amazon ECR.
SpecifiedImage -> (строка)
ResolvedImage -> (строка)
ProductionVariant.ResolutionTime -> (метка времени)
ResolvedImage
CurrentWeight -> (вещественное число)
DesiredWeight -> (вещественное число)
CurrentInstanceCount -> (целое число)
DesiredInstanceCount -> (целое число)
InstanceType -> (строка)
AcceleratorType -> (строка)
Этот параметр больше не поддерживается. Ускорители Elastic Inference (EI) больше недоступны.
Этот параметр использовался для указания размера экземпляра EI, который необходимо использовать для варианта производства.
VariantStatus -> (список)
Статус варианта конечной точки, который описывает текущий статус этапа развертывания или операционный статус.
(структура)
Описывает статус варианта производства.
Status -> (строка)
Статус варианта конечной точки, который описывает текущий статус этапа развертывания или операционный статус.
-
Creating: Создание ресурсов вывода для варианта производства. -
Deleting: Прекращение работы ресурсов вывода для варианта производства. -
Updating: Обновление емкости для варианта производства. -
ActivatingTraffic: Включение трафика для варианта производства. -
Baking: Период ожидания для мониторинга сигналов CloudWatch в конфигурации автоматического отката.
StatusMessage -> (строка)
StartTime -> (метка времени)
CurrentServerlessConfig -> (структура)
Конфигурация без сервера для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного одновременного выполнения, которое необходимо выделить для конечной точки без сервера. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций по конечным точкам без сервера для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.DesiredServerlessConfig -> (структура)
Конфигурация без сервера, запрошенная для этого развертывания, как указано в конфигурации конечной точки для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенного одновременного выполнения, которое необходимо выделить для конечной точки без сервера. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций по конечным точкам без сервера для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.ManagedInstanceScaling -> (структура)
Параметры, которые управляют диапазоном количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для адаптации к трафику.
Status -> (строка)
MinInstanceCount -> (целое число)
MaxInstanceCount -> (целое число)
RoutingConfig -> (структура)
Параметры, которые управляют тем, как конечная точка направляет входящий трафик на экземпляры, которые она предоставляет.
RoutingStrategy -> (строка)
Определяет способ маршрутизации входящего трафика конечной точкой:
-
LEAST_OUTSTANDING_REQUESTS: конечная точка направляет запросы на конкретные экземпляры, которые имеют больше возможностей для их обработки. -
RANDOM: конечная точка направляет каждый запрос на случайный экземпляр.
StartTime -> (метка времени)
ShadowProductionVariants -> (список)
Массив объектов PendingProductionVariantSummary, по одному для каждой модели, размещённой за этим конечной точкой в режиме тени с реплицированным производственным трафиком из модели, указанной в ProductionVariants для развертывания в процессе.
(структура)
Резюме производственной варианты для развертывания, когда конечная точка создаёт или обновляет с операциями CreateEndpoint или UpdateEndpoint. Описывает VariantStatus , вес и ёмкость для производственной варианты, связанной с конечной точкой.
VariantName -> (строка)
DeployedImages -> (список)
Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry изображений вывода, развернутых на экземплярах этой ProductionVariant.
(структура)
Получает путь Amazon EC2 Container Registry образа Docker модели, которая размещена в этом ProductionVariant.
Если вы использовали форму registry/repository[:tag] для указания пути образа основного контейнера при создании модели, размещённой в этом ProductionVariant, путь будет разрешён в путь вида registry/repository[@digest]. Хеш-значение, идентифицирующее конкретную версию образа. Дополнительная информация о путях Amazon ECR находится в разделе «Получение образа» в руководстве пользователя Amazon ECR.
SpecifiedImage -> (строка)
ResolvedImage -> (строка)
ProductionVariant.ResolutionTime -> (временная метка)
ResolvedImage.CurrentWeight -> (вещественное число)
DesiredWeight -> (вещественное число)
CurrentInstanceCount -> (целое число)
DesiredInstanceCount -> (целое число)
InstanceType -> (строка)
AcceleratorType -> (строка)
Этот параметр больше не поддерживается. Elastic Inference (EI) больше недоступен.
Этот параметр использовался для указания размера экземпляра EI, используемого для производственной варианта.
VariantStatus -> (список)
Статус варианта конечной точки, который описывает текущий статус стадии развертывания или операционный статус.
(структура)
Описывает статус производственной варианта.
Status -> (строка)
Статус варианта конечной точки, который описывает текущий статус стадии развертывания или операционный статус.
-
Creating: Создание ресурсов вывода для производственного варианта. -
Deleting: Завершение ресурсов вывода для производственного варианта. -
Updating: Обновление ёмкости для производственного варианта. -
ActivatingTraffic: Включение трафика для производственной варианты. -
Baking: Период ожидания для мониторинга сигналов CloudWatch в конфигурации автоматического отката.
StatusMessage -> (строка)
StartTime -> (временная метка)
CurrentServerlessConfig -> (структура)
Конфигурация серверного варианта для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество предоставленной параллельности, подлежащей выделению для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверной конечной точки для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.DesiredServerlessConfig -> (структура)
Конфигурация серверного варианта, запрошенная для этого развертывания, указанная в конфигурации конечной точки для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество предоставленной параллельности, подлежащей выделению для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверной конечной точки для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.ManagedInstanceScaling -> (структура)
Настройки, которые контролируют диапазон количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для адаптации к трафику.
Status -> (строка)
MinInstanceCount -> (целое число)
MaxInstanceCount -> (целое число)
RoutingConfig -> (структура)
Настройки, которые контролируют, как конечная точка направляет входящий трафик на экземпляры, которые она размещает.
RoutingStrategy -> (строка)
Устанавливает, как конечная точка направляет входящий трафик:
-
LEAST_OUTSTANDING_REQUESTS: Конечная точка направляет запросы на конкретные экземпляры, которые имеют больше ёмкости для их обработки. -
RANDOM: Конечная точка направляет каждый запрос на случайным образом выбранный экземпляр.
ExplainerConfig -> (структура)
Параметры конфигурации для объяснения.
ClarifyExplainerConfig -> (структура)
Элемент ExplainerConfig, содержащий параметры конфигурации для объяснения SageMaker Clarify.
EnableExplanations -> (строка)
EnableExplanations https://docs.aws.amazon.com/sagemaker/latest/dg/clarify-online-explainability-create-endpoint.html#clarify-online-explainability-create-endpoint-enable`__.InferenceConfig -> (структура)
Параметр конфигурации вывода для контейнера модели.
FeaturesAttribute -> (строка)
FeaturesAttribute — это выражение JMESPath 'myfeatures', то оно извлекает список признаков [1,2,3] из данных запроса '{"myfeatures":[1,2,3]}'.ContentTemplate -> (строка)
ContentTemplate '{"myfeatures":$features}' отформатирует список признаков [1,2,3] в строку записи '{"myfeatures":[1,2,3]}'. Требуется только тогда, когда входной формат контейнера модели — JSON Lines.MaxRecordCount -> (целое число)
MaxRecordCount равно 1, контейнер модели ожидает по одной записи на запрос. Значение 2 или больше означает, что контейнер ожидает пакетные запросы, что может уменьшить нагрузку и ускорить процесс вывода. Если этот параметр не указан, объяснители будут настраивать количество записей на запрос в соответствии с возможностями контейнера модели во время выполнения.MaxPayloadInMB -> (целое число)
6 МБ.ProbabilityIndex -> (целое число)
Индекс, начинающийся с нуля, используемый для извлечения значения вероятности (оценки) или списка из выходных данных контейнера модели в формате CSV. Если это значение не указано, все выходные данные контейнера модели будут рассматриваться как значение вероятности (оценка) или список.
Пример для модели с одним классом: Если выходные данные контейнера модели содержат строковое обозначение метки предсказания, за которым следует вероятность: '1,0.6', установите ProbabilityIndex в 1, чтобы выбрать значение вероятности 0.6.
Пример для многоклассовой модели: Если выходные данные контейнера модели содержат строковое обозначение метки предсказания, за которым следует вероятность: '"[\'cat\',\'dog\',\'fish\']","[0.1,0.6,0.3]"', установите ProbabilityIndex в 1, чтобы выбрать значения вероятностей [0.1,0.6,0.3].
LabelIndex -> (целое число)
Индекс, начинающийся с нуля, используемый для извлечения заголовка метки или списка заголовков меток из выходных данных контейнера модели в формате CSV.
'"[\'cat\',\'dog\',\'fish\']","[0.1,0.6,0.3]"', установите LabelIndex в 0, чтобы выбрать заголовки меток ['cat','dog','fish'].ProbabilityAttribute -> (строка)
Выражение JMESPath, используемое для извлечения вероятности (или оценки) из выходных данных контейнера модели, если контейнер модели находится в формате JSON Lines.
'{"predicted_label":1,"probability":0.6}', установите ProbabilityAttribute в 'probability'.LabelAttribute -> (строка)
Выражение JMESPath, используемое для поиска списка заголовков меток в выходных данных контейнера модели.
'{"labels":["cat","dog","fish"],"probability":[0.6,0.3,0.1]}', установите LabelAttribute в 'labels', чтобы извлечь список заголовков меток ["cat","dog","fish"]
LabelHeaders -> (список)
Для задач многоклассовой классификации заголовки меток — это имена классов. В противном случае заголовок метки — это имя предсказанной метки. Они используются для улучшения удобочитаемости выходных данных API InvokeEndpoint. Дополнительную информацию см. в разделе Ответ в разделе Вызов конечной точки в Руководстве разработчика.
(строка)
FeatureHeaders -> (список)
Названия признаков. Если указаны, они включаются в полезную нагрузку ответа конечной точки для повышения удобочитаемости выходных данных InvokeEndpoint. Дополнительную информацию см. в разделе «Ответ» в разделе «Вызов конечной точки» в Руководстве разработчика.
(строка)
FeatureTypes -> (список)
Список типов данных признаков (необязательно). Применим только к объяснениям NLP. Если указан, FeatureTypes должен содержать как минимум одну строку 'text' (например, ['text']). Если FeatureTypes не указан, объяснители определяют типы признаков на основе исходных данных. Типы признаков включаются в полезную нагрузку ответа конечной точки. Дополнительную информацию см. в разделе «Ответ» в разделе «Вызов конечной точки» в Руководстве разработчика.
(строка)
ShapConfig -> (структура)
Конфигурация для анализа SHAP.
ShapBaselineConfig -> (структура)
Конфигурация для базовой линии SHAP алгоритма Kernal SHAP.
MimeType -> (строка)
'text/csv' или 'application/jsonlines'. По умолчанию — 'text/csv'.ShapBaseline -> (строка)
ShapBaseline может содержать одну или несколько записей, которые будут использоваться в качестве базового набора данных. Формат файла базовой линии SHAP должен совпадать с форматом обучающего набора данных. Например, если обучающий набор данных находится в формате CSV и каждая запись содержит четыре признака, а все признаки числовые, то формат базовых данных также должен иметь эти характеристики. Для обработки естественного языка (NLP) текстовых столбцов значение базовой линии должно быть значением, используемым для замены единицы текста, указанной в Granularity параметра TextConfig. Предельная величина для ShapBasline составляет 4 КБ. Используйте параметр ShapBaselineUri, если хотите предоставить более 4 КБ базовых данных.ShapBaselineUri -> (строка)
ShapBaselineUri должен быть доступен для ВЧС. Дополнительную информацию об настройке конечных точек с Amazon Virtual Private Cloud см. в разделе Предоставление SageMaker доступа к ресурсам в вашей виртуальной частной сети Amazon.NumberOfSamples -> (целое число)
Количество выборок, которые будут использоваться для анализа алгоритмом Kernal SHAP.
Примечание
Количество выборок определяет размер синтетического набора данных, что влияет на задержку запросов на объяснение. Дополнительную информацию см. в разделе Синтетические данные в разделе Настройка и создание конечной точки.UseLogit -> (булево)
Seed -> (целое число)
TextConfig -> (структура)
Параметр, указывающий, обрабатываются ли текстовые признаки как текст и предоставляются ли объяснения для отдельных единиц текста. Требуется только для объяснения обработки естественного языка (NLP).
Language -> (строка)
Указывает язык текстовых признаков в коде `ISO 639-1 < https://en.wikipedia.org/wiki/List_of_ISO_639-1_codes>`__ или коде ISO 639-3 поддерживаемого языка.
Примечание
Для смешанных языков используйте код'xx'.Granularity -> (строка)
'token', то каждый токен (например, слово на английском языке) текста рассматривается как признак. Значения SHAP вычисляются для каждой единицы/признака.ShadowProductionVariants -> (список)
Массив объектов ProductionVariantSummary, по одному для каждой модели, которую вы хотите разместить на этом конечной точке в режиме тени с дублированием трафика производства с модели, указанной в ProductionVariants.
(структура)
Описывает вес и мощности для варианта производства, связанного с конечной точкой. Если вы отправили запрос в API UpdateEndpointWeightsAndCapacities, и статус конечной точки Updating, вы получите различные желаемые и текущие значения.
VariantName -> (строка)
DeployedImages -> (список)
Массив объектов DeployedImage, указывающих пути Amazon EC2 Container Registry для изображений инференции, развернутых на экземплярах этой ProductionVariant.
(структура)
Получает путь Amazon EC2 Container Registry для docker-изображения модели, размещенной в ProductionVariant.
Если вы использовали форму registry/repository[:tag] для указания пути к изображению основного контейнера при создании модели, размещенной в этой ProductionVariant, путь разрешается в путь вида registry/repository[@digest]. Хеш-значение, идентифицирующее определенную версию изображения. Подробности о путях Amazon ECR см. в руководстве Amazon ECR User Guide — Загрузка изображения.
SpecifiedImage -> (строка)
ResolvedImage -> (строка)
ProductionVariant.ResolutionTime -> (отметка времени)
ResolvedImage.CurrentWeight -> (вещественное число)
DesiredWeight -> (вещественное число)
UpdateEndpointWeightsAndCapacities.CurrentInstanceCount -> (целое число)
DesiredInstanceCount -> (целое число)
UpdateEndpointWeightsAndCapacities.VariantStatus -> (список)
Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.
(структура)
Описывает состояние варианта производства.
Status -> (строка)
Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.
-
Creating: Создание ресурсов инференции для варианта производства. -
Deleting: Закрытие ресурсов инференции для варианта производства. -
Updating: Обновление емкости для варианта производства. -
ActivatingTraffic: Включение трафика для варианта производства. -
Baking: Период ожидания для мониторинга предупреждений CloudWatch в конфигурации автоматической отката.
StatusMessage -> (строка)
StartTime -> (отметка времени)
CurrentServerlessConfig -> (структура)
Настройка серверless для конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенной одновременной обработки, выделяемое для серверless конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверless конечной точки для заданий Inference Recommender. Дополнительную информацию о создании задания Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .DesiredServerlessConfig -> (структура)
Запрошенная конфигурация серверless для обновления конечной точки.
MemorySizeInMB -> (целое число)
MaxConcurrency -> (целое число)
ProvisionedConcurrency -> (целое число)
Количество выделенной одновременной обработки, выделяемое для серверless конечной точки. Должно быть меньше или равно MaxConcurrency.
Примечание
Это поле не поддерживается для рекомендаций серверless конечной точки для заданий Inference Recommender. Дополнительную информацию о создании задания Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .ManagedInstanceScaling -> (структура)
Настройки, контролирующие диапазон количества экземпляров, которые конечная точка выделяет при масштабировании вверх или вниз для обработки трафика.
Status -> (строка)
MinInstanceCount -> (целое число)
MaxInstanceCount -> (целое число)
RoutingConfig -> (структура)
Настройки, которые контролируют маршрутизацию входящего трафика на экземпляры, размещенные конечной точкой.
RoutingStrategy -> (строка)
Устанавливает способ маршрутизации входящего трафика конечной точкой:
-
LEAST_OUTSTANDING_REQUESTS: конечная точка маршрутизирует запросы на конкретные экземпляры, у которых больше емкости для их обработки. -
RANDOM: конечная точка маршрутизирует каждый запрос на случайный выбранный экземпляр.
© Copyright 2025, Amazon Web Services. Created using Sphinx.