Spec-Zone.ru › AWS CLI v2

[ aws . sagemaker ]

describe-endpoint

Описание

Возвращает описание конечной точки.

См. также: Документацию API AWS

Синтаксис

  describe-endpoint
--endpoint-name <value>
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--endpoint-name (строка)

Имя конечной точки.

--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения с помощью предоставленного значения JSON, поскольку строка будет интерпретироваться буквально. Это не может быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, будет выведен пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет нестабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.

Глобальные параметры

--debug (логическое)

Включить отладочную запись журнала.

--endpoint-url (строка)

Переопределить URL по умолчанию команды указанным URL.

--no-verify-ssl (логическое)

По умолчанию AWS CLI использует SSL при взаимодействии с AWS-сервисами. Для каждого SSL-соединения AWS CLI будет проверять SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.

--no-paginate (логическое)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования для вывода команды.

  • json
  • text
  • таблица
  • yaml
  • yaml-поток

--query (строка)

Запрос JMESPath для фильтрации данных ответа.

--profile (строка)

Использовать определенный профиль из файла учетных данных.

--region (строка)

Регион для использования. Переопределяет параметры конфигурации/среды.

--version (строка)

Отобразить версию этого инструмента.

--color (строка)

Включить/выключить цветной вывод.

  • включено
  • выключено
  • автоматически

--no-sign-request (логическое)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.

--ca-bundle (строка)

Файл сертификата CA для проверки SSL-сертификатов. Переопределяет параметры конфигурации/среды.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет выполняться блокирующим образом без таймаута. Значение по умолчанию составляет 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет выполняться блокирующим образом без таймаута. Значение по умолчанию составляет 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 предполагает, что двоичные блоки предоставляются как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, сопоставляемого с двоичным блоком, fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от параметра cli-binary-format. При использовании file:// содержимое файла должно быть правильно отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (логическое)

Отключить кли-пагинатор для вывода.

--cli-auto-prompt (логическое)

Автоматически запросить параметры ввода CLI.

--no-cli-auto-prompt (логическое)

Отключить автоматическое запрошение параметров ввода CLI.

Вывод

EndpointName -> (строка)

Имя конечной точки.

EndpointArn -> (строка)

Amazon Resource Name (ARN) конечной точки.

EndpointConfigName -> (строка)

Имя конфигурации конечной точки, связанной с этой конечной точкой.

ProductionVariants -> (список)

Массив объектов ProductionVariantSummary, по одному для каждой модели, размещенной за этой конечной точкой.

(структура)

Описание веса и мощностей для варианта производства, связанного с конечной точкой. Если вы отправили запрос к API UpdateEndpointWeightsAndCapacities, и статус конечной точки Updating, вы получите разные значения желаемого и текущего состояния.

VariantName -> (строка)

Название варианта.

DeployedImages -> (список)

Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry для изображений вывода, развернутых на экземплярах этой ProductionVariant.

(структура)

Получает путь Amazon EC2 Container Registry для Docker-изображения модели, размещенной в ProductionVariant .

Если вы использовали форму registry/repository[:tag] для указания пути к изображению основного контейнера при создании модели, размещенной в этой ProductionVariant, путь будет соответствовать пути вида registry/repository[@digest]. Digest — это хеш-значение, которое идентифицирует конкретную версию изображения. Дополнительную информацию о путях Amazon ECR см. в руководстве пользователя Amazon ECR.

SpecifiedImage -> (строка)

Путь к изображению, который вы указали при создании модели.

ResolvedImage -> (строка)

Конкретный путь digest изображения, размещенного в этой ProductionVariant.

ResolutionTime -> (отметка времени)

Дата и время, когда путь к изображению для модели был изменен на ResolvedImage.

CurrentWeight -> (вещественное число)

Вес, связанный с вариантом.

DesiredWeight -> (вещественное число)

Запрошенный вес, как указано в запросе UpdateEndpointWeightsAndCapacities.

CurrentInstanceCount -> (целое число)

Количество экземпляров, связанных с вариантом.

DesiredInstanceCount -> (целое число)

Количество экземпляров, запрошенных в запросе UpdateEndpointWeightsAndCapacities.

VariantStatus -> (список)

Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.

(структура)

Описание статуса варианта производства.

Status -> (строка)

Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.

  • Creating : Создание ресурсов вывода для варианта производства.
  • Deleting : Завершение работы ресурсов вывода для варианта производства.
  • Updating : Обновление емкости для варианта производства.
  • ActivatingTraffic : Включение трафика для варианта производства.
  • Baking : Период ожидания для мониторинга CloudWatch-сигналов тревоги в конфигурации автоматического отката.

StatusMessage -> (строка)

Сообщение, описывающее статус варианта производства.

StartTime -> (отметка времени)

Время начала текущего изменения статуса.

CurrentServerlessConfig -> (структура)

Конфигурация серверлеса для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверлесс-конечной точки. Допустимые значения — кратные 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверлесс-конечная точка.

ProvisionedConcurrency -> (целое число)

Количество выделенного одновременного выполнения для серверлесс-конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверлесс-конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в CreateInferenceRecommendationsJobs.

DesiredServerlessConfig -> (структура)

Конфигурация серверлеса, запрошенная для обновления конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверлесс-конечной точки. Допустимые значения — кратные 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверлесс-конечная точка.

ProvisionedConcurrency -> (целое число)

Количество выделенного одновременного выполнения для серверлесс-конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверлесс-конечных точек для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в CreateInferenceRecommendationsJobs.

ManagedInstanceScaling -> (структура)

Настройки, которые контролируют диапазон количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для поддержки трафика.

Status -> (строка)

Указывает, включено ли управляемое масштабирование экземпляров.

MinInstanceCount -> (целое число)

Минимальное количество экземпляров, которое конечная точка должна сохранить при масштабировании вниз для поддержки уменьшения трафика.

MaxInstanceCount -> (целое число)

Максимальное количество экземпляров, которые конечная точка может предоставить при масштабировании вверх для поддержки увеличения трафика.

RoutingConfig -> (структура)

Настройки, которые контролируют, как конечная точка направляет входящий трафик на экземпляры, которые размещает конечная точка.

RoutingStrategy -> (строка)

Устанавливает, как конечная точка направляет входящий трафик:

  • LEAST_OUTSTANDING_REQUESTS : Конечная точка направляет запросы на конкретные экземпляры, имеющие больше емкости для их обработки.
  • RANDOM : Конечная точка направляет каждый запрос на случайным образом выбранный экземпляр.

DataCaptureConfig -> (структура)

Текущая активная конфигурация захвата данных, используемая вашей конечной точкой.

EnableCapture -> (булево)

Включен ли или выключен захват данных.

CaptureStatus -> (строка)

Функционален ли сейчас захват данных.

CurrentSamplingPercentage -> (целое число)

Процент запросов, захватываемых вашей конечной точкой.

DestinationS3Uri -> (строка)

Расположение Amazon S3, используемое для захвата данных.

KmsKeyId -> (строка)

Ключ KMS, используемый для шифрования данных в Amazon S3.

EndpointStatus -> (строка)

Статус конечной точки.

  • OutOfService : Конечная точка недоступна для приема входящих запросов.
  • Creating : Выполняется CreateEndpoint.
  • Updating : Выполняется UpdateEndpoint или UpdateEndpointWeightsAndCapacities.
  • SystemUpdating : Конечная точка проходит техническое обслуживание и не может быть обновлена, удалена или перемасштабирована, пока не завершит работу. Это техническое обслуживание не изменяет какие-либо значения, заданные клиентом, такие как конфигурация VPC, шифрование KMS, модель, тип экземпляра или количество экземпляров.
  • RollingBack : Конечная точка не может выполнить масштабирование вверх или вниз или изменить вес и емкость варианта и находится в процессе отката к предыдущей конфигурации. После завершения отката конечная точка возвращается в статус InService. Этот переходный статус применяется только к конечной точке, у которой включено автоматическое масштабирование, и которая проходит изменение веса или емкости варианта в рамках вызова UpdateEndpointWeightsAndCapacities или при явном вызове операции UpdateEndpointWeightsAndCapacities.
  • InService : Конечная точка доступна для обработки входящих запросов.
  • Deleting : Выполняется DeleteEndpoint.
  • Failed : Конечная точка не может быть создана, обновлена или перемасштабирована. Используйте значение FailureReason, возвращаемое DescribeEndpoint, для получения информации об ошибке. DeleteEndpoint — единственная операция, которая может быть выполнена на конечной точке с ошибкой.
  • UpdateRollbackFailed : Оба развертывания с отката и автоматический откат завершились неудачно. Ваша конечная точка находится в режиме обслуживания с комбинацией старой и новой конфигураций конечной точки. Дополнительную информацию о способе решения этой проблемы и восстановления статуса конечной точки до InService см. в разделе Развертывание с отката.

FailureReason -> (строка)

Если статус конечной точки Failed, причина неудачи.

CreationTime -> (отметка времени)

Отметка времени, показывающая, когда была создана конечная точка.

LastModifiedTime -> (отметка времени)

Отметка времени, показывающая, когда конечная точка была в последний раз изменена.

LastDeploymentConfig -> (структура)

Настройка последнего развертывания конечной точки.

BlueGreenUpdatePolicy -> (структура)

Политика обновления для развертывания «синий/зелёный». Если эта политика указана, SageMaker создаёт новый флот во время развертывания, сохраняя при этом старый флот. SageMaker переключает трафик на новый флот в соответствии с указанной конфигурацией маршрутизации трафика. В конфигурации развертывания должна использоваться только одна политика обновления. Если политика обновления не указана, SageMaker по умолчанию использует стратегию развертывания «синий/зелёный» с переключением всего трафика сразу.

TrafficRoutingConfiguration -> (структура)

Определяет стратегию маршрутизации трафика для переключения трафика со старого флота на новый флот во время развертывания конечной точки.

Type -> (строка)

Тип стратегии маршрутизации трафика.

  • ALL_AT_ONCE : Трафик конечной точки переключается на новый флот в один шаг.
  • CANARY : Трафик конечной точки переключается на новый флот в два шага. Первый шаг — это кэнион, представляющий собой небольшую часть трафика. Второй шаг — оставшаяся часть трафика.
  • LINEAR : Трафик конечной точки переключается на новый флот в n шагов заданного размера.

WaitIntervalInSeconds -> (целое число)

Время ожидания (в секундах) между инкрементными шагами включения трафика на новый флот конечной точки.

CanarySize -> (структура)

Размер пакета для первого шага включения трафика на новый флот конечной точки. Value должен быть меньше или равен 50% от общего количества экземпляров варианта.

Type -> (строка)

Указывает тип ёмкости конечной точки.

  • INSTANCE_COUNT : Конечная точка активируется в зависимости от количества экземпляров.
  • CAPACITY_PERCENT : Конечная точка активируется в зависимости от указанного процента ёмкости.

Value -> (целое число)

Определяет размер ёмкости, либо как количество экземпляров, либо как процент ёмкости.

LinearStepSize -> (структура)

Размер пакета для каждого шага включения трафика на новый флот конечной точки. Value должен составлять 10-50% от общего количества экземпляров варианта.

Type -> (строка)

Указывает тип ёмкости конечной точки.

  • INSTANCE_COUNT : Конечная точка активируется в зависимости от количества экземпляров.
  • CAPACITY_PERCENT : Конечная точка активируется в зависимости от указанного процента ёмкости.

Value -> (целое число)

Определяет размер ёмкости, либо как количество экземпляров, либо как процент ёмкости.

TerminationWaitInSeconds -> (целое число)

Дополнительное время ожидания в секундах после завершения развертывания конечной точки перед завершением старого флота конечной точки. По умолчанию 0.

MaximumExecutionTimeoutInSeconds -> (целое число)

Максимальное время выполнения развертывания. Обратите внимание, что значение таймаута должно быть больше общего времени ожидания, указанного в TerminationWaitInSeconds и WaitIntervalInSeconds .

RollingUpdatePolicy -> (структура)

Указывает стратегию развертывания в режиме непрерывного обновления для обновления конечной точки SageMaker.

MaximumBatchSize -> (структура)

Размер пакета для каждого шага непрерывного обновления для выделения ёмкости и включения трафика на новый флот конечной точки и завершения ёмкости на старом флоте конечной точки. Значение должно быть от 5% до 50% от общего количества экземпляров варианта.

Type -> (строка)

Указывает тип ёмкости конечной точки.

  • INSTANCE_COUNT : Конечная точка активируется в зависимости от количества экземпляров.
  • CAPACITY_PERCENT : Конечная точка активируется в зависимости от указанного процента ёмкости.

Value -> (целое число)

Определяет размер ёмкости, либо как количество экземпляров, либо как процент ёмкости.

WaitIntervalInSeconds -> (целое число)

Длительность периода ожидания, в течение которого SageMaker отслеживает оповещения для каждой группы на новом флоте.

MaximumExecutionTimeoutInSeconds -> (целое число)

Предел времени для всего развертывания. Превышение этого предела приводит к таймауту.

RollbackMaximumBatchSize -> (структура)

Размер пакета для отката на старый флот конечной точки. Каждый шаг непрерывного обновления для выделения ёмкости и включения трафика на старый флот конечной точки и завершения ёмкости на новом флоте конечной точки. Если этот параметр отсутствует, по умолчанию будет установлено значение 100% от общей ёмкости, что означает запуск всей ёмкости старого флота сразу при отмене.

Type -> (строка)

Указывает тип ёмкости конечной точки.

  • INSTANCE_COUNT : Конечная точка активируется в зависимости от количества экземпляров.
  • CAPACITY_PERCENT : Конечная точка активируется в зависимости от указанного процента ёмкости.

Value -> (целое число)

Определяет размер ёмкости, либо как количество экземпляров, либо как процент ёмкости.

AutoRollbackConfiguration -> (структура)

Конфигурация автоматического отката для обработки сбоев и восстановления при развертывании конечной точки.

Alarms -> (список)

Список оповещений CloudWatch в вашей учётной записи, настроенных для мониторинга метрик конечной точки. Если любое из оповещений срабатывает во время развертывания, SageMaker отменяет развертывание.

(структура)

Оповещение Amazon CloudWatch, настроенное для мониторинга метрик конечной точки.

AlarmName -> (строка)

Имя оповещения CloudWatch в вашей учётной записи.

AsyncInferenceConfig -> (структура)

Возвращает описание конфигурации конечной точки, созданной с помощью API ` CreateEndpointConfig https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_CreateEndpointConfig.html`__.

ClientConfig -> (структура)

Настраивает поведение клиента, используемого SageMaker для взаимодействия с контейнером модели во время асинхронного вывода.

MaxConcurrentInvocationsPerInstance -> (целое число)

Максимальное количество одновременных запросов, отправленных клиентом SageMaker в контейнер модели. Если значение не указано, SageMaker выбирает оптимальное значение.

OutputConfig -> (структура)

Указывает конфигурацию для вывода вызовов асинхронного вывода.

KmsKeyId -> (строка)

Ключ Amazon Web Services Key Management Service (Amazon Web Services KMS), который SageMaker использует для шифрования вывода асинхронного вывода в Amazon S3.

S3OutputPath -> (строка)

Расположение Amazon S3 для загрузки ответов вывода.

NotificationConfig -> (структура)

Указывает конфигурацию уведомлений о результатах вывода для асинхронного вывода.

SuccessTopic -> (строка)

Тема Amazon SNS для отправки уведомления об успешном завершении вывода. Если тема не указана, уведомление об успехе не отправляется.

ErrorTopic -> (строка)

Тема Amazon SNS для отправки уведомления о сбое вывода. Если тема не указана, уведомление об ошибке не отправляется.

IncludeInferenceResponseIn -> (список)

Темы Amazon SNS, в которые вы хотите включить ответ вывода.

Примечание

Ответ вывода включается только в том случае, если размер ответа меньше или равен 128 КБ.

(строка)

S3FailurePath -> (строка)

Расположение Amazon S3 для загрузки ответов вывода о сбое.

PendingDeploymentSummary -> (структура)

Возвращает сводку о развертывании в процессе. Это поле возвращается только тогда, когда конечная точка создает или обновляет конфигурацию новой конечной точки.

EndpointConfigName -> (строка)

Имя конфигурации конечной точки, используемой в развертывании.

ProductionVariants -> (список)

Массив объектов PendingProductionVariantSummary, по одному для каждой модели, размещенной за этой конечной точкой для развертывания в процессе.

(структура)

Сводка варианта производства для развертывания, когда конечная точка создается или обновляется операциями CreateEndpoint или UpdateEndpoint. Описывает VariantStatus, вес и емкость варианта производства, связанного с конечной точкой.

VariantName -> (строка)

Имя варианта.

DeployedImages -> (список)

Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry для изображений вывода, развернутых на экземплярах этой ProductionVariant.

(структура)

Получает путь Amazon EC2 Container Registry к изображению Docker модели, которая размещена в этом ProductionVariant.

Если вы использовали форму registry/repository[:tag] для указания пути изображения основного контейнера при создании модели, размещенной в этом ProductionVariant, путь разрешается в путь вида registry/repository[@digest]. Хеш-значение является значением дайджеста, которое идентифицирует определенную версию изображения. Сведения о путях Amazon ECR см. в разделе Вытягивание изображения в руководстве пользователя Amazon ECR.

SpecifiedImage -> (строка)

Путь к изображению, который вы указали при создании модели.

ResolvedImage -> (строка)

Конкретный путь дайджеста к изображению, размещенному в этом ProductionVariant.

ResolutionTime -> (метка времени)

Дата и время, когда путь изображения модели был разрешен до ResolvedImage

CurrentWeight -> (вещественное число)

Вес, связанный с вариантом.

DesiredWeight -> (вещественное число)

Запрашиваемый вес для варианта в этом развертывании, как указано в конфигурации конечной точки для конечной точки. Значение взято из запроса к операции CreateEndpointConfig.

CurrentInstanceCount -> (целое число)

Количество экземпляров, связанных с вариантом.

DesiredInstanceCount -> (целое число)

Запрашиваемое количество экземпляров в этом развертывании, как указано в конфигурации конечной точки для конечной точки. Значение взято из запроса к операции CreateEndpointConfig.

InstanceType -> (строка)

Тип экземпляров, связанных с вариантом.

AcceleratorType -> (строка)

Этот параметр больше не поддерживается. Ускорители Elastic Inference (EI) больше недоступны.

Этот параметр использовался для указания размера экземпляра EI, который необходимо использовать для варианта производства.

VariantStatus -> (список)

Статус варианта конечной точки, который описывает текущий статус этапа развертывания или операционный статус.

(структура)

Описывает статус варианта производства.

Status -> (строка)

Статус варианта конечной точки, который описывает текущий статус этапа развертывания или операционный статус.

  • Creating : Создание ресурсов вывода для варианта производства.
  • Deleting : Прекращение работы ресурсов вывода для варианта производства.
  • Updating : Обновление емкости для варианта производства.
  • ActivatingTraffic : Включение трафика для варианта производства.
  • Baking : Период ожидания для мониторинга сигналов CloudWatch в конфигурации автоматического отката.

StatusMessage -> (строка)

Сообщение, описывающее статус варианта производства.

StartTime -> (метка времени)

Время начала текущего изменения статуса.

CurrentServerlessConfig -> (структура)

Конфигурация без сервера для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей конечной точки без сервера. Допустимые значения — это приращения по 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обрабатывать ваша конечная точка без сервера.

ProvisionedConcurrency -> (целое число)

Количество выделенного одновременного выполнения, которое необходимо выделить для конечной точки без сервера. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций по конечным точкам без сервера для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.

DesiredServerlessConfig -> (структура)

Конфигурация без сервера, запрошенная для этого развертывания, как указано в конфигурации конечной точки для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей конечной точки без сервера. Допустимые значения — это приращения по 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обрабатывать ваша конечная точка без сервера.

ProvisionedConcurrency -> (целое число)

Количество выделенного одновременного выполнения, которое необходимо выделить для конечной точки без сервера. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций по конечным точкам без сервера для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.

ManagedInstanceScaling -> (структура)

Параметры, которые управляют диапазоном количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для адаптации к трафику.

Status -> (строка)

Указывает, включено ли управляемое масштабирование экземпляров.

MinInstanceCount -> (целое число)

Минимальное количество экземпляров, которые конечная точка должна сохранить при масштабировании вниз для адаптации к снижению трафика.

MaxInstanceCount -> (целое число)

Максимальное количество экземпляров, которые конечная точка может предоставить при масштабировании вверх для адаптации к увеличению трафика.

RoutingConfig -> (структура)

Параметры, которые управляют тем, как конечная точка направляет входящий трафик на экземпляры, которые она предоставляет.

RoutingStrategy -> (строка)

Определяет способ маршрутизации входящего трафика конечной точкой:

  • LEAST_OUTSTANDING_REQUESTS : конечная точка направляет запросы на конкретные экземпляры, которые имеют больше возможностей для их обработки.
  • RANDOM : конечная точка направляет каждый запрос на случайный экземпляр.

StartTime -> (метка времени)

Время начала развертывания.

ShadowProductionVariants -> (список)

Массив объектов PendingProductionVariantSummary, по одному для каждой модели, размещённой за этим конечной точкой в режиме тени с реплицированным производственным трафиком из модели, указанной в ProductionVariants для развертывания в процессе.

(структура)

Резюме производственной варианты для развертывания, когда конечная точка создаёт или обновляет с операциями CreateEndpoint или UpdateEndpoint. Описывает VariantStatus , вес и ёмкость для производственной варианты, связанной с конечной точкой.

VariantName -> (строка)

Название варианта.

DeployedImages -> (список)

Массив объектов DeployedImage, которые указывают пути Amazon EC2 Container Registry изображений вывода, развернутых на экземплярах этой ProductionVariant.

(структура)

Получает путь Amazon EC2 Container Registry образа Docker модели, которая размещена в этом ProductionVariant.

Если вы использовали форму registry/repository[:tag] для указания пути образа основного контейнера при создании модели, размещённой в этом ProductionVariant, путь будет разрешён в путь вида registry/repository[@digest]. Хеш-значение, идентифицирующее конкретную версию образа. Дополнительная информация о путях Amazon ECR находится в разделе «Получение образа» в руководстве пользователя Amazon ECR.

SpecifiedImage -> (строка)

Путь к изображению, который вы указали при создании модели.

ResolvedImage -> (строка)

Конкретный путь к изображению, размещённому в этом ProductionVariant.

ResolutionTime -> (временная метка)

Дата и время, когда путь к изображению модели был разрешён к ResolvedImage.

CurrentWeight -> (вещественное число)

Вес, связанный с вариантом.

DesiredWeight -> (вещественное число)

Запрошенный вес для варианта в этом развертывании, указанный в конфигурации конечной точки для конечной точки. Значение взято из запроса к операции CreateEndpointConfig.

CurrentInstanceCount -> (целое число)

Количество экземпляров, связанных с вариантом.

DesiredInstanceCount -> (целое число)

Количество экземпляров, запрошенных в этом развертывании, указанное в конфигурации конечной точки для конечной точки. Значение взято из запроса к операции CreateEndpointConfig.

InstanceType -> (строка)

Тип экземпляров, связанных с вариантом.

AcceleratorType -> (строка)

Этот параметр больше не поддерживается. Elastic Inference (EI) больше недоступен.

Этот параметр использовался для указания размера экземпляра EI, используемого для производственной варианта.

VariantStatus -> (список)

Статус варианта конечной точки, который описывает текущий статус стадии развертывания или операционный статус.

(структура)

Описывает статус производственной варианта.

Status -> (строка)

Статус варианта конечной точки, который описывает текущий статус стадии развертывания или операционный статус.

  • Creating : Создание ресурсов вывода для производственного варианта.
  • Deleting : Завершение ресурсов вывода для производственного варианта.
  • Updating : Обновление ёмкости для производственного варианта.
  • ActivatingTraffic : Включение трафика для производственной варианты.
  • Baking : Период ожидания для мониторинга сигналов CloudWatch в конфигурации автоматического отката.

StatusMessage -> (строка)

Сообщение, описывающее статус производственной варианты.

StartTime -> (временная метка)

Время начала текущего изменения статуса.

CurrentServerlessConfig -> (структура)

Конфигурация серверного варианта для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверной конечной точки. Допустимые значения — приращения по 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверная конечная точка.

ProvisionedConcurrency -> (целое число)

Количество предоставленной параллельности, подлежащей выделению для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверной конечной точки для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.

DesiredServerlessConfig -> (структура)

Конфигурация серверного варианта, запрошенная для этого развертывания, указанная в конфигурации конечной точки для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверной конечной точки. Допустимые значения — приращения по 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые может обработать ваша серверная конечная точка.

ProvisionedConcurrency -> (целое число)

Количество предоставленной параллельности, подлежащей выделению для серверной конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверной конечной точки для задач Inference Recommender. Дополнительную информацию о создании задачи Inference Recommender см. в разделе CreateInferenceRecommendationsJobs.

ManagedInstanceScaling -> (структура)

Настройки, которые контролируют диапазон количества экземпляров, которые конечная точка предоставляет при масштабировании вверх или вниз для адаптации к трафику.

Status -> (строка)

Указывает, включено ли управляемое масштабирование экземпляров.

MinInstanceCount -> (целое число)

Минимальное количество экземпляров, которые конечная точка должна сохранить при масштабировании вниз для адаптации к уменьшению трафика.

MaxInstanceCount -> (целое число)

Максимальное количество экземпляров, которые конечная точка может предоставить при масштабировании вверх для адаптации к увеличению трафика.

RoutingConfig -> (структура)

Настройки, которые контролируют, как конечная точка направляет входящий трафик на экземпляры, которые она размещает.

RoutingStrategy -> (строка)

Устанавливает, как конечная точка направляет входящий трафик:

  • LEAST_OUTSTANDING_REQUESTS : Конечная точка направляет запросы на конкретные экземпляры, которые имеют больше ёмкости для их обработки.
  • RANDOM : Конечная точка направляет каждый запрос на случайным образом выбранный экземпляр.

ExplainerConfig -> (структура)

Параметры конфигурации для объяснения.

ClarifyExplainerConfig -> (структура)

Элемент ExplainerConfig, содержащий параметры конфигурации для объяснения SageMaker Clarify.

EnableExplanations -> (строка)

Логическое выражение JMESPath, используемое для фильтрации записей, которые требуется объяснить. Объяснения активированы по умолчанию. Дополнительную информацию см. в ` EnableExplanations https://docs.aws.amazon.com/sagemaker/latest/dg/clarify-online-explainability-create-endpoint.html#clarify-online-explainability-create-endpoint-enable`__.

InferenceConfig -> (структура)

Параметр конфигурации вывода для контейнера модели.

FeaturesAttribute -> (строка)

Предоставляет выражение JMESPath для извлечения признаков из входных данных контейнера модели в формате JSON Lines. Например, если FeaturesAttribute — это выражение JMESPath 'myfeatures', то оно извлекает список признаков [1,2,3] из данных запроса '{"myfeatures":[1,2,3]}'.

ContentTemplate -> (строка)

Шаблонная строка, используемая для форматирования JSON-записи в приемлемый для контейнера модели вход. Например, строка ContentTemplate '{"myfeatures":$features}' отформатирует список признаков [1,2,3] в строку записи '{"myfeatures":[1,2,3]}'. Требуется только тогда, когда входной формат контейнера модели — JSON Lines.

MaxRecordCount -> (целое число)

Максимальное количество записей в запросе, которое может обработать контейнер модели при запросе предсказаний синтетического набора данных. Запись — это единица входных данных, на основе которых можно сделать вывод, например, одна строка в данных CSV. Если MaxRecordCount равно 1, контейнер модели ожидает по одной записи на запрос. Значение 2 или больше означает, что контейнер ожидает пакетные запросы, что может уменьшить нагрузку и ускорить процесс вывода. Если этот параметр не указан, объяснители будут настраивать количество записей на запрос в соответствии с возможностями контейнера модели во время выполнения.

MaxPayloadInMB -> (целое число)

Максимальный размер загрузки (МБ) запроса от объяснителей к контейнеру модели. По умолчанию — 6 МБ.

ProbabilityIndex -> (целое число)

Индекс, начинающийся с нуля, используемый для извлечения значения вероятности (оценки) или списка из выходных данных контейнера модели в формате CSV. Если это значение не указано, все выходные данные контейнера модели будут рассматриваться как значение вероятности (оценка) или список.

Пример для модели с одним классом: Если выходные данные контейнера модели содержат строковое обозначение метки предсказания, за которым следует вероятность: '1,0.6', установите ProbabilityIndex в 1, чтобы выбрать значение вероятности 0.6.

Пример для многоклассовой модели: Если выходные данные контейнера модели содержат строковое обозначение метки предсказания, за которым следует вероятность: '"[\'cat\',\'dog\',\'fish\']","[0.1,0.6,0.3]"', установите ProbabilityIndex в 1, чтобы выбрать значения вероятностей [0.1,0.6,0.3].

LabelIndex -> (целое число)

Индекс, начинающийся с нуля, используемый для извлечения заголовка метки или списка заголовков меток из выходных данных контейнера модели в формате CSV.

Пример для многоклассовой модели: Если выходные данные контейнера модели содержат заголовки меток, за которыми следуют вероятности: '"[\'cat\',\'dog\',\'fish\']","[0.1,0.6,0.3]"', установите LabelIndex в 0, чтобы выбрать заголовки меток ['cat','dog','fish'].

ProbabilityAttribute -> (строка)

Выражение JMESPath, используемое для извлечения вероятности (или оценки) из выходных данных контейнера модели, если контейнер модели находится в формате JSON Lines.

Пример: Если выходные данные контейнера модели для одного запроса — '{"predicted_label":1,"probability":0.6}', установите ProbabilityAttribute в 'probability'.

LabelAttribute -> (строка)

Выражение JMESPath, используемое для поиска списка заголовков меток в выходных данных контейнера модели.

Пример: Если выходные данные контейнера модели для пакетного запроса — '{"labels":["cat","dog","fish"],"probability":[0.6,0.3,0.1]}', установите LabelAttribute в 'labels', чтобы извлечь список заголовков меток ["cat","dog","fish"]

LabelHeaders -> (список)

Для задач многоклассовой классификации заголовки меток — это имена классов. В противном случае заголовок метки — это имя предсказанной метки. Они используются для улучшения удобочитаемости выходных данных API InvokeEndpoint. Дополнительную информацию см. в разделе Ответ в разделе Вызов конечной точки в Руководстве разработчика.

(строка)

FeatureHeaders -> (список)

Названия признаков. Если указаны, они включаются в полезную нагрузку ответа конечной точки для повышения удобочитаемости выходных данных InvokeEndpoint. Дополнительную информацию см. в разделе «Ответ» в разделе «Вызов конечной точки» в Руководстве разработчика.

(строка)

FeatureTypes -> (список)

Список типов данных признаков (необязательно). Применим только к объяснениям NLP. Если указан, FeatureTypes должен содержать как минимум одну строку 'text' (например, ['text']). Если FeatureTypes не указан, объяснители определяют типы признаков на основе исходных данных. Типы признаков включаются в полезную нагрузку ответа конечной точки. Дополнительную информацию см. в разделе «Ответ» в разделе «Вызов конечной точки» в Руководстве разработчика.

(строка)

ShapConfig -> (структура)

Конфигурация для анализа SHAP.

ShapBaselineConfig -> (структура)

Конфигурация для базовой линии SHAP алгоритма Kernal SHAP.

MimeType -> (строка)

Тип MIME базовых данных. Выберите из 'text/csv' или 'application/jsonlines'. По умолчанию — 'text/csv'.

ShapBaseline -> (строка)

Встроенные данные базовой линии SHAP в строковом формате. ShapBaseline может содержать одну или несколько записей, которые будут использоваться в качестве базового набора данных. Формат файла базовой линии SHAP должен совпадать с форматом обучающего набора данных. Например, если обучающий набор данных находится в формате CSV и каждая запись содержит четыре признака, а все признаки числовые, то формат базовых данных также должен иметь эти характеристики. Для обработки естественного языка (NLP) текстовых столбцов значение базовой линии должно быть значением, используемым для замены единицы текста, указанной в Granularity параметра TextConfig. Предельная величина для ShapBasline составляет 4 КБ. Используйте параметр ShapBaselineUri, если хотите предоставить более 4 КБ базовых данных.

ShapBaselineUri -> (строка)

Унифицированный идентификатор ресурса (URI) ведра S3, в котором хранится файл базовой линии SHAP. Формат файла базовой линии SHAP должен совпадать с форматом обучающего набора данных. Например, если обучающий набор данных находится в формате CSV, а каждая запись в обучающем наборе данных имеет четыре признака, и все признаки числовые, то базовый файл также должен иметь этот же формат. Каждая запись должна содержать только признаки. Если вы используете виртуальную частную сеть (ВЧС), ShapBaselineUri должен быть доступен для ВЧС. Дополнительную информацию об настройке конечных точек с Amazon Virtual Private Cloud см. в разделе Предоставление SageMaker доступа к ресурсам в вашей виртуальной частной сети Amazon.

NumberOfSamples -> (целое число)

Количество выборок, которые будут использоваться для анализа алгоритмом Kernal SHAP.

Примечание

Количество выборок определяет размер синтетического набора данных, что влияет на задержку запросов на объяснение. Дополнительную информацию см. в разделе Синтетические данные в разделе Настройка и создание конечной точки.

UseLogit -> (булево)

Булево значение, указывающее, хотите ли вы использовать функцию logit (true) или логарифмические вероятности (false) для прогнозов модели. По умолчанию — false.

Seed -> (целое число)

Начальное значение, используемое для инициализации генератора случайных чисел в объяснении. Укажите это значение для получения детерминированного результата SHAP.

TextConfig -> (структура)

Параметр, указывающий, обрабатываются ли текстовые признаки как текст и предоставляются ли объяснения для отдельных единиц текста. Требуется только для объяснения обработки естественного языка (NLP).

Language -> (строка)

Указывает язык текстовых признаков в коде `ISO 639-1 < https://en.wikipedia.org/wiki/List_of_ISO_639-1_codes>`__ или коде ISO 639-3 поддерживаемого языка.

Примечание

Для смешанных языков используйте код 'xx'.

Granularity -> (строка)

Единица детализации для анализа текстовых признаков. Например, если единица — 'token', то каждый токен (например, слово на английском языке) текста рассматривается как признак. Значения SHAP вычисляются для каждой единицы/признака.

ShadowProductionVariants -> (список)

Массив объектов ProductionVariantSummary, по одному для каждой модели, которую вы хотите разместить на этом конечной точке в режиме тени с дублированием трафика производства с модели, указанной в ProductionVariants.

(структура)

Описывает вес и мощности для варианта производства, связанного с конечной точкой. Если вы отправили запрос в API UpdateEndpointWeightsAndCapacities, и статус конечной точки Updating, вы получите различные желаемые и текущие значения.

VariantName -> (строка)

Название варианта.

DeployedImages -> (список)

Массив объектов DeployedImage, указывающих пути Amazon EC2 Container Registry для изображений инференции, развернутых на экземплярах этой ProductionVariant.

(структура)

Получает путь Amazon EC2 Container Registry для docker-изображения модели, размещенной в ProductionVariant.

Если вы использовали форму registry/repository[:tag] для указания пути к изображению основного контейнера при создании модели, размещенной в этой ProductionVariant, путь разрешается в путь вида registry/repository[@digest]. Хеш-значение, идентифицирующее определенную версию изображения. Подробности о путях Amazon ECR см. в руководстве Amazon ECR User Guide — Загрузка изображения.

SpecifiedImage -> (строка)

Путь к изображению, указанный вами при создании модели.

ResolvedImage -> (строка)

Конкретный путь с хеш-суммой изображения, размещенного в этой ProductionVariant.

ResolutionTime -> (отметка времени)

Дата и время, когда путь к изображению модели был разрешен до ResolvedImage.

CurrentWeight -> (вещественное число)

Вес, связанный с вариантом.

DesiredWeight -> (вещественное число)

Запрашиваемый вес, указанный в запросе UpdateEndpointWeightsAndCapacities.

CurrentInstanceCount -> (целое число)

Количество экземпляров, связанных с вариантом.

DesiredInstanceCount -> (целое число)

Количество экземпляров, запрошенных в запросе UpdateEndpointWeightsAndCapacities.

VariantStatus -> (список)

Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.

(структура)

Описывает состояние варианта производства.

Status -> (строка)

Статус варианта конечной точки, описывающий текущий статус стадии развертывания или операционный статус.

  • Creating : Создание ресурсов инференции для варианта производства.
  • Deleting : Закрытие ресурсов инференции для варианта производства.
  • Updating : Обновление емкости для варианта производства.
  • ActivatingTraffic : Включение трафика для варианта производства.
  • Baking : Период ожидания для мониторинга предупреждений CloudWatch в конфигурации автоматической отката.

StatusMessage -> (строка)

Сообщение, описывающее состояние варианта производства.

StartTime -> (отметка времени)

Время начала текущего изменения статуса.

CurrentServerlessConfig -> (структура)

Настройка серверless для конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверless конечной точки. Допустимые значения — с шагом 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые ваша серверless конечная точка может обработать.

ProvisionedConcurrency -> (целое число)

Количество выделенной одновременной обработки, выделяемое для серверless конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверless конечной точки для заданий Inference Recommender. Дополнительную информацию о создании задания Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .

DesiredServerlessConfig -> (структура)

Запрошенная конфигурация серверless для обновления конечной точки.

MemorySizeInMB -> (целое число)

Размер памяти вашей серверless конечной точки. Допустимые значения — с шагом 1 ГБ: 1024 МБ, 2048 МБ, 3072 МБ, 4096 МБ, 5120 МБ или 6144 МБ.

MaxConcurrency -> (целое число)

Максимальное количество одновременных вызовов, которые ваша серверless конечная точка может обработать.

ProvisionedConcurrency -> (целое число)

Количество выделенной одновременной обработки, выделяемое для серверless конечной точки. Должно быть меньше или равно MaxConcurrency.

Примечание

Это поле не поддерживается для рекомендаций серверless конечной точки для заданий Inference Recommender. Дополнительную информацию о создании задания Inference Recommender см. в разделе CreateInferenceRecommendationsJobs .

ManagedInstanceScaling -> (структура)

Настройки, контролирующие диапазон количества экземпляров, которые конечная точка выделяет при масштабировании вверх или вниз для обработки трафика.

Status -> (строка)

Указывает, включено ли управляемое масштабирование экземпляров.

MinInstanceCount -> (целое число)

Минимальное количество экземпляров, которое конечная точка должна сохранить при масштабировании вниз, чтобы учесть уменьшение трафика.

MaxInstanceCount -> (целое число)

Максимальное количество экземпляров, которое конечная точка может выделить при масштабировании вверх, чтобы учесть увеличение трафика.

RoutingConfig -> (структура)

Настройки, которые контролируют маршрутизацию входящего трафика на экземпляры, размещенные конечной точкой.

RoutingStrategy -> (строка)

Устанавливает способ маршрутизации входящего трафика конечной точкой:

  • LEAST_OUTSTANDING_REQUESTS : конечная точка маршрутизирует запросы на конкретные экземпляры, у которых больше емкости для их обработки.
  • RANDOM : конечная точка маршрутизирует каждый запрос на случайный выбранный экземпляр.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API