Обновление API инференции
Обновляет конечную точку инференции.
Inference API позволяют использовать определённые сервисы, такие как встроенные модели машинного обучения (ELSER, E5), модели, загруженные через Eland, Cohere, OpenAI, Azure, Google AI Studio, Google Vertex AI, Anthropic, Watsonx.ai или Hugging Face. Для встроенных моделей и моделей, загруженных через Eland, inference API предлагают альтернативный способ использования и управления обученными моделями. Однако, если вы не планируете использовать inference API для использования этих моделей или хотите использовать модели, не относящиеся к NLP, используйте API моделей машинного обучения.
Запрос
PUT _inference/<inference_id>/_update
PUT _inference/<task_type>/<inference_id>/_update
Предварительные условия
- Требуется
manage_inferenceправо доступа к кластеру (встроенная роль inference_admin предоставляет это право) - Требуется существующая конечная точка инференции, созданная с помощью API создания конечной точки инференции
Описание
API обновления инференции позволяет обновить task_settings, секреты и/или num_allocations существующей конечной точки инференции.
Для использования API обновления можно изменить task_settings, секреты (в service_settings) или num_allocations, в зависимости от конкретного сервиса конечной точки и типа задачи, которые вы создали. Для просмотра обновляемых task_settings, имён полей секретов (специфичных для каждого сервиса) и сервисов, где num_allocations применимо (только для сервиса elasticsearch), обратитесь к следующему списку сервисов, доступных через inference API. Вы найдёте доступные типы задач рядом с каждым именем сервиса. Щёлкните по ссылкам для просмотра подробностей конфигурации сервиса:
- AlibabaCloud AI Search (
completion,rerank,sparse_embedding,text_embedding) - Amazon Bedrock (
completion,text_embedding) - Anthropic (
completion) - Azure AI Studio (
completion,text_embedding) - Azure OpenAI (
completion,text_embedding) - Cohere (
completion,rerank,text_embedding) - Elasticsearch (
rerank,sparse_embedding,text_embedding- этот сервис предназначен для встроенных моделей и моделей, загруженных через Eland) - ELSER (
sparse_embedding) - Google AI Studio (
completion,text_embedding) - Google Vertex AI (
rerank,text_embedding) - Hugging Face (
text_embedding) - Mistral (
text_embedding) - OpenAI (
completion,text_embedding)
Параметры пути
-
<inference_id> - (Обязательно, строка) Уникальный идентификатор конечной точки инференции.
-
<task_type> - (Необязательно, строка) Тип задачи инференции, выполняемой моделью. Обратитесь к списку сервисов в разделе описания API для получения доступных типов задач.
Примеры
Следующий пример демонстрирует, как обновить ключ API конечной точки инференции под названием my-inference-endpoint:
resp = client.inference.update(
inference_id="my-inference-endpoint",
inference_config={
"service_settings": {
"api_key": "<API_KEY>"
}
},
)
print(resp) const response = await client.inference.put({
task_type: "my-inference-endpoint",
inference_id: "_update",
inference_config: {
service_settings: {
api_key: "<API_KEY>",
},
},
});
console.log(response); PUT _inference/my-inference-endpoint/_update
{
"service_settings": {
"api_key": "<API_KEY>"
}
}
© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/8.17/update-inference-api.html