API создания словаря обученной модели
Создает словарь обученной модели. Поддерживается только для моделей обработки естественного языка (NLP).
Запрос
PUT _ml/trained_models/<model_id>/vocabulary/
Предварительные требования
Требуется привилегия кластера manage_ml. Эта привилегия включена в встроенную роль machine_learning_admin.
Описание
Словарь хранится в индексе, как описано в inference_config.*.vocabulary определения обученной модели.
Параметры пути
-
<model_id> - (Обязательно, строка) Уникальный идентификатор обученной модели.
Тело запроса
-
vocabulary - (массив) Словарь модели. Не должен быть пустым.
-
merges - (Необязательно, массив) Слияния модели, используемые в кодировании пар байтов. Слияния должны быть парами подслов, разделенными пробелами, и в порядке предпочтения. Пример: ["f o", "fo o"]. Должен быть предоставлен для моделей стиля RoBERTa и BART.
-
scores - (Необязательно, массив) Значения оценок словаря, используемые при разбиении на токены методом sentence-piece. Должен иметь ту же длину, что и
vocabulary. Требуется для моделей с разбиением на токены sentence-piece методом unigram, таких как XLMRoberta и T5.
Примеры
Следующий пример демонстрирует, как создать словарь модели для ранее сохранённой конфигурации обученной модели.
PUT _ml/trained_models/elastic__distilbert-base-uncased-finetuned-conll03-english/vocabulary
{
"vocabulary": [
"[PAD]",
"[unused0]",
...
]
} API возвращает следующие результаты:
{
"acknowledged": true
}
© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/8.17/put-trained-model-vocabulary.html