API получения статистики по потокам данных
Получает информацию об использовании потоков данных.
Запрос
GET _ml/datafeeds/<feed_id>/_stats
GET _ml/datafeeds/<feed_id>,<feed_id>/_stats
GET _ml/datafeeds/_stats
GET _ml/datafeeds/_all/_stats
Предварительные условия
Требуется привилегия кластера monitor_ml. Эта привилегия включена в встроенную роль machine_learning_user.
Описание
Если поток данных остановлен, вы получите только datafeed_id и state.
Этот API возвращает не более 10 000 потоков данных.
Параметры пути
-
<feed_id> -
(Необязательно, строка) Идентификатор потока данных. Это может быть идентификатор потока данных или выражение с подстановкой.
Вы можете получить статистику по нескольким потокам данных в одном запросе API, используя список потоков данных, разделенных запятыми, или выражение с подстановкой. Вы можете получить статистику по всем потокам данных, используя
_all, указав*в качестве идентификатора потока данных или опуская идентификатор.
Параметры запроса
-
allow_no_datafeeds - (Необязательно, логическое значение) [7.10] Устарело в 7.10. Используйте
allow_no_matchвместо него. -
allow_no_match -
(Необязательно, логическое значение) Указывает, что делать, когда запрос:
- Содержит выражения с подстановкой, и нет совпадений потоков данных.
- Содержит строку
_allили нет идентификаторов, и нет совпадений. - Содержит выражения с подстановкой и есть только частичные совпадения.
Значение по умолчанию —
true, которое возвращает пустой массивdatafeeds, когда нет совпадений, и подмножество результатов при частичных совпадениях. Если этот параметр имеет значениеfalse, запрос возвращает код состояния404, когда нет совпадений или только частичные совпадения.
Тело ответа
API возвращает массив объектов количества потоков данных. Все эти свойства информационные; вы не можете обновить их значения.
-
assignment_explanation - (строка) Только для запущенных потоков данных, содержит сообщения, относящиеся к выбору узла.
-
datafeed_id - (строка) Числовая строка, которая уникально идентифицирует поток данных. Этот идентификатор может содержать строчные буквенно-цифровые символы (a-z и 0-9), дефисы и символы подчеркивания. Он должен начинаться и заканчиваться буквенно-цифровыми символами.
-
node -
(объект) Только для запущенных потоков данных, эта информация относится к узлу, на котором запущен поток данных.
Подробности
-
attributes - (объект) Список атрибутов узла, таких как
ml.machine_memoryилиml.max_open_jobsнастройки. -
ephemeral_id - (строка) Эфемерный идентификатор узла.
-
id - (строка) Уникальный идентификатор узла.
-
name - (строка) Имя узла. Например,
0-o0tOo. -
transport_address - (строка) Хост и порт, где принимаются подключения транспортного HTTP.
-
-
running_state -
(объект) Объект, содержащий текущее состояние потока данных. Он предоставляется только если поток данных запущен.
Подробности
-
real_time_configured - (булево значение) Указывает, является ли поток данных "реального времени"; означает, что у потока данных нет настроенного
endвремени. -
real_time_running - (булево значение) Указывает, завершил ли поток данных выполнение на доступных прошлых данных. Для потоков данных без настроенного
endвремени это означает, что поток данных сейчас обрабатывает данные "реального времени".
-
-
state -
(строка) Состояние потока данных, которое может иметь одно из следующих значений:
-
starting: Поток данных запрошен на запуск, но еще не запущен. -
started: Поток данных активно получает данные. -
stopping: Поток данных запрошен на остановку и завершает свои последние действия. -
stopped: Поток данных остановлен и не будет получать данные до повторного запуска.
-
-
timing_stats -
(объект) Объект, предоставляющий статистическую информацию о временных аспектах этого потока данных.
Подробности
-
average_search_time_per_bucket_ms - (двойное значение) Среднее время поиска на ведро в миллисекундах.
-
bucket_count - (целое число) Количество обработанных ведер.
-
exponential_average_search_time_per_hour_ms - (двойное значение) Экспоненциальное среднее время поиска за час в миллисекундах.
-
job_id - Идентификатор задачи обнаружения аномалий.
-
search_count - Количество выполненных поисков потоком данных.
-
total_search_time_ms - Общее время, потраченное потоком данных на поиск в миллисекундах.
-
Коды ответов
-
404(Недостающие ресурсы) - Если
allow_no_matchравноfalse, этот код указывает, что нет ресурсов, которые соответствуют запросу, или только частичные совпадения для запроса.
Примеры
GET _ml/datafeeds/datafeed-high_sum_total_sales/_stats
API возвращает следующие результаты:
{
"count": 1,
"datafeeds": [
{
"datafeed_id": "datafeed-high_sum_total_sales",
"state": "started",
"node": {
"id": "2spCyo1pRi2Ajo-j-_dnPX",
"name": "node-0",
"ephemeral_id": "hoXMLZB0RWKfR9UPPUCxXX",
"transport_address": "127.0.0.1:9300",
"attributes": {
"ml.machine_memory": "17179869184",
"ml.max_open_jobs": "512"
}
},
"assignment_explanation": "",
"timing_stats": {
"job_id" : "high_sum_total_sales",
"search_count" : 27,
"bucket_count" : 619,
"total_search_time_ms" : 296.0,
"average_search_time_per_bucket_ms" : 0.4781906300484653,
"exponential_average_search_time_per_hour_ms" : 33.28246548059884
}
}
]
}
© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/7.17/ml-get-datafeed-stats.html