Spec-Zone.ru › Elasticsearch 7
›Elasticsearch Guide [7.17] ›REST API ›API для обнаружения аномалий с помощью машинного обучения

API получения статистики по потокам данных

Получает информацию об использовании потоков данных.

Запрос

GET _ml/datafeeds/<feed_id>/_stats

GET _ml/datafeeds/<feed_id>,<feed_id>/_stats

GET _ml/datafeeds/_stats

GET _ml/datafeeds/_all/_stats

Предварительные условия

Требуется привилегия кластера monitor_ml. Эта привилегия включена в встроенную роль machine_learning_user.

Описание

Если поток данных остановлен, вы получите только datafeed_id и state.

Этот API возвращает не более 10 000 потоков данных.

Параметры пути

<feed_id>

(Необязательно, строка) Идентификатор потока данных. Это может быть идентификатор потока данных или выражение с подстановкой.

Вы можете получить статистику по нескольким потокам данных в одном запросе API, используя список потоков данных, разделенных запятыми, или выражение с подстановкой. Вы можете получить статистику по всем потокам данных, используя _all, указав * в качестве идентификатора потока данных или опуская идентификатор.

Параметры запроса

allow_no_datafeeds
(Необязательно, логическое значение) [7.10] Устарело в 7.10. Используйте allow_no_match вместо него.
allow_no_match

(Необязательно, логическое значение) Указывает, что делать, когда запрос:

  • Содержит выражения с подстановкой, и нет совпадений потоков данных.
  • Содержит строку _all или нет идентификаторов, и нет совпадений.
  • Содержит выражения с подстановкой и есть только частичные совпадения.

Значение по умолчанию — true, которое возвращает пустой массив datafeeds, когда нет совпадений, и подмножество результатов при частичных совпадениях. Если этот параметр имеет значение false, запрос возвращает код состояния 404, когда нет совпадений или только частичные совпадения.

Тело ответа

API возвращает массив объектов количества потоков данных. Все эти свойства информационные; вы не можете обновить их значения.

assignment_explanation
(строка) Только для запущенных потоков данных, содержит сообщения, относящиеся к выбору узла.
datafeed_id
(строка) Числовая строка, которая уникально идентифицирует поток данных. Этот идентификатор может содержать строчные буквенно-цифровые символы (a-z и 0-9), дефисы и символы подчеркивания. Он должен начинаться и заканчиваться буквенно-цифровыми символами.
node

(объект) Только для запущенных потоков данных, эта информация относится к узлу, на котором запущен поток данных.

Подробности
attributes
(объект) Список атрибутов узла, таких как ml.machine_memory или ml.max_open_jobs настройки.
ephemeral_id
(строка) Эфемерный идентификатор узла.
id
(строка) Уникальный идентификатор узла.
name
(строка) Имя узла. Например, 0-o0tOo.
transport_address
(строка) Хост и порт, где принимаются подключения транспортного HTTP.
running_state

(объект) Объект, содержащий текущее состояние потока данных. Он предоставляется только если поток данных запущен.

Подробности
real_time_configured
(булево значение) Указывает, является ли поток данных "реального времени"; означает, что у потока данных нет настроенного end времени.
real_time_running
(булево значение) Указывает, завершил ли поток данных выполнение на доступных прошлых данных. Для потоков данных без настроенного end времени это означает, что поток данных сейчас обрабатывает данные "реального времени".
state

(строка) Состояние потока данных, которое может иметь одно из следующих значений:

  • starting: Поток данных запрошен на запуск, но еще не запущен.
  • started: Поток данных активно получает данные.
  • stopping: Поток данных запрошен на остановку и завершает свои последние действия.
  • stopped: Поток данных остановлен и не будет получать данные до повторного запуска.
timing_stats

(объект) Объект, предоставляющий статистическую информацию о временных аспектах этого потока данных.

Подробности
average_search_time_per_bucket_ms
(двойное значение) Среднее время поиска на ведро в миллисекундах.
bucket_count
(целое число) Количество обработанных ведер.
exponential_average_search_time_per_hour_ms
(двойное значение) Экспоненциальное среднее время поиска за час в миллисекундах.
job_id
Идентификатор задачи обнаружения аномалий.
search_count
Количество выполненных поисков потоком данных.
total_search_time_ms
Общее время, потраченное потоком данных на поиск в миллисекундах.

Коды ответов

404 (Недостающие ресурсы)
Если allow_no_match равно false, этот код указывает, что нет ресурсов, которые соответствуют запросу, или только частичные совпадения для запроса.

Примеры

GET _ml/datafeeds/datafeed-high_sum_total_sales/_stats

API возвращает следующие результаты:

{
  "count": 1,
  "datafeeds": [
    {
      "datafeed_id": "datafeed-high_sum_total_sales",
      "state": "started",
      "node": {
        "id": "2spCyo1pRi2Ajo-j-_dnPX",
        "name": "node-0",
        "ephemeral_id": "hoXMLZB0RWKfR9UPPUCxXX",
        "transport_address": "127.0.0.1:9300",
        "attributes": {
          "ml.machine_memory": "17179869184",
          "ml.max_open_jobs": "512"
        }
      },
      "assignment_explanation": "",
      "timing_stats": {
        "job_id" : "high_sum_total_sales",
         "search_count" : 27,
         "bucket_count" : 619,
         "total_search_time_ms" : 296.0,
         "average_search_time_per_bucket_ms" : 0.4781906300484653,
         "exponential_average_search_time_per_hour_ms" : 33.28246548059884
      }
    }
  ]
}

© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/7.17/ml-get-datafeed-stats.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API