Обогащение ваших данных
Вы можете использовать процессор обогащения, чтобы добавлять данные из ваших существующих индексов в поступающие документы во время поглощения.
Например, вы можете использовать процессор обогащения для:
- Определение веб-сервисов или поставщиков на основе известных IP-адресов
- Добавление информации о продуктах к розничным заказам на основе идентификаторов продуктов
- Дополнение контактной информации на основе адреса электронной почты
- Добавление почтовых индексов на основе координат пользователя
Как работает процессор обогащения
Большинство процессоров являются автономными и изменяют только существующие данные в поступающих документах.
Процессор обогащения добавляет новые данные в поступающие документы и требует нескольких специальных компонентов:
- Политика обогащения
-
Набор параметров конфигурации, используемых для добавления правильных данных обогащения к соответствующим поступающим документам.
Политика обогащения содержит:
- Список одного или нескольких источниковых индексов, которые хранят данные обогащения в виде документов
- Тип политики, определяющий способ соответствия данных обогащения поступающим документам
- Поле сопоставления из исходных индексов, используемое для сопоставления поступающих документов
- Поля обогащения, содержащие данные обогащения из исходных индексов, которые вы хотите добавить к поступающим документам
Перед использованием с процессором обогащения политика обогащения должна быть выполнена. При выполнении политика обогащения использует данные обогащения из исходных индексов политики для создания оптимизированного системного индекса, называемого индексом обогащения. Процессор использует этот индекс для сопоставления и обогащения поступающих документов.
- Источниковый индекс
- Индекс, который хранит данные обогащения, которые вы хотите добавить к поступающим документам. Вы можете создавать и управлять этими индексами так же, как обычный индекс Elasticsearch. В политике обогащения можно использовать несколько исходных индексов. Вы также можете использовать один и тот же исходный индекс в нескольких политиках обогащения.
- Индекс обогащения
-
Специальный системный индекс, связанный с определенной политикой обогащения.
Прямое сопоставление поступающих документов с документами в исходных индексах может быть медленным и ресурсоемким. Чтобы ускорить процесс, процессор обогащения использует индекс обогащения.
Индексы обогащения содержат данные обогащения из исходных индексов, но имеют несколько специальных свойств, помогающих оптимизировать их:
- Это системные индексы, что означает, что они управляются внутри Elasticsearch и предназначены только для использования с процессорами обогащения и командой ES|QL
ENRICH. - Они всегда начинаются с
.enrich-*. - Они являются только для чтения, что означает, что вы не можете их непосредственно изменить.
- Они объединяются для быстрого извлечения.
- Это системные индексы, что означает, что они управляются внутри Elasticsearch и предназначены только для использования с процессорами обогащения и командой ES|QL
© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/8.17/ingest-enriching-data.html