Spec-Zone.ru › Elasticsearch 7
›Elasticsearch Guide [7.17] ›Анализ текста ›Справочник по фильтрам токенов

Фильтр токенов Classic

Выполняет необязательную пост-обработку терминов, сгенерированных токенизатором classic.

Этот фильтр удаляет английские притяжательные формы ('s) в конце слов и удаляет точки из аббревиатур. Он использует классический фильтр Lucene ClassicFilter.

Пример

Следующий запрос API анализа демонстрирует работу фильтра Classic.

GET /_analyze
{
  "tokenizer" : "classic",
  "filter" : ["classic"],
  "text" : "The 2 Q.U.I.C.K. Brown-Foxes jumped over the lazy dog's bone."
}

Фильтр генерирует следующие токены:

[ The, 2, QUICK, Brown, Foxes, jumped, over, the, lazy, dog, bone ]

Добавление в анализатор

Следующий запрос API создания индекса использует фильтр Classic для настройки нового пользовательского анализатора.

PUT /classic_example
{
  "settings": {
    "analysis": {
      "analyzer": {
        "classic_analyzer": {
          "tokenizer": "classic",
          "filter": [ "classic" ]
        }
      }
    }
  }
}

© 2023-2025 Elasticsearch
As of September 2024, Elasticsearch is available under a choice of three licenses: the Server Side Public License (SSPL), the Elastic License, or the AGPLv3 (OSI approved).
Elasticsearch and the Elasticsearch logo are trademarks of Elasticsearch B.V., registered in the U.S. and in other countries.
https://www.elastic.co/guide/en/elasticsearch/reference/7.17/analysis-classic-tokenfilter.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API