内置分析器
分析器(Analyzer)是 Elasticsearch 中文本处理的核心组件,负责将字符串拆分为词项(tokens),以支持高效的全文检索。Elasticsearch 提供了多种内置分析器,满足不同语言和应用需求。
1. 标准分析器(standard)
默认分析器,使用 Unicode 文本分词器,适合大多数语言的通用分词需求。
2. 简单分析器(simple)
仅按非字母字符拆分文本,所有字母转换为小写,适合基本英文文本。
3. 空白分析器(whitespace)
按空白字符分词,不改变词项大小写。
4. 关键词分析器(keyword)
不进行分词,整个文本作为一个词项,适用于精确匹配字段。
5. 语言专用分析器
支持多种语言,如:
english:英文停用词过滤和词干提取chinese:中文分词(需安装插件)french、german、spanish等多种语言分析器
6. 自定义分析器
基于内置分析器可组合使用分词器、过滤器和字符过滤器,满足复杂需求。
7. 示例:指定分析器
PUT /my-index
{
"settings": {
"analysis": {
"analyzer": {
"my_analyzer": {
"type": "standard"
}
}
}
}
}
`
了解内置分析器及其特性,有助于选择合适的分词策略,提升搜索的相关性和性能。
相关内容
- 定义与用途 本章介绍 Elasticsearch 的定义、核心功能与适用场景,帮助读者理解它为何成为现代搜索与日志分析的首选解决方案。
- 使用场景 本章总结 Elasticsearch 在全文搜索、日志分析、监控告警、推荐系统等领域的典型应用场景,助力理解其强大用途。
- 核心概念简介 本章概览 Elasticsearch 的核心构成,包括索引、文档、映射、节点、集群等关键概念,为后续使用和架构设计打下基础。
- 本地安装 本章介绍如何在本地环境中安装 Elasticsearch,适配 Windows、macOS 和 Linux 系统,便于开发测试与入门学习。
- Docker 安装 本章讲解如何通过 Docker 安装和运行 Elasticsearch,适合开发者快速搭建测试环境并集成至容器化工作流中。
- 与 Kibana 一起部署 本章介绍如何将 Elasticsearch 与 Kibana 一起部署,使用 Docker Compose 快速构建可视化分析平台,适合开发与测试环境使用。