以下ES、ES_head都部署在linux系统中
一、创建索引库
ES的索引库是一个逻辑概念,它包括了分词列表及文档列表,同一个索引库中存储了相同类型的文档。它就相当于MySQL中的表,或相当于Mongodb中的集合。
关于索引这个语:
索引(名词):ES是基于Lucene构建的一个搜索服务,它要从索引库搜索符合条件索引数据。
索引(动词):索引库刚创建起来是空的,将数据添加到索引库的过程称为索引。
下边介绍两种创建索引库的方法,它们的工作原理是相同的,都是客户端向ES服务发送命令。
第一种:使用postman或curl这样的工具创建:
下面使用postman创建的例子
第二种:使用es_head创建
二、创建映射
1.概念说明:
在索引中每个文档都包括了一个或多个field(一行记录中包含一个或多个字段),创建映射就是向索引库中创建field的过程,下边是document和field与关系数据库的概念的类比:
文档(Document)----------------Row 行记录(数据库记录)
字段(Field)-------------------Columns 列
上边讲的创建索引库相当于关系数据库中的数据库还是表?
1、如果相当于数据库就表示一个索引库可以创建很多不同类型的文档,这在ES中也是允许的。
2、如果相当于表就表示一个索引库只能存储相同类型的文档,ES官方建议 在一个索引库中只存储相同类型的文档。
2.创建映射
创建映射语法
由于ES6.0版本还没有将type(类型名称)彻底删除,所以暂时把type起一个没有特殊意义的名字。ES9.0版本把type彻底删除
使用postman创建的例子
映射内容 创建映射,三个字段:name/description/studymodel
映射创建成功,查看es_head页面
三、文档操作
添加文档
ES中文档相当于MySQL数据库表中的记录。
添加文档语法
使用postman创建示例 (这里没有设置id值,随机生成id值)
通过es_head查看数据
搜索文档
1.根据id查询数据
查询语句
使用postman测试
使用es_head查询数据
2.查询所有记录
注意:使用postman查询出现以下错误
原因:请求body中包含了数据,删掉重新请求,结果如下
3.查询名称中包括bootstrap关键字的记录
4.查询学习模式为201001的记录
请求结果分析
DSL搜索
查询指定索引库指定类型下的文档。(使用DSL搜索方法)
分页查询
ES支持分页查询,传入两个参数:from和size
Term Query
Term Query为精确查询,在搜索时会整体匹配关键字,不再将关键字分词。
上边的搜索会查询name包括“spring”这个词的文档。
更新文档
通过url请求有两种方法:
1.完全替换
2.局部修改 (只更新某个字段)
删除文档
1.根据id删除,格式如下
2.搜索匹配删除,将搜索出来的记录删除,格式如下:
搜索匹配将studymodel为201001的记录全部删除
四、使用IK分词器
1.测试分词器
会进行分词,索引中存放的就是一个一个的词(term),当你去搜索时就是拿关键字去匹配词,最终找到词关联的文档。
索引库默认使用的分词器对中文是单字分词
2.两种分词模式
ik分词器有两种分词模式:ik_max_word和ik_smart模式。
3.自定义词库
如果要让分词器支持一些专有词语,可以自定义词库。
iK目录下一个main.dic的文件,此文件为词库文件。
五、映射
1.映射的维护方法
查询所有索引的映射
创建映射
示例
更新映射
映射创建成功可以添加新字段,已有字段不允许更新。(字段类型也不能修改) ******
删除字段
通过删除索引来删除映射
2.常用映射字段
文本字段
1.text 字段内各种属性值
1)analyzer
通过analyzer属性指定分词器,下面指定name的字段类型为text,使用ik分词器的ik_max_word分词模式
上边指定了analyzer是指在索引(数据添加到数据库中)和搜索都使用ik_max_word,如果单独想定义搜索时使用的分词器则可以通过search_analyzer属性。
对于ik分词器建议是索引(数据添加到数据库中)时使用ik_max_word将搜索内容进行细粒度分词,搜索时使用ik_smart提高搜索精确性。
2)index
通过index属性指定是否索引(索引库搜索符合条件索引数据)。
默认为index=true,即要进行索引,只有进行索引才可以从索引库搜索到。
但是也有一些内容不需要索引,比如:商品图片地址只被用来展示图片,不进行搜索图片,此时可以将index设置为false。
删除索引,重新创建映射,举例:将pic字段的index设置为false,尝试根据pic去搜索,结果搜索不到数据
3)store
测试:
新索引库es_test创建新映射:
插入文档:(插入数据)
查询测试
通过测试发现:name和description都支持全文检索,pic不可作为查询条件。
2.keyword关键字字段
上边介绍的text文本字段在映射时要设置分词器,keyword字段为关键字字段,通常搜索keyword是按照整体搜索,所以创建keyword字段的索引时是不进行分词的,比如:邮政编码、手机号码、身份证等。keyword字段通常用于过虑、排序、聚合等。
测试
3.日期类型字段
日期类型不用设置分词器,通常日期类型的字段用于排序。
1)format 通过format设置日期格式
例子:下面添加映射date,设置允许date字段存储年月日时分秒、年月日及毫秒三种格式
插入文档测试
4.数值类型
ES支持下面这些数值类型
1)尽量选择范围小的类型,提高搜索效率
2)对于浮点型尽量使用比例因子,比如一个价格字段,单位为元,我们将比例因子设置为100,映射如下:
更新已有映射price,并插入文档