ElasticSearch(简称ES)是一个分布式、RESTful 风格的搜索和数据分析引擎,是用Java
开发并且是当前最流行的开源的企业级搜索引擎,能够达到近实时搜索,稳定,可靠,快
速,安装使用方便。
客户端支持Java、.NET(C#)、PHP、Python、Ruby等多种语言。
官方网站: https://www.elastic.co/
下载地址:https://www.elastic.co/cn/downloads/past-releases#elasticsearch
ElasticSearch应用场景
全文检索是指通过一个程序扫描文本中的每一个单词,针对单词建立索引,并保存该单词在文本中的位置、以及出现的次数;用户查询时可以通过之前建立好的索引找到单词对应的文本位置、出现的次数,从而读取到具体的内容。因此市面上常见的搜索引擎的实现简单概括的话可以分为如下几步:
平时我们使用的都是索引,都是通过主键定位到某条数据,那么倒排索引呢,刚好相反,是数据对应到主键
简单理解,正向索引是通过key找value,反向索引则是通过value找key。ES底层在检索时
底层使用的就是倒排索引。
Elasticsearch是构建在Apache Lucene之上的开源分布式搜索引擎。而Lucene是一个基于Java语言开发的搜索引擎库类,创建于1999年,2005年成为Apache 顶级开源项目,具有高性能、易扩展的优点。但是因为它只能基于java语言开发、类库的接口没有进一步封装,学习成本高,除此之外原生的Lucene并不支持水平扩展,因此当今的主搜索引擎框架以Elasticsearch为主。
优点如下:
5.x新特性
6.x新特性
7.x新特性
集成Lucene 8.0 ,正式废除单个索引下多Type的支持;从7.1开始,Security 功能可以免费使用 ,ECK - Elasticseach Operator on Kubernetes 框架的广泛应用。
新功能,如 New Cluster coordination、 Feature——Complete High Level REST Client、Script Score Query 等。
性能优化 默认的Primary Shard数从5改为1,避免Over Sharding, 以及更快的Top K
8.x新特性
下载地址: https://www.elastic.co/cn/downloads/past-releases#elasticsearch
选择版本:7.17.3
注意,如果是初学者也可以直接下载windows的版本,解压后无需配置直接启动,然后在浏览器中输入http://localhost:9200如下图所示即安装成功。
下载完以后登录Linux服务器将对应安装包放到特定位置。
Linux单机版安装:
1、打开SecureCRT,选择File->Connection SFTP Session->将下载好的jar包上传到对应目录
#如果当前用户是root用户,需要创建一个新用户来启动es
useradd es
passwd es 输入两次密码
#切换到es用户下
su es
#进入到es的家目录
cd /home/es
pwd
#回到root用户并将jar包复制
exit
cp /root/elasticsearch-7.17.3-linux-x86_64.tar.gz /home/es
sudo chown es:es elasticsearch-7.17.3-linux-x86_64.tar.gz
tar -zxvf elasticsearch-7.17.3-linux-x86_64.tar.gz
cd elasticsearch-7.17.3/config
vi elasticsearch.yml
vi jvm.options
2、修改对应的配置文件
elasticsearch.yml
cd ../bin
./elasticsearch #-d 后台启动
4、常见启动错误解决方案
[1]: max file descriptors [4096] for elasticsearch process is too low, increase to at
least [65536]
ES因为需要大量的创建索引文件,需要大量的打开系统的文件,所以我们需要解除linux系
统当中打开文件最大数目的限制,不然ES启动就会抛错
#切换到root用户
vim /etc/security/limits.conf
#末尾添加如下配置:
soft nofile 65536
hard nofile 65536
soft nproc 4096
hard nproc 4096
[2]: max number of threads [1024] for user [es] is too low, increase to at least [4096]无法创建本地线程问题,用户最大可创建线程数太小
vim /etc/security/limits.d/20‐nproc.conf
#改为如下配置
soft nproc 4096
[3]: max virtual memory areas vm.max_map_count [65530] is too low, increase to at
least [262144]
vim /etc/sysctl.conf
#追加以下内容
vm.max_map_count=262144
#保存退出之后执行如下命令:
sysctl ‐p
[4]: the default discovery settings are unsuitable for production use; at least one of
[discovery.seed_hosts, discovery.seed_providers, cluster.initial_master_nodes] must
be configured
缺少默认配置,至少需要配置
discovery.seed_hosts/discovery.seed_providers/cluster.initial_master_nodes中的一个
参数.
vim ../config/elasticsearch.yml
#添加配置
discovery.seed_hosts: ["127.0.0.1"]
cluster.initial_master_nodes: ["node‐1"]
#或者单节点
discovery.type: node‐single
Kibana是一个开源分析和可视化平台,旨在与Elasticsearch协同工作
1)下载并解压缩Kibana
下载地址:https://www.elastic.co/cn/downloads/past-releases#kibana
选择版本:7.17.3
可以选择windows版本或linux版本。
2)修改Kibana.yml
tar -zxvf kibana-7.17.3-linux-x86_64.tar.gz
vim kibana-7.17.3-linux-x86_64/config/kibana.yml
server.port: 5601
server.host: 0.0.0.0 #服务器ip,如果是本地运行可以直接改成localhost,线上推荐这样改
elasticsearch.hosts: ["http://服务器公网ip:9200"]
i18n.locale: "zh‐CN" #Kibana汉化
3)运行Kibana:注意:kibana也需要非root用户启动
cd ../bin
./kibana
#后台启动
nohup ./kibana &
4、访问Kibana: http://localhost:5601/后输入GET /_cat/nodes 输出如下即为配置成功
Elasticsearch提供插件机制对系统进行扩展
以安装analysis-icu这个分词插件为例
#查看已安装插件
cd /home/es/elasticsearch-7.17.3
bin/elasticsearch‐plugin list
#安装插件
./elasticsearch‐plugin install analysis‐icu
#删除插件
./elasticsearch‐plugin remove analysis‐icu