linux环境下Elasticsearch安装教程

一、Elasticsearch简介

ElasticSearch(简称ES)是一个分布式、RESTful 风格的搜索和数据分析引擎,是用Java
开发并且是当前最流行的开源的企业级搜索引擎,能够达到近实时搜索,稳定,可靠,快
速,安装使用方便。
客户端支持Java、.NET(C#)、PHP、Python、Ruby等多种语言。
官方网站: https://www.elastic.co/
下载地址:https://www.elastic.co/cn/downloads/past-releases#elasticsearch
ElasticSearch应用场景

  • 站内搜索
  • 日志管理与分析
  • 大数据分析
  • 应用性能监控
  • 机器学习

1、什么是全文检索

全文检索是指通过一个程序扫描文本中的每一个单词,针对单词建立索引,并保存该单词在文本中的位置、以及出现的次数;用户查询时可以通过之前建立好的索引找到单词对应的文本位置、出现的次数,从而读取到具体的内容。因此市面上常见的搜索引擎的实现简单概括的话可以分为如下几步:

  • 内容爬取,停顿词过滤;
  • 内容分词,提取关键词;
  • 根据关键词建立倒排索引;
  • 用户输入关键词进行搜索;

在这里插入图片描述

2、倒排索引

平时我们使用的都是索引,都是通过主键定位到某条数据,那么倒排索引呢,刚好相反,是数据对应到主键
简单理解,正向索引是通过key找value,反向索引则是通过value找key。ES底层在检索时
底层使用的就是倒排索引。

在这里插入图片描述

3、Elasticsearch的诞生与起源

Elasticsearch是构建在Apache Lucene之上的开源分布式搜索引擎。而Lucene是一个基于Java语言开发的搜索引擎库类,创建于1999年,2005年成为Apache 顶级开源项目,具有高性能、易扩展的优点。但是因为它只能基于java语言开发、类库的接口没有进一步封装,学习成本高,除此之外原生的Lucene并不支持水平扩展,因此当今的主搜索引擎框架以Elasticsearch为主。

  • 2004年 Shay Banon 基于Lucene开发了Compass
  • 2010年 ShayBanon重写了Compass,取名Elasticsearch

优点如下:

  • 支持分布式,可水平扩展
  • 降低全文检索的学习曲线,可以被任何编程语言调用

4、ElasticSearch版本特性

5.x新特性

  • Lucene 6.x, 性能提升,默认打分机制从TF-IDF改为BM 25
  • 支持Ingest节点/ Painless Scripting / Completion suggested支持/原生的 Java REST客户端
  • Type标记成deprecated,支持了Keyword的类型
  • 性能优化 内部引擎移除了避免同一文档并发更新的竞争锁,带来15% - 20%的性能提升
  • Instant aggregation,支持分片上聚合的缓存 新增了Profile API

6.x新特性

  • 集成了Lucene 7.x的新功能,如跨集群复制(CCR) 、索引生命周期管理 、SQL的支持 。
  • 更友好的的升级及数据迁移,在主要版本之间的迁移更为简化,体验升级 ;全新的基于操作的数据复制框架,可加快恢复数据 。
  • 性能上的优化,有效存储稀疏字段的新方法,降低了存储成本;在索引时进行排序,可加快排序的查询性能。

7.x新特性

  • 集成Lucene 8.0 ,正式废除单个索引下多Type的支持;从7.1开始,Security 功能可以免费使用 ,ECK - Elasticseach Operator on Kubernetes 框架的广泛应用。

  • 在这里插入图片描述

  • 新功能,如 New Cluster coordinationFeature——Complete High Level REST ClientScript Score Query 等。

  • 性能优化 默认的Primary Shard数从5改为1,避免Over Sharding, 以及更快的Top K

8.x新特性

  • Rest API相比较7.x而言做了比较大的改动(比如彻底删除_type)
  • 默认开启安全配置
  • 存储空间优化:对倒排文件使用新的编码集,对于keyword、match_only_text、text类型字段有效,有3.5%的空间优化提升,对于新建索引和segment自动生效。
  • 优化geo_point,geo_shape类型的索引(写入)效率:15%的提升。
  • 技术预览版KNNAPI发布,(K邻近算法),跟推荐系统、自然语言排名相关。
    https://www.elastic.co/guide/en/elastic­stack/current/elasticsearch­breakingchanges.html

5、ElasticSearch快速安装

下载地址: https://www.elastic.co/cn/downloads/past-releases#elasticsearch
选择版本:7.17.3

在这里插入图片描述


注意,如果是初学者也可以直接下载windows的版本,解压后无需配置直接启动,然后在浏览器中输入http://localhost:9200如下图所示即安装成功。

在这里插入图片描述


下载完以后登录Linux服务器将对应安装包放到特定位置。
Linux单机版安装:
1、打开SecureCRT,选择File->Connection SFTP Session->将下载好的jar包上传到对应目录

#如果当前用户是root用户,需要创建一个新用户来启动es
useradd es
passwd es 输入两次密码
#切换到es用户下
su es
#进入到es的家目录
cd /home/es
pwd
#回到root用户并将jar包复制
exit
cp /root/elasticsearch-7.17.3-linux-x86_64.tar.gz  /home/es
sudo chown es:es elasticsearch-7.17.3-linux-x86_64.tar.gz
tar -zxvf elasticsearch-7.17.3-linux-x86_64.tar.gz
cd elasticsearch-7.17.3/config
vi elasticsearch.yml
vi jvm.options

2、修改对应的配置文件
elasticsearch.yml

  • cluster.name:当前节点所属集群名称,多个节点如果要组成同一个集群,那么集群名称一定要配置成相同
  • node.name:当前节点名称 path.data:配置数据存储目录,比如索引数据等
  • path.logs:配置日志存储目录,比如运行日志和集群健康信息等
  • bootstrap.memory_lock:配置ES启动时是否进行内存锁定检查,默认值true
  • network.host:配置能够访问当前节点的主机,默认值为当前节点所在机器的本机回环地址127.0.0.1,可以配置为0.0.0.0,表示所有主机均可访问
  • http.port:配置当前ES节点对外提供服务的http端口,默认值 9200 discovery.seed_hosts:配置参与集群节点发现过程的主机列表
  • cluster.initial_master_nodes:配置ES集群初始化时参与master选举的节点名称列表,必须与node.name配置的一致
    jvm.options调整jvm堆大小,如果当前虚机内核比较小,以1核1G为例建议配成512m
    ‐Xms4g
    ‐Xmx4g
    3、启动ElasticSearch服务
    Windows可直接运行elasticsearch.bat
cd ../bin
./elasticsearch #-d 后台启动

4、常见启动错误解决方案
[1]: max file descriptors [4096] for elasticsearch process is too low,increase to at
least [65536]

ES因为需要大量的创建索引文件,需要大量的打开系统的文件,所以我们需要解除linux系
统当中打开文件最大数目的限制,不然ES启动就会抛错

#切换到root用户
vim /etc/security/limits.conf
#末尾添加如下配置:
soft nofile 65536
hard nofile 65536
soft nproc 4096
hard nproc 4096

[2]: max number of threads [1024] for user [es] is too low,increase to at least [4096]无法创建本地线程问题,用户最大可创建线程数太小

vim /etc/security/limits.d/20‐nproc.conf
#改为如下配置
soft nproc 4096

[3]: max virtual memory areas vm.max_map_count [65530] is too low,increase to at
least [262144]

vim /etc/sysctl.conf
#追加以下内容
vm.max_map_count=262144
#保存退出之后执行如下命令:
sysctl ‐p

[4]: the default discovery settings are unsuitable for production use; at least one of
[discovery.seed_hosts,discovery.seed_providers,cluster.initial_master_nodes] must
be configured

缺少默认配置,至少需要配置
discovery.seed_hosts/discovery.seed_providers/cluster.initial_master_nodes中的一个
参数.

  • discovery.seed_hosts: 集群主机列表
  • discovery.seed_providers: 基于配置文件配置集群主机列表
  • cluster.initial_master_nodes: 启动时初始化的参与选主的node,生产环境必填
vim ../config/elasticsearch.yml
#添加配置
discovery.seed_hosts: ["127.0.0.1"]
cluster.initial_master_nodes: ["node‐1"]
#或者单节点
discovery.type: node‐single

6、客户端Kibana安装

Kibana是一个开源分析和可视化平台,旨在与Elasticsearch协同工作
1)下载并解压缩Kibana
下载地址:https://www.elastic.co/cn/downloads/past-releases#kibana
选择版本:7.17.3

在这里插入图片描述


可以选择windows版本或linux版本。
2)修改Kibana.yml

tar -zxvf kibana-7.17.3-linux-x86_64.tar.gz
vim kibana-7.17.3-linux-x86_64/config/kibana.yml

server.port: 5601
server.host: 0.0.0.0  #服务器ip,如果是本地运行可以直接改成localhost,线上推荐这样改
elasticsearch.hosts: ["http://服务器公网ip:9200"]
i18n.locale: "zh‐CN" #Kibana汉化

3)运行Kibana:注意:kibana也需要非root用户启动

cd ../bin
./kibana
#后台启动
nohup ./kibana  &

4、访问Kibana: http://localhost:5601/后输入GET /_cat/nodes 输出如下即为配置成功

在这里插入图片描述

7、Elasticsearch安装分词插件

Elasticsearch提供插件机制对系统进行扩展
以安装analysis-icu这个分词插件为例

#查看已安装插件
cd /home/es/elasticsearch-7.17.3
bin/elasticsearch‐plugin list 
#安装插件
./elasticsearch‐plugin install analysis‐icu
#删除插件
./elasticsearch‐plugin remove analysis‐icu

注意:安装和删除完插件后,需要重启ES服务才能生效。

在这里插入图片描述

在这里插入图片描述

原文地址:https://blog.csdn.net/qq_45036013/article/details/129448347

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐


文章浏览阅读774次,点赞24次,收藏16次。typescript项目中我们使用typings-for-css-modules-loader来替代css-loader实现css modules。1、typings-for-css-modules-loader加载器介绍 Webpack加载器,用作css-loader的替代产品,可动态生成CSS模块的TypeScript类型这句话是什么意思呢?就是编译时处理css文件...
文章浏览阅读784次。react router redux antd eslint prettier less axios_react+antd+redux+less
文章浏览阅读3.9k次,点赞5次,收藏11次。需要删除.security-7索引文件。把在第1步中的被注释的配置打开。之后就是按照提示输入密码。执行bin目录下的文件。_failed to authenticate user 'elastic' against
文章浏览阅读1.2k次,点赞23次,收藏24次。Centos 8 安装es_centos8 yum elasticsearch
文章浏览阅读3.2k次。设置完之后,数据会⾃动同步到其他节点。修改密码时,将第⼀步配置删除,然后重启。单独使⽤⼀个节点⽣成证书;执⾏设置⽤户名和密码的命令。执⾏完上⾯命令以后就可以在。⽂件,在⾥⾯添加如下内容。这个⽂件复制到其他节点下。其中⼀个节点设置密码即可。依次对每个账户设置密码。全部节点都要重启⼀遍。需要在配置⽂件中开启。个⽤户分别设置密码,⽬录下,证书⽂件名为。功能,并指定证书位置。_es设置账号和密码
文章浏览阅读1.9k次,点赞2次,收藏7次。针对多数据源写入的场景,可以借助MQ实现异步的多源写入,这种情况下各个源的写入逻辑互不干扰,不会由于单个数据源写入异常或缓慢影响其他数据源的写入,虽然整体写入的吞吐量增大了,但是由于MQ消费是异步消费,所以不适合实时业务场景。不易出现数据丢失问题,主要基于MQ消息的消费保障机制,比如ES宕机或者写入失败,还能重新消费MQ消息。针对这种情况,有数据强一致性要求的,就必须双写放到事务中来处理,而一旦用上事物,则性能下降更加明显。可能出现延时问题:MQ是异步消费模型,用户写入的数据不一定可以马上看到,造成延时。_mysql同步es
文章浏览阅读3.6w次,点赞48次,收藏44次。【程序员洲洲送书福利-第十九期】《C++ Core Guidelines解析》
文章浏览阅读1.3k次。当我们在开发Vue应用时,经常需要对表单进行校验,以确保用户输入的数据符合预期。Vue提供了一个强大的校验规则机制,通过定义rules规则,可以方便地对表单进行验证,并给出相应的错误提示。_vue ruler校验
文章浏览阅读2k次,点赞16次,收藏12次。Linux内核源码下载地址及方式_linux源码下载
文章浏览阅读1k次。这样在每天自动生成的索引skywalking_log_xxx就会使用上述模版来生成,timestamp会被设置成date类型。然后此时在–>索引管理–>kibana–>索引模式添加skywalking_log*索引时就会有时间字段了。在通过skywalking将日志收集到es后,由于skywalking收集的日志(skywalking_log索引)没有date类型的字段导致在es上再索引模式中没有时间范围的查询。skywalking收集的日志有时间戳字段timestamp,只是默认为long类型。_skywalking timestamp
文章浏览阅读937次,点赞18次,收藏21次。1.初始化git仓库,使用git int命令。2.添加文件到git仓库,两步走:2.1 使用命令,注意,可反复多次使用,添加多个文件;2.2 使用命令,完成。此笔记是我个人学习记录笔记,通过廖雪峰的笔记进行学习,用自己能理解的笔记记录下来,如果侵权,联系删。不存在任何盈利性质,单纯发布后,用于自己学习回顾。
文章浏览阅读786次,点赞8次,收藏7次。上述示例中的 origin 是远程仓库的名称,https://github.com/example/repository.git 是远程仓库的 URL,(fetch) 表示该远程仓库用于获取更新,(push) 表示该远程仓库用于推送更新。你可以选择在本地仓库创建与远程仓库分支对应的本地分支,也可以直接将本地仓库的分支推送到远程仓库的对应分支。将 替换为远程仓库的名称(例如 origin), 替换为要推送的本地分支的名称, 替换为要推送到的远程分支的名称。_git remote 智能切换仓库
文章浏览阅读1.5k次。配置eslint校验代码工具_eslint 实时校验
文章浏览阅读1.2k次,点赞28次,收藏26次。Git入门基础介绍,什么是Git,如何使用Git,以及Git的工作的基本原理
文章浏览阅读2.7k次。基于官方给出的几种不同环境不同的安装方式,本文将会选择在使用.zip文件在Windows上安装Elasticsearch在Linux或macOS上从存档文件安装ElasticsearchInstall Elasticsearch with Docker (此种方式待定)使用Docker安装Elasticsearch。_elasticsearch安装部署windows
文章浏览阅读3.3k次,点赞5次,收藏11次。【Linux驱动】内核模块编译 —— make modules 的使用(单模块编译、多模块编译)_make modules
文章浏览阅读1k次。docker启动es报错_max virtual memory areas vm.max_map_count [65530] is too low, increase to at
文章浏览阅读4.2k次,点赞2次,收藏6次。使用docker单机安装elasticsearch后再安装kibana时找不到es。_unable to retrieve version information from elasticsearch nodes. security_ex
文章浏览阅读1.1k次。日志处理对于任何现代IT系统都是关键部分,本教程专为新手设计,通过详细解释Logstash的三大核心组件,为您展示如何从零开始搭建强大的日志处理系统。您还将学习如何同步MySQL数据到Elasticsearch,并通过一个"Hello World"示例快速入门。无论您是完全的新手还是有一些基础,本教程都将引导您顺利掌握Logstash的基本操作和高级应用。_logstash mysql
文章浏览阅读1.1w次,点赞5次,收藏25次。执行这条指令之后,你的本地项目就与远程Git仓库建立了连接,你就可以开始对你的代码进行版本追踪和协作开发了。使用“git remote add origin”指令,可以轻松地将本地项目连接到远程Git仓库。git remote set-url origin 执行这条指令之后,Git就会将已经添加的名为“origin”的仓库删除。git remote add origin 其中,是你的远程Git仓库的网址。_git remote add origin