ElasticSearch 索引创建

准备工作

在开始创建索引之前,您需要安装Elasticsearch并启动Elasticsearch服务器。您还需要使用一个REST客户端,例如Kibana或Postman,以便与Elasticsearch进行交互。

创建一个索引

要创建Elasticsearch索引,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 选择要创建索引所在的集群(如果有多个集群)

  3. 使用PUT方法指定索引名称和参数。例如,我们将创建一个名为“my_index”的索引。

    PUT /my_index

4.在请求体中,指定索引的映射。索引映射定义了索引中包含的字段及其属性。下面是一个示例映射:

{
  "mappings": {
    "properties": {
      "field_1": { "type": "text" },"field_2": { "type": "keyword" }
    }
  }
}

上面的示例中,我们定义了一个包含两个字段的索引:field_1和field_2。field_1是一个文本字段,field_2是一个关键词字段。

  1. 现在,我们可以使用REST客户端向Elasticsearch服务器发送PUT请求来创建索引:

        {
          "mappings": {
            "properties": {
              "field_1": { "type": "text" },"field_2": { "type": "keyword" }
            }
          }
        }
    

如果一切顺利,Elasticsearch服务器应该会响应一个JSON格式的确认消息。

在Kibana中,您可以使用DevTools界面创建索引。请注意,Kibana和Elasticsearch是一体化的,因此您不需要手动连接到Elasticsearch服务器。

下面是在Kibana中创建索引的步骤:

  1. 在Kibana主界面上,单击左侧面板中的DevTools。

  2. 在DevTools界面中,选择Console选项卡。

  3. 在控制台中,输入以下内容:

    PUT /my_index
    {
      "mappings": {
        "properties": {
          "field_1": { "type": "text" },"field_2": { "type": "keyword" }
        }
      }
    }
    
    1. 单击Send请求按钮,以将请求发送到Elasticsearch服务器。

现在,您已经了解如何创建Elasticsearch索引。请记住,索引是存储数据的基本单元。创建一个正确的索引映射可以使您的数据更容易搜索和分析。

我将详细说明Elasticsearch索引的创建过程,包括索引映射、索引别名、设置分片和副本。希望这将帮助您更全面地了解如何使用Elasticsearch创建索引。

索引映射

Elasticsearch索引映射定义了索引中包含的字段及其属性。映射是一个JSON对象,它定义了字段类型、分析器、嵌套和多个映射类型等。

字段类型

在索引映射中,您需要定义每个字段的数据类型。Elasticsearch支持以下字段类型:

  • text:文本字段
  • keyword:关键词字段
  • date:日期字段
  • long、integer、short、byte、double、float、half_float、scaled_float:数字类型字段
  • boolean:布尔类型字段
  • binary:二进制类型字段
  • range:范围类型字段
  • object:嵌套类型字段
  • nested:嵌套类型字段(如数组)

下面是一个索引映射的示例:

{
  "mappings": {
    "properties": {
      "title": {
        "type": "text"
      },"author": {
        "type": "text"
      },"year": {
        "type": "date"
      },"price": {
        "type": "float"
      },"publisher": {
        "type": "object","properties": {
          "name": { "type": "text" },"address": { "type": "text" }
        }
      }
    }
  }
}

上面的示例中,我们定义了一个包含五个字段的索引。其中,title和author是文本类型字段,year是日期类型字段,price是浮点数类型字段,publisher是嵌套对象类型字段,包含name和address两个子字段。

分析器

分析器是将文本字段分割成单词的组件。Elasticsearch默认使用StandardAnalyzer分析器,该分析器将文本分割成小写单词。您可以选择使用其他分析器,如WhitespaceAnalyzer、SimpleAnalyzer或KeywordAnalyzer,或根据需要自定义分析器。

下面是一个使用自定义分析器的索引映射示例:

{
  "settings": {
    "analysis": {
      "analyzer": {
        "my_analyzer": {
          "type": "custom","tokenizer": "my_tokenizer","filter": ["lowercase","stop"]          
        }
      },"tokenizer": {
        "my_tokenizer": {
          "type": "whitespace"
        }
      },"filter": {
        "stop": {
          "type": "stop","stopwords": ["a","an","the"]
        }
      }
    }
  },"mappings": {
    "properties": {
      "title": {
        "type": "text","analyzer": "my_analyzer"
      }
    }
  }
}

上面的示例中,我们定义了一个名为“my_analyzer”的自定义分析器,并将它应用于title字段。分析器使用whitespace分词器将文本分割成单词,然后使用lowercase和stop过滤器处理单词列表。

嵌套和多个映射类型

嵌套映射允许您将对象属性嵌入到其他对象中。例如,您可以将一个人的姓名、地址和电话号码放在一个对象中,并嵌入到一个“联系人”对象中。嵌套映射可以让您针对嵌套对象的特定属性进行搜索。

多个映射类型允许您在同一索引中存储多种不同类型的文档,并为每种类型定义不同的映射。例如,您可以将新闻文章和产品目录存储在同一索引中,并为每种类型定义不同的字段和映射。

下面是一个包含嵌套映射和多个映射类型的索引映射示例:

{
  "mappings": {
    "properties": {
      "title": {
        "type": "text"
      },"tags": {
        "type": "keyword"
      },"product": {
        "type": "nested","category": { "type": "keyword" }
        }
      },"type": {
        "type": "keyword"
      }
    },"news": {
      "properties": {
        "date": {
          "type": "date"
        }
      }
    },"product": {
      "properties": {
        "description": {
          "type": "text"
        }
      }
    }
  }
}

上面的示例中,我们定义了一个包含六个字段的索引。其中,title、author和tags是文本类型字段,price是浮点数类型字段,product是嵌套映射类型字段。我们还定义了两个映射类型:news和product,分别包含与新闻和产品相关的字段。

索引别名

索引别名是一个指向一个或多个索引的指针。别名可用于将多个索引组合在一起,或为单个索引提供简化的访问路径。在Elasticsearch中,别名可以在索引创建时或随后添加。

创建索引别名

要创建别名,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用PUT方法指定索引和别名名称。例如,我们将索引“my_index”指定为别名“my_alias”。

    PUT /my_index/_alias/my_alias

  3. 如果要指定多个索引,请使用逗号分隔它们。例如,我们将索引“my_index1”和“my_index2”指定为别名“my_alias”。

    PUT /my_index1,my_index2/_alias/my_alias

  4. 要为别名指定过滤器,请在请求体中指定过滤器JSON对象。例如,我们将在创建别名“my_alias”时指定一个过滤器,以仅匹配包含“category”字段的文档。

    {
      "actions" : [
        {
          "add" : {
            "index" : "my_index","alias" : "my_alias","filter" : {
              "exists" : { "field" : "category" }
            }
          }
        }
      ]
    }
    

    上面的示例中,我们使用“add”操作将索引“my_index”和别名“my_alias”关联。我们还指定了一个过滤器对象,该对象仅匹配包含“category”字段的文档。

更新/删除索引别名

要更新或删除别名,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用POST方法指定索引别名操作。例如,我们将删除别名“my_alias”。

    {
      "actions" : [
        { "remove" : { "index" : "my_index","alias" : "my_alias" } }
      ]
    }```
    
    
  3. 如果要更新别名,请使用“add”操作添加新的索引别名。例如,我们将别名“my_alias”从索引“my_index”更改为“my_index1”。

    {
      "actions" : [
        { "remove" : { "index" : "my_index","alias" : "my_alias" } },{ "add" : { "index" : "my_index1","alias" : "my_alias" } }
      ]
    }
    

分片和副本

在Elasticsearch中,数据被分为多个分片并分布在多个节点上。分片允许数据水平扩展,提高了系统的容错性和性能。每个分片都是一个自包含的Lucene索引,可以在多台服务器上进行分布式存储和处理。

副本是对数据的备份,用于提高系统的可用性和容错性。每个索引都可以有零个或多个副本。副本只存储数据的副本,不参与搜索和分析操作。

设置分片和副本

在创建索引时,您可以指定要为索引创建的分片数量和副本数量。例如,我们将为名为“my_index”的索引创建两个分片和一个副本:

{
  "settings": {
    "index": {
      "number_of_shards": 2,"number_of_replicas": 1
    }
  },"mappings": {
    "properties": {
      "title": {
        "type": "text"
      }
    }
  }
}

上面的示例中,我们在请求体中指定了索引的设置和映射。在设置中,我们将分片数设置为2,并将副本数设置为1。在映射中,我们定义了一个名为“title”的文本字段。

注意,一旦创建索引,就无法更改其分片数。但是,您可以更改副本数。要更改索引的副本数,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用PUT方法指定索引名称,然后使用请求体指定新的副本数。例如,我们将“my_index”索引的副本数更改为2。

    PUT /my_index/_settings
    {
      "number_of_replicas": 2
    }
    

总结

创建索引是使用Elasticsearch的关键步骤之一。在创建索引时,您需要考虑字段类型、分析器、嵌套和多个映射等因素。您还可以使用别名、分片和副本等功能来提高系统的容错性、性能和可用性。

在创建索引之前,请确保您已经安装了Elasticsearch并启动了服务器。您还需要使用适当的REST客户端与服务器进行交互。如果您遇到问题,请查看Elasticsearch文档或参考Elasticsearch社区中的其它资源。

#ChatGPT协助生成

原文地址:https://blog.csdn.net/weishuai90/article/details/129679518

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐


文章浏览阅读774次,点赞24次,收藏16次。typescript项目中我们使用typings-for-css-modules-loader来替代css-loader实现css modules。1、typings-for-css-modules-loader加载器介绍 Webpack加载器,用作css-loader的替代产品,可动态生成CSS模块的TypeScript类型这句话是什么意思呢?就是编译时处理css文件...
文章浏览阅读784次。react router redux antd eslint prettier less axios_react+antd+redux+less
文章浏览阅读3.9k次,点赞5次,收藏11次。需要删除.security-7索引文件。把在第1步中的被注释的配置打开。之后就是按照提示输入密码。执行bin目录下的文件。_failed to authenticate user 'elastic' against
文章浏览阅读1.2k次,点赞23次,收藏24次。Centos 8 安装es_centos8 yum elasticsearch
文章浏览阅读3.2k次。设置完之后,数据会⾃动同步到其他节点。修改密码时,将第⼀步配置删除,然后重启。单独使⽤⼀个节点⽣成证书;执⾏设置⽤户名和密码的命令。执⾏完上⾯命令以后就可以在。⽂件,在⾥⾯添加如下内容。这个⽂件复制到其他节点下。其中⼀个节点设置密码即可。依次对每个账户设置密码。全部节点都要重启⼀遍。需要在配置⽂件中开启。个⽤户分别设置密码,⽬录下,证书⽂件名为。功能,并指定证书位置。_es设置账号和密码
文章浏览阅读1.9k次,点赞2次,收藏7次。针对多数据源写入的场景,可以借助MQ实现异步的多源写入,这种情况下各个源的写入逻辑互不干扰,不会由于单个数据源写入异常或缓慢影响其他数据源的写入,虽然整体写入的吞吐量增大了,但是由于MQ消费是异步消费,所以不适合实时业务场景。不易出现数据丢失问题,主要基于MQ消息的消费保障机制,比如ES宕机或者写入失败,还能重新消费MQ消息。针对这种情况,有数据强一致性要求的,就必须双写放到事务中来处理,而一旦用上事物,则性能下降更加明显。可能出现延时问题:MQ是异步消费模型,用户写入的数据不一定可以马上看到,造成延时。_mysql同步es
文章浏览阅读3.6w次,点赞48次,收藏44次。【程序员洲洲送书福利-第十九期】《C++ Core Guidelines解析》
文章浏览阅读1.3k次。当我们在开发Vue应用时,经常需要对表单进行校验,以确保用户输入的数据符合预期。Vue提供了一个强大的校验规则机制,通过定义rules规则,可以方便地对表单进行验证,并给出相应的错误提示。_vue ruler校验
文章浏览阅读2k次,点赞16次,收藏12次。Linux内核源码下载地址及方式_linux源码下载
文章浏览阅读1k次。这样在每天自动生成的索引skywalking_log_xxx就会使用上述模版来生成,timestamp会被设置成date类型。然后此时在–>索引管理–>kibana–>索引模式添加skywalking_log*索引时就会有时间字段了。在通过skywalking将日志收集到es后,由于skywalking收集的日志(skywalking_log索引)没有date类型的字段导致在es上再索引模式中没有时间范围的查询。skywalking收集的日志有时间戳字段timestamp,只是默认为long类型。_skywalking timestamp
文章浏览阅读937次,点赞18次,收藏21次。1.初始化git仓库,使用git int命令。2.添加文件到git仓库,两步走:2.1 使用命令,注意,可反复多次使用,添加多个文件;2.2 使用命令,完成。此笔记是我个人学习记录笔记,通过廖雪峰的笔记进行学习,用自己能理解的笔记记录下来,如果侵权,联系删。不存在任何盈利性质,单纯发布后,用于自己学习回顾。
文章浏览阅读786次,点赞8次,收藏7次。上述示例中的 origin 是远程仓库的名称,https://github.com/example/repository.git 是远程仓库的 URL,(fetch) 表示该远程仓库用于获取更新,(push) 表示该远程仓库用于推送更新。你可以选择在本地仓库创建与远程仓库分支对应的本地分支,也可以直接将本地仓库的分支推送到远程仓库的对应分支。将 替换为远程仓库的名称(例如 origin), 替换为要推送的本地分支的名称, 替换为要推送到的远程分支的名称。_git remote 智能切换仓库
文章浏览阅读1.5k次。配置eslint校验代码工具_eslint 实时校验
文章浏览阅读1.2k次,点赞28次,收藏26次。Git入门基础介绍,什么是Git,如何使用Git,以及Git的工作的基本原理
文章浏览阅读2.7k次。基于官方给出的几种不同环境不同的安装方式,本文将会选择在使用.zip文件在Windows上安装Elasticsearch在Linux或macOS上从存档文件安装ElasticsearchInstall Elasticsearch with Docker (此种方式待定)使用Docker安装Elasticsearch。_elasticsearch安装部署windows
文章浏览阅读3.3k次,点赞5次,收藏11次。【Linux驱动】内核模块编译 —— make modules 的使用(单模块编译、多模块编译)_make modules
文章浏览阅读1k次。docker启动es报错_max virtual memory areas vm.max_map_count [65530] is too low, increase to at
文章浏览阅读4.2k次,点赞2次,收藏6次。使用docker单机安装elasticsearch后再安装kibana时找不到es。_unable to retrieve version information from elasticsearch nodes. security_ex
文章浏览阅读1.1k次。日志处理对于任何现代IT系统都是关键部分,本教程专为新手设计,通过详细解释Logstash的三大核心组件,为您展示如何从零开始搭建强大的日志处理系统。您还将学习如何同步MySQL数据到Elasticsearch,并通过一个"Hello World"示例快速入门。无论您是完全的新手还是有一些基础,本教程都将引导您顺利掌握Logstash的基本操作和高级应用。_logstash mysql
文章浏览阅读1.1w次,点赞5次,收藏25次。执行这条指令之后,你的本地项目就与远程Git仓库建立了连接,你就可以开始对你的代码进行版本追踪和协作开发了。使用“git remote add origin”指令,可以轻松地将本地项目连接到远程Git仓库。git remote set-url origin 执行这条指令之后,Git就会将已经添加的名为“origin”的仓库删除。git remote add origin 其中,是你的远程Git仓库的网址。_git remote add origin