ElasticSearch 索引创建

news/2025/2/15 17:32:56/

准备工作

在开始创建索引之前,您需要安装Elasticsearch并启动Elasticsearch服务器。您还需要使用一个REST客户端,例如Kibana或Postman,以便与Elasticsearch进行交互。

创建一个索引

要创建Elasticsearch索引,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 选择要创建索引所在的集群(如果有多个集群)

  3. 使用PUT方法指定索引名称和参数。例如,我们将创建一个名为“my_index”的索引。

    PUT /my_index

4.在请求体中,指定索引的映射。索引映射定义了索引中包含的字段及其属性。下面是一个示例映射:

{"mappings": {"properties": {"field_1": { "type": "text" },"field_2": { "type": "keyword" }}}
}

上面的示例中,我们定义了一个包含两个字段的索引:field_1和field_2。field_1是一个文本字段,field_2是一个关键词字段。

  1. 现在,我们可以使用REST客户端向Elasticsearch服务器发送PUT请求来创建索引:

        {"mappings": {"properties": {"field_1": { "type": "text" },"field_2": { "type": "keyword" }}}}
    

如果一切顺利,Elasticsearch服务器应该会响应一个JSON格式的确认消息。

在Kibana中,您可以使用DevTools界面创建索引。请注意,Kibana和Elasticsearch是一体化的,因此您不需要手动连接到Elasticsearch服务器。

下面是在Kibana中创建索引的步骤:

  1. 在Kibana主界面上,单击左侧面板中的DevTools。

  2. 在DevTools界面中,选择Console选项卡。

  3. 在控制台中,输入以下内容:

    PUT /my_index
    {"mappings": {"properties": {"field_1": { "type": "text" },"field_2": { "type": "keyword" }}}
    }
    
    1. 单击Send请求按钮,以将请求发送到Elasticsearch服务器。

现在,您已经了解如何创建Elasticsearch索引。请记住,索引是存储数据的基本单元。创建一个正确的索引映射可以使您的数据更容易搜索和分析。

我将详细说明Elasticsearch索引的创建过程,包括索引映射、索引别名、设置分片和副本。希望这将帮助您更全面地了解如何使用Elasticsearch创建索引。

索引映射

Elasticsearch索引映射定义了索引中包含的字段及其属性。映射是一个JSON对象,它定义了字段类型、分析器、嵌套和多个映射类型等。

字段类型

在索引映射中,您需要定义每个字段的数据类型。Elasticsearch支持以下字段类型:

  • text:文本字段
  • keyword:关键词字段
  • date:日期字段
  • long、integer、short、byte、double、float、half_float、scaled_float:数字类型字段
  • boolean:布尔类型字段
  • binary:二进制类型字段
  • range:范围类型字段
  • object:嵌套类型字段
  • nested:嵌套类型字段(如数组)

下面是一个索引映射的示例:

{"mappings": {"properties": {"title": {"type": "text"},"author": {"type": "text"},"year": {"type": "date"},"price": {"type": "float"},"publisher": {"type": "object","properties": {"name": { "type": "text" },"address": { "type": "text" }}}}}
}

上面的示例中,我们定义了一个包含五个字段的索引。其中,title和author是文本类型字段,year是日期类型字段,price是浮点数类型字段,publisher是嵌套对象类型字段,包含name和address两个子字段。

分析器

分析器是将文本字段分割成单词的组件。Elasticsearch默认使用StandardAnalyzer分析器,该分析器将文本分割成小写单词。您可以选择使用其他分析器,如WhitespaceAnalyzer、SimpleAnalyzer或KeywordAnalyzer,或根据需要自定义分析器。

下面是一个使用自定义分析器的索引映射示例:

{"settings": {"analysis": {"analyzer": {"my_analyzer": {"type": "custom","tokenizer": "my_tokenizer","filter": ["lowercase", "stop"]          }},"tokenizer": {"my_tokenizer": {"type": "whitespace"}},"filter": {"stop": {"type": "stop","stopwords": ["a", "an", "the"]}}}},"mappings": {"properties": {"title": {"type": "text","analyzer": "my_analyzer"}}}
}

上面的示例中,我们定义了一个名为“my_analyzer”的自定义分析器,并将它应用于title字段。分析器使用whitespace分词器将文本分割成单词,然后使用lowercase和stop过滤器处理单词列表。

嵌套和多个映射类型

嵌套映射允许您将对象属性嵌入到其他对象中。例如,您可以将一个人的姓名、地址和电话号码放在一个对象中,并嵌入到一个“联系人”对象中。嵌套映射可以让您针对嵌套对象的特定属性进行搜索。

多个映射类型允许您在同一索引中存储多种不同类型的文档,并为每种类型定义不同的映射。例如,您可以将新闻文章和产品目录存储在同一索引中,并为每种类型定义不同的字段和映射。

下面是一个包含嵌套映射和多个映射类型的索引映射示例:

{"mappings": {"properties": {"title": {"type": "text"},"author": {"type": "text"},"tags": {"type": "keyword"},"price": {"type": "float"},"product": {"type": "nested","properties": {"name": { "type": "text" },"category": { "type": "keyword" }}},"type": {"type": "keyword"}},"news": {"properties": {"date": {"type": "date"}}},"product": {"properties": {"description": {"type": "text"}}}}
}

上面的示例中,我们定义了一个包含六个字段的索引。其中,title、author和tags是文本类型字段,price是浮点数类型字段,product是嵌套映射类型字段。我们还定义了两个映射类型:news和product,分别包含与新闻和产品相关的字段。

索引别名

索引别名是一个指向一个或多个索引的指针。别名可用于将多个索引组合在一起,或为单个索引提供简化的访问路径。在Elasticsearch中,别名可以在索引创建时或随后添加。

创建索引别名

要创建别名,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用PUT方法指定索引和别名名称。例如,我们将索引“my_index”指定为别名“my_alias”。

    PUT /my_index/_alias/my_alias

  3. 如果要指定多个索引,请使用逗号分隔它们。例如,我们将索引“my_index1”和“my_index2”指定为别名“my_alias”。

    PUT /my_index1,my_index2/_alias/my_alias

  4. 要为别名指定过滤器,请在请求体中指定过滤器JSON对象。例如,我们将在创建别名“my_alias”时指定一个过滤器,以仅匹配包含“category”字段的文档。

    {"actions" : [{"add" : {"index" : "my_index","alias" : "my_alias","filter" : {"exists" : { "field" : "category" }}}}]
    }
    

    上面的示例中,我们使用“add”操作将索引“my_index”和别名“my_alias”关联。我们还指定了一个过滤器对象,该对象仅匹配包含“category”字段的文档。

更新/删除索引别名

要更新或删除别名,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用POST方法指定索引别名操作。例如,我们将删除别名“my_alias”。

    {"actions" : [{ "remove" : { "index" : "my_index", "alias" : "my_alias" } }]
    }```
  3. 如果要更新别名,请使用“add”操作添加新的索引别名。例如,我们将别名“my_alias”从索引“my_index”更改为“my_index1”。

    {"actions" : [{ "remove" : { "index" : "my_index", "alias" : "my_alias" } },{ "add" : { "index" : "my_index1", "alias" : "my_alias" } }]
    }
    

分片和副本

在Elasticsearch中,数据被分为多个分片并分布在多个节点上。分片允许数据水平扩展,提高了系统的容错性和性能。每个分片都是一个自包含的Lucene索引,可以在多台服务器上进行分布式存储和处理。

副本是对数据的备份,用于提高系统的可用性和容错性。每个索引都可以有零个或多个副本。副本只存储数据的副本,不参与搜索和分析操作。

设置分片和副本

在创建索引时,您可以指定要为索引创建的分片数量和副本数量。例如,我们将为名为“my_index”的索引创建两个分片和一个副本:

{"settings": {"index": {"number_of_shards": 2,"number_of_replicas": 1}},"mappings": {"properties": {"title": {"type": "text"}}}
}

上面的示例中,我们在请求体中指定了索引的设置和映射。在设置中,我们将分片数设置为2,并将副本数设置为1。在映射中,我们定义了一个名为“title”的文本字段。

注意,一旦创建索引,就无法更改其分片数。但是,您可以更改副本数。要更改索引的副本数,请执行以下步骤:

  1. 打开REST客户端并连接到Elasticsearch服务器。

  2. 使用PUT方法指定索引名称,然后使用请求体指定新的副本数。例如,我们将“my_index”索引的副本数更改为2。

    PUT /my_index/_settings
    {"number_of_replicas": 2
    }
    

总结

创建索引是使用Elasticsearch的关键步骤之一。在创建索引时,您需要考虑字段类型、分析器、嵌套和多个映射等因素。您还可以使用别名、分片和副本等功能来提高系统的容错性、性能和可用性。

在创建索引之前,请确保您已经安装了Elasticsearch并启动了服务器。您还需要使用适当的REST客户端与服务器进行交互。如果您遇到问题,请查看Elasticsearch文档或参考Elasticsearch社区中的其它资源。

#ChatGPT协助生成


http://www.ppmy.cn/news/36999.html

相关文章

Linux进程控制-3

本片作为进程控制的最后一篇博客,来讲述进程控制中的最后一模块:程序替换的内容。 目录 程序替换 1.内容 2.接口 2.1execve 2.2execv 2.3execvp 2.4execl 2.5execlp 2.6execle 程序替换 1.内容 在真正了解程序替换之前,我们首先…

Java云电子病历系统源码,提供电子病历在线制作、管理和使用的一体化电子病历

这是一套SaaS模式Java版云HIS系统的子系统云电子病历系统源码,本系统采用前后端分离模式开发和部署,支持电子病历四级。 文末获取源码联系! 本电子病历系统主要为医院住院部提供医疗记录依据,协助医务人员在医疗活动过程中通过信…

蓝桥杯嵌入式--实战模拟题

前言在蓝桥杯省赛举办之前,学校组织了一场模拟赛,基于第十三届的省赛题,但是难度略高于省赛,这篇博客记录一下解题的过程,其思路可供大家参考。详细工程目前先联系我获取。题目详情实现思路分析花个十几分钟把题目好好…

Linux常用文件系统简述

Linux操作系统支持多种类型的文件系统,在这里我将简要介绍几种常见的Linux文件系统。1. EXT4EXT4是最为常用,最早和稳定的Linux文件系统之一,它是EXT3文件系统的升级版。EXT4采用了更高效的方式组织磁盘空间,支持更大的分区和更高…

2022年业绩逆势增长,“要强”蒙牛再创蒙牛

2022年是蒙牛“再造一个新蒙牛”五年计划的第二年,也是乳企赛道疫情以来最为艰难的一年,这一年里,不仅有疫情多点散发所带来的线下渠道不畅,也有原材料价格飙涨所导致的成本高企。 在这种形势下,蒙牛尽管遭遇多重困难…

第18章_MySQL8其它新特性

第18章_MySQL8其它新特性 🏠个人主页:shark-Gao 🧑个人简介:大家好,我是shark-Gao,一个想要与大家共同进步的男人😉😉 🎉目前状况:23届毕业生,…

分享7个你可能还不知道的JS Web API,构建现代化网站轻松搞定

Midjourney 创作,未来API大家好,随着技术的迅速发展,开发者们拥有了越来越多的令人惊叹的新工具和API。但是,我们发现在100多个API中,只有5%的API被开发者们积极地使用。下面让我们来看看一些有用的Web API&#xff0c…

Shell sed命令的奇妙用法:解决一些常见的文本处理问题

shell sed命令 sed是一种在线编辑器,它一次处理一行内容。 http://www.gnu.org/software/sed/manual/sed.html处理时,把当前处理的行存储在临时缓冲区中,称为“模式空间”(pattern space), 接着用sed命令…