MongoDB【索引-index】

news/2024/9/23 2:16:24/

目录

1:概述

2:索引的类型

2.1:单字段索引

2.2:复合索引

2.3:其他索引

3:索引的管理操作

3.1:索引的查看

3.2:索引的创建

3.3:索引的移除

4:索引的使用

4.1:执行计划

4.2:涵盖的查询


1:概述

索引支持在 MongoDB 中高效地执行查询。如果没有索引, MongoDB 必须执行全集合扫描,即扫描集合中的每个文档,以选择与查询语句 匹配的文档。这种扫描全集合的查询效率是非常低的,特别在处理大量的数据时,查询可以要花费几十秒甚至几分钟,这对网站的性能是非
常致命的。
如果查询存在适当的索引, MongoDB 可以使用该索引限制必须检查的文档数。
索引是特殊的数据结构,它以易于遍历的形式存储集合数据集的一小部分。索引存储特定字段或一组字段的值,按字段值排序。索引项的排序支持有效的相等匹配和基于范围的查询操作。此外,MongoDB 还可以使用索引中的排序返回排序结果。
官网文档: https://docs.mongodb.com/manual/indexes/
了解:
MongoDB 索引使用 B 树数据结构(确切的说是 B-Tree MySQL B+Tree

2:索引的类型

2.1:单字段索引

MongoDB 支持在文档的单个字段上创建用户定义的升序 / 降序索引,称为单字段索引( Single Field Index )。
对于单个字段索引和排序操作,索引键的排序顺序(即升序或降序)并不重要,因为 MongoDB 可以在任何方向上遍历索引。

2.2:复合索引

MongoDB 还支持多个字段的用户定义索引,即复合索引( Compound Index )。
复合索引中列出的字段顺序具有重要意义。例如,如果复合索引由 { userid: 1, score: - 1 } 组成,则索引首先按 userid 正序排序,然后在每个userid 的值内,再在按 score 倒序排序。

2.3:其他索引

地理空间索引( Geospatial Index )、文本索引( Text Indexes )、哈希索( HashedIndexes )。
地理空间索引( Geospatial Index
为了支持对地理空间坐标数据的有效查询, MongoDB 提供了两种特殊的索引:返回结果时使用平面几何的二维索引和返回结果时使用球面几何的二维球面索引。
文本索引( Text Indexes
MongoDB 提供了一种文本索引类型,支持在集合中搜索字符串内容。这些文本索引不存储特定于语言的停止词(例如 “the” “a” “or” ), 而将集合中的词作为词干,只存储根词。
哈希索引( Hashed Indexes
为了支持基于散列的分片, MongoDB 提供了散列索引类型,它对字段值的散列进行索引。这些索引在其范围内的值分布更加随机,但只支持相等匹配,不支持基于范围的查询。

3:索引的管理操作

3.1:索引的查看

说明:
返回一个集合中的所有索引的数组。
语法:
db.collection.getIndexes()
提示:该语法命令运行要求是 MongoDB 3.0+
【示例】
查看 comment 集合中所有的索引情况
> db.comment.getIndexes()[{"v" : 2,"key" : {"_id" : 1},"name" : "_id_","ns" : "articledb.comment"}]
结果中显示的是默认 _id 索引。
默认 _id 索引:
MongoDB 在创建集合的过程中,在 _id 字段上创建一个唯一的索引,默认名字为 _id_ ,该索引可防止客户端插入两个具有相同值的文 档,您不能在_id 字段上删除此索引。
注意:该索引是唯一索引,因此值不能重复,即 _id 值不能重复的。在分片集群中,通常使用 _id 作为片键。

3.2:索引的创建

说明:
在集合上创建索引。
语法:
db.collection.createIndex(keys, options)
参数:

options(更多选项)列表:

提示:
注意在 3.0.0 版本前创建索引方法为 db.collection.ensureIndex() ,之后的版本使用了 db.collection.createIndex() 方法,
ensureIndex() 还能用,但只是 createIndex() 的别名。

【示例】
1 )单字段索引示例:对 userid 字段建立索引:
> db.comment.createIndex({userid:1})
{
"createdCollectionAutomatically" : false,
"numIndexesBefore" : 1,
"numIndexesAfter" : 2,
"ok" : 1
}
参数 1 :按升序创建索引
可以查看一下:
> db.comment.getIndexes()
[{"v" : 2,"key" : {"_id" : 1},"name" : "_id_","ns" : "articledb.comment"},{"v" : 2,"key" : {"userid" : 1},"name" : "userid_1","ns" : "articledb.comment"}
]
索引名字为 `userid_1
compass查看:

2)复合索引:对 userid nickname 同时建立复合(Compound)索引:

> db.comment.createIndex({userid:1,nickname:-1})
{
"createdCollectionAutomatically" : false,
"numIndexesBefore" : 2,
"numIndexesAfter" : 3,
"ok" : 1
}

 查看一下索引:

> db.comment.getIndexes()
[
{
"v" : 2,
"key" : {
"_id" : 1
},
"name" : "_id_",
"ns" : "articledb.comment"
},
{
"v" : 2,
"key" : {
"userid" : 1
},
"name" : "userid_1",
"ns" : "articledb.comment"
},
{
"v" : 2,
"key" : {
"userid" : 1,
"nickname" : -1
},
"name" : "userid_1_nickname_-1",
"ns" : "articledb.comment"
}
]
compass 中:

3.3:索引的移除

说明:可以移除指定的索引,或移除所有索引
一、指定索引的移除
语法:
db.collection.dropIndex(index)
参数:
【示例】
删除 comment 集合中 userid 字段上的升序索引:
> db.comment.dropIndex({userid:1})
{ "nIndexesWas" : 3, "ok" : 1 }
查看已经删除了。
二、所有索引的移除
语法:
db.collection.dropIndexes()
【示例】
删除 spit 集合中所有索引。
> db.comment.dropIndexes()
{
"nIndexesWas" : 2,
"msg" : "non-_id indexes dropped for collection",
"ok" : 1
}
提示: _id 的字段的索引是无法删除的,只能删除非 _id 字段的索引。

4:索引的使用

4.1:执行计划

分析查询性能( Analyze Query Performance )通常使用执行计划(解释计划、 Explain Plan )来查看查询的情况,如查询耗费的时间、是 否基于索引查询等。
那么,通常,我们想知道,建立的索引是否有效,效果如何,都需要通过执行计划查看。
语法:
db.collection.find(query,options).explain(options)
【示例】
查看根据 userid 查询数据的情况:
> db.comment.find({userid:"1003"}).explain()
{"queryPlanner" : {"plannerVersion" : 1,"namespace" : "articledb.comment","indexFilterSet" : false,"parsedQuery" : {"userid" : {"$eq" : "1003"}},"winningPlan" : {"stage" : "COLLSCAN","filter" : {"userid" : {"$eq" : "1003"}},"direction" : "forward"},"rejectedPlans" : [ ]},"serverInfo" : {"host" : "9ef3740277ad","port" : 27017,"version" : "4.0.10","gitVersion" : "c389e7f69f637f7a1ac3cc9fae843b635f20b766"},"ok" : 1
}
关键点看: "stage" : "COLLSCAN", 表示全集合扫描

下面对userid建立索引

> db.comment.createIndex({userid:1})
{
"createdCollectionAutomatically" : false,
"numIndexesBefore" : 1,
"numIndexesAfter" : 2,
"ok" : 1
}

 再次查看执行计划:

{"queryPlanner" : {"plannerVersion" : 1,"namespace" : "articledb.comment","indexFilterSet" : false,"parsedQuery" : {"userid" : {"$eq" : "1013"}},"winningPlan" : {"stage" : "FETCH","inputStage" : {"stage" : "IXSCAN","keyPattern" : {"userid" : 1},"indexName" : "userid_1","isMultiKey" : false,"multiKeyPaths" : {"userid" : [ ]},"isUnique" : false,"isSparse" : false,"isPartial" : false,"indexVersion" : 2,"direction" : "forward","indexBounds" : {"userid" : ["[\"1013\", \"1013\"]"]}}},"rejectedPlans" : [ ]
},"serverInfo" : {"host" : "9ef3740277ad","port" : 27017,"version" : "4.0.10","gitVersion" : "c389e7f69f637f7a1ac3cc9fae843b635f20b766"},"ok" : 1
}
关键点看: "stage" : "IXSCAN" , 基于索引的扫描
compass查看:

4.2:涵盖的查询

Covered Queries
当查询条件和查询的投影仅包含索引字段时, MongoDB 直接从索引返回结果,而不扫描任何文档或将文档带入内存。 这些覆盖的查询可以
非常有效。

更多:https://docs.mongodb.com/manual/core/query-optimization/#read-operations-covered-query

【示例】

> db.comment.find({userid:"1003"},{userid:1,_id:0})
{ "userid" : "1003" }
{ "userid" : "1003" }
> db.comment.find({userid:"1003"},{userid:1,_id:0}).explain()
{
"queryPlanner" : {
"plannerVersion" : 1,
"namespace" : "articledb.comment",
"indexFilterSet" : false,
"parsedQuery" : {
"userid" : {
"$eq" : "1003"
}
},
"winningPlan" : {
"stage" : "PROJECTION",
"transformBy" : {
"userid" : 1,
"_id" : 0
},
"inputStage" : {
"stage" : "IXSCAN",
"keyPattern" : {
Compass中:
5 文章评论
5.1 需求分析
某头条的文章评论业务如下:
"userid" : 1
},
"indexName" : "userid_1",
"isMultiKey" : false,
"multiKeyPaths" : {
"userid" : [ ]
},
"isUnique" : false,
"isSparse" : false,
"isPartial" : false,
"indexVersion" : 2,
"direction" : "forward",
"indexBounds" : {
"userid" : [
"[\"1003\", \"1003\"]"
]
}
}
},
"rejectedPlans" : [ ]
},
"serverInfo" : {
"host" : "bobohost.localdomain",
"port" : 27017,
"version" : "4.0.10",
"gitVersion" : "c389e7f69f637f7a1ac3cc9fae843b635f20b766"
},
"ok" : 1
}


http://www.ppmy.cn/news/56313.html

相关文章

简单的redis master slave 配置

只做一个简单的master - slave 配置,新手试炼配置用。使用windows系统 master 配置 redis 默认,密码为空。首先配置redis(for master)的密码。 修改安装目录下的redis.windows.conf文件,搜索到requirepass, # requirepass foob…

Jenkins 修改 root 权限问题

记一次 jenkins 修改 root 权限的问题 有时候 jenkins 执行脚本会说权限不够,于是想着直接给他 root 权限吧。 网上很多博客,很多都说改 vim /etc/sysconfig/jenkins 修改 JENKINS_USER"root" 然后修改三个文件路径的权限分别是 /var/lib/j…

微机原理与接口技术课程笔记(汇编语言)

目录 一、指令系统 (〇)寻址方式(7种) (一)数据传输类指令 (二)算数运算类指令 (三)逻辑操作类指令 (四)控制转移类指令 &…

我们公司的面试,有点不一样!

我们公司的面试,有点不一样! 朋友们周末愉快,我是鱼皮。因为我很屑,所以大家也可以叫我屑老板。 自从我发了自己创业的文章和视频后,收到了很多小伙伴们的祝福,真心非常感谢! 不得不说&#…

网络安全:windows批处理写病毒的一些基本命令.

网络安全:windows批处理一些命令. echo off一般都写在批处理的最上面,用于关闭回显,意思是 关闭回显: 没有关闭回显: 所以,意思就是将输入指令的过程隐藏起来。 set是设置的意思,作业是打印、创建和修改变…

Python自动化测试框架之unittest使用详解

unittest是Python自动化测试框架之一,提供了一系列测试工具和接口,支持单元测试、功能测试、集成测试等多种测试类型。unittest使用面向对象的思想实现测试用例的编写和管理,可以方便地扩展和定制测试框架,支持多种测试结果输出格…

Go官方指南(一)包、变量、函数

import "time" 获取当前系统时间:time.Now() 每个 Go 程序都是由包构成的 按照约定 ,包名与导入路径的最后一个元素一致。例如,"math/rand"包中的源码均以 package rand 语句开始 在 Go 中,如果一个名字以…

人工智能之配置环境教程二:在Anaconda中创建虚拟环境安装GPU版本的Pytorch及torchvision并在VsCode中使用虚拟环境

人工智能之配置环境教程二:在Anaconda中创建虚拟环境安装GPU版本的Pytorch及torchvision并在VsCode中使用虚拟环境 作者介绍一. 查看自己电脑的CUDA版本1.1 方式一1.2 方式二 二. 下载安装CUDA三. 查看环境变量四. 创建虚拟环境4.1 使用指令创建虚拟环境4.2 查看Anc…