MongoDB 入门 (二)索引

  • 索引基本概述
  • 索引的类型
  • 索引的管理
  • 查看索引
  • 创建索引
  • 索引的移除
  • 索引的使用


索引基本概述

索引支持在MongoDB中高效地执行查询。如果没有索引,MongoDB必须执行全集合扫描,即扫描集合中的每个文档,以选择与查询语句匹配的文档。这种扫描全集合的查询效率是非常低的,特别在处理大量的数据时,查询可以要花费几十秒甚至几分钟,这对网站的性能是非常致命的。

如果查询存在适当的索引,MongoDB可以使用该索引限制必须检查的文档数。

索引是特殊的数据结构,它以易于遍历的形式存储集合数据集的一小部分。索引存储特定字段或一组字段的值,按字段值排序。索引项的排序支持有效的相等匹配和基于范围的查询操作。此外,MongoDB还可以使用索引中的排序返回排序结果。

索引官网文档

MongoDB索引使用B树数据结构(确切的说是B-Tree,MySQL是B+Tree)


索引的类型

单字段索引
MongoDB支持在文档的单个字段上创建用户定义的升序/降序索引,称为单字段索引(Single Field Index)。

对于单个字段索引和排序操作,索引键的排序顺序(即升序或降序)并不重要,因为MongoDB可以在任何方向上遍历索引。


复合索引
MongoDB还支持多个字段的用户定义索引,即复合索引(Compound Index)。

复合索引中列出的字段顺序具有重要意义。例如,如果复合索引由 { userid: 1, score: -1 } 组成,则索引首先按userid正序排序,然后
在每个userid的值内,再在按score倒序排序


其他索引

  • 地理空间索引(Geospatial Index)
    为了支持对地理空间坐标数据的有效查询,MongoDB提供了两种特殊的索引:返回结果时使用平面几何的二维索引和返回结果时使用球面 几何的二维球面索引。
  • 文本索引(Text Indexes)
    MongoDB提供了一种文本索引类型,支持在集合中搜索字符串内容。这些文本索引不存储特定于语言的停止词(例如“the”、“a”、“or”),而将集合中的词作为词干,只存储根词。
  • 哈希索引(Hashed Indexes)
    为了支持基于散列的分片,MongoDB提供了散列索引类型,它对字段值的散列进行索引。这些索引在其范围内的值分布更加随机,但只支持相等匹配,不支持基于范围的查询。

索引的管理

查看索引

查询索引
返回一个集合中的所有索引的数组

db.集合名.getIndexes()

查看mongo索引创建的时间 mongo索引数据结构_执行计划


结果中显示的是默认 _id 索引。

默认_id索引:MongoDB在创建集合的过程中,在 _id 字段上创建一个唯一的索引,默认名字为 id ,该索引可防止客户端插入两个具有相同值的文档,您不能在_id字段上删除此索引。

注意:该索引是唯一索引,因此值不能重复,即 _id 值不能重复的。在分片集群中,通常使用 _id 作为片键


创建索引

在集合上创建索引。

db.集合名.createIndex(keys, options)

注意在 3.0.0 版本前创建索引方法为 db.collection.ensureIndex() ,之后的版本使用了 db.collection.createIndex() 方法, ensureIndex() 还能用,但只是 createIndex() 的别名。

单字段索引示例:对 userid 字段建立索引:

db.hxt094.createIndex({userid:1})  //对于单字段而言,升序降序并不影响
{ 
	"createdCollectionAutomatically" : false, 
	"numIndexesBefore" : 1, 
	"numIndexesAfter" : 2, 
	"ok" : 1 
}

复合索引:对 userid 和 nickname 同时建立复合(Compound)索引:

db.hxt094.createIndex({userid:1,nickname:-1}) 
{ 
	"createdCollectionAutomatically" : false, 
	"numIndexesBefore" : 2, 
	"numIndexesAfter" : 3, 
	"ok" : 1 
}

查看mongo索引创建的时间 mongo索引数据结构_字段_02


索引的移除

指定索引的移除

db.collection.dropIndex(index)

删除 comment 集合中 userid 字段上的升序索引:

db.comment.dropIndex({userid:1})

所有索引的移除

db.collection.dropIndexes()

索引的使用

执行计划
执行计划的作用是:分析查询性能(Analyze Query Performance),通常使用执行计划(解释计划、Explain Plan)来查看查询的情况,如查询耗费的时间、是否基于索引查询等。我们想知道 建立的索引是否有效,效果如何,都需要通过执行计划查看。

db.collection.find(query,options).explain(options)

查看根据userid查询数据的情况:

db.comment.find({userid:"1003"}).explain()

关键点看: “stage” : “COLLSCAN”, 表示全集合扫描

查看mongo索引创建的时间 mongo索引数据结构_字段_03

下面对userid建立索引

> db.comment.createIndex({userid:1}) 
{ 
	"createdCollectionAutomatically" : false, 
	"numIndexesBefore" : 1, 
	"numIndexesAfter" : 2, 
	"ok" : 1 
}

再次查看执行计划,关键点看: “stage” : “IXSCAN” ,基于索引的扫描