MongoDB中聚合(aggregate)主要用于处理数据(诸如统计平均值,求和等),并返回计算后的数据结果。有点类似sql语句中的 count(*)。
一、聚合
对于Mongodb中的聚合应该使用aggregate()方法
语法:db.COLLECTION_NAME.aggregate(AGGREGATE_OPERATION)
先建一组数据用于今天的测试。
sum:
- 统计年龄段中各有多少个
db.TestAggregate.aggregate([{$group:{_id:"$age",num_tutorial:{$sum:1}}}])
Max:
- 统计每个地区中最大的年龄
db.TestAggregate.aggregate([{group:{_id:"address",num_tutorial:{max:"age”}
}}])
剩下的都类似大家可以看看下表
二、管道##:
管道在Unix和Linux中一般用于将当前命令的输出结果作为下一个命令的参数。
MongoDB的聚合管道将MongoDB文档在一个管道处理完毕后将结果传递给下一个管道处理。管道操作是可以重复的。
表达式:处理输入文档并输出。表达式是无状态的,只能用于计算当前聚合管道的文档,不能处理其它的文档。
这里我们介绍一下聚合框架中常用的几个操作:
- $project:修改输入文档的结构。可以用来重命名、增加或删除域,也可以用于创建计算结果以及嵌套文档。
- match:用于过滤数据,只输出符合条件的文档。match使用MongoDB的标准查询操作。
- $limit:用来限制MongoDB聚合管道返回的文档数。
- $skip:在聚合管道中跳过指定数量的文档,并返回余下的文档。
- $unwind:将文档中的某一个数组类型字段拆分成多条,每条包含数组中的一个值。
- $group:将集合中的文档分组,可用于统计结果。
- $sort:将输入文档排序后输出。
- $geoNear:输出接近某一地理位置的有序文档。
project:
db.TestAggregate.aggregate({$project:{name:1,age:1}})
–如果不想出现_ID就用下面的语句执行:
db.TestAggregate.aggregate({$project:{name:1,age:1,_id:0}})
skip 和 limit :
主要用于分页:
三、游标
之前说过mongodb客户端也是C++写的,所以也支持c++的一些操作。先看下游标的效果
- 首先var lst 定义了查询出所有集合中的文档,find()。定义完并不会马上执行。
- 在foreach中循环输出的时候就可以一次性加载过来,然后让游标逐行读取,当我们枚举完了之后,游标销毁。
- 最后我再去foreach输出时发现没有数据了。
四、索引
要体现索引的性能,必须要有多的数据。我现在先在我的集合中插入20万条文档,看图
MongoDB中带了分析工具explain(),现在来看下没有加索引查找记录Name:“Michael10000”所花费的时间
millis:描述的是查找所花费的时间。52毫秒
nscanned:200000表示扫面了200000万次文档。
cursor:BasicCursor表示使用全表顺序扫描
其他的根据字面意思很容易明白。
建立索引:
看到没有,扫描耗费时间0,快的飞起。查看索引和删除索引