MongoDB中聚合(aggregate)主要用于处理数据(诸如统计平均值,求和等),并返回计算后的数据结果。有点类似sql语句中的 count(*)。

一、聚合

对于Mongodb中的聚合应该使用aggregate()方法
    语法:db.COLLECTION_NAME.aggregate(AGGREGATE_OPERATION)

先建一组数据用于今天的测试。

mongodb查询最后几条数据 mongodb查询总条数_地理位置

sum:

  • 统计年龄段中各有多少个
db.TestAggregate.aggregate([{$group:{_id:"$age",num_tutorial:{$sum:1}}}])

mongodb查询最后几条数据 mongodb查询总条数_地理位置_02


Max:

  • 统计每个地区中最大的年龄

db.TestAggregate.aggregate([{group:{_id:"address",num_tutorial:{max:"age”}
}}])

mongodb查询最后几条数据 mongodb查询总条数_地理位置_03

剩下的都类似大家可以看看下表

mongodb查询最后几条数据 mongodb查询总条数_地理位置_04

二、管道##:


管道在Unix和Linux中一般用于将当前命令的输出结果作为下一个命令的参数。

MongoDB的聚合管道将MongoDB文档在一个管道处理完毕后将结果传递给下一个管道处理。管道操作是可以重复的。

表达式:处理输入文档并输出。表达式是无状态的,只能用于计算当前聚合管道的文档,不能处理其它的文档。

这里我们介绍一下聚合框架中常用的几个操作:

  1. $project:修改输入文档的结构。可以用来重命名、增加或删除域,也可以用于创建计算结果以及嵌套文档。
  2. match:用于过滤数据,只输出符合条件的文档。match使用MongoDB的标准查询操作。
  3. $limit:用来限制MongoDB聚合管道返回的文档数。
  4. $skip:在聚合管道中跳过指定数量的文档,并返回余下的文档。
  5. $unwind:将文档中的某一个数组类型字段拆分成多条,每条包含数组中的一个值。
  6. $group:将集合中的文档分组,可用于统计结果。
  7. $sort:将输入文档排序后输出。
  8. $geoNear:输出接近某一地理位置的有序文档。

project:

db.TestAggregate.aggregate({$project:{name:1,age:1}})

mongodb查询最后几条数据 mongodb查询总条数_mongodb查询最后几条数据_05

–如果不想出现_ID就用下面的语句执行:
db.TestAggregate.aggregate({$project:{name:1,age:1,_id:0}})

skip 和 limit :

主要用于分页:

mongodb查询最后几条数据 mongodb查询总条数_mongodb查询最后几条数据_06

三、游标

之前说过mongodb客户端也是C++写的,所以也支持c++的一些操作。先看下游标的效果

mongodb查询最后几条数据 mongodb查询总条数_地理位置_07

  1. 首先var lst 定义了查询出所有集合中的文档,find()。定义完并不会马上执行。
  2. 在foreach中循环输出的时候就可以一次性加载过来,然后让游标逐行读取,当我们枚举完了之后,游标销毁。
  3. 最后我再去foreach输出时发现没有数据了。

四、索引

要体现索引的性能,必须要有多的数据。我现在先在我的集合中插入20万条文档,看图

mongodb查询最后几条数据 mongodb查询总条数_地理位置_08

MongoDB中带了分析工具explain(),现在来看下没有加索引查找记录Name:“Michael10000”所花费的时间

mongodb查询最后几条数据 mongodb查询总条数_索引_09

millis:描述的是查找所花费的时间。52毫秒
nscanned:200000表示扫面了200000万次文档。
cursor:BasicCursor表示使用全表顺序扫描
其他的根据字面意思很容易明白。

建立索引:

mongodb查询最后几条数据 mongodb查询总条数_mongodb_10


看到没有,扫描耗费时间0,快的飞起。查看索引和删除索引

mongodb查询最后几条数据 mongodb查询总条数_mongodb_11