国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁 > 數(shù)據(jù)庫 > MongoDB > 正文

使用aggregate在MongoDB中查詢重復數(shù)據(jù)記錄的方法

2020-03-14 13:17:50
字體:
供稿:網(wǎng)友
這篇文章主要介紹了使用aggregate在MongoDB中查詢重復數(shù)據(jù)記錄的方法的相關(guān)資料,需要的朋友可以參考下
 

MongoDB中聚合(aggregate)主要用于處理數(shù)據(jù)(諸如統(tǒng)計平均值,求和等),并返回計算后的數(shù)據(jù)結(jié)果。有點類似sql語句中的 count(*)。

aggregate() 方法

MongoDB中聚合的方法使用aggregate()。

語法

aggregate() 方法的基本語法格式如下所示:

>db.COLLECTION_NAME.aggregate(AGGREGATE_OPERATION)

我們知道,MongoDB屬于文檔型數(shù)據(jù)庫,其存儲的文檔類型都是JSON對象。正是由于這一特性,我們在Node.js中會經(jīng)常使用MongoDB進行數(shù)據(jù)的存取。但由于Node.js是異步執(zhí)行的,這就導致我們無法保證每一次的數(shù)據(jù)庫save操作都是原子型的。也就是說,如果客戶端連續(xù)兩次發(fā)起同一事件將數(shù)據(jù)存入數(shù)據(jù)庫,很可能會導致數(shù)據(jù)被重復保存。高并發(fā)的情況下,哪怕是你在代碼中已經(jīng)做了非常嚴格的校驗,例如插入數(shù)據(jù)前判斷要保存的數(shù)據(jù)是否已經(jīng)存在,但仍然有可能會出現(xiàn)數(shù)據(jù)被重復保存的風險。因為在異步執(zhí)行中,你沒有辦法保證哪個線程先執(zhí)行,哪個線程后執(zhí)行,客戶端發(fā)起的所有請求并非按我們想象的都是順序執(zhí)行的。一個較好的解決辦法是在Mongo數(shù)據(jù)庫的所有表中創(chuàng)建唯一索引。事實上,MongoDB默認會為所有表創(chuàng)建一個_id字段的唯一索引(可以取消)。如果你想在Node.js中通過mongoose.schema來自動創(chuàng)建索引,可以參考下面的代碼:

var mongoose = require('mongoose');var Schema = mongoose.Schema;var customerSchema = new mongoose.Schema({cname: String,cellPhone, String,sender: String,tag: String,behaviour: Number,createTime: {type: Date,default: Date.now},current:{type: Boolean,default: true}}, {versionKey: false});customerSchema.index({cname:1,cellPhone:1,sender:1,tag:1,behaviour:1}, {unique: true});module.exports = mongoose.model('customer', customerSchema); 

  上面的model中我們定義了表customer的結(jié)構(gòu),并通過index()方法在字段cname,cellPhone,sender,tag,behaviour上創(chuàng)建了唯一索引,這樣當包含這些字段的重復數(shù)據(jù)被插入時,數(shù)據(jù)庫會拋出異常。借用mongoose,如果數(shù)據(jù)庫表之前已經(jīng)被創(chuàng)建并且程序正在運行中,當我們修改model并添加索引,然后重新啟動app,只要有對該model的訪問,mongoose會自動進行檢測并創(chuàng)建索引。當然,如果數(shù)據(jù)出現(xiàn)重復,則索引創(chuàng)建會失敗。此時我們可以通過在創(chuàng)建索引時添加dropDups選項,讓數(shù)據(jù)庫自動將重復的數(shù)據(jù)刪除,如:

customerSchema.index({cname:1,cellPhone:1,sender:1,tag:1,behaviour:1}, {unique: true, dropDups: true});

  不過據(jù)MongoDB的官方說明,自3.0以后的版本不再使用該選項,而且也并沒有提供替代的解決辦法。貌似官方不再提供創(chuàng)建索引時自動刪除重復記錄的功能。那如何才能快速有效地找出重復的記錄并且刪除呢?首先我們要找出這些記錄,然后通過remove()方法進行刪除。下面的查詢語句可以找出給定字段有重復數(shù)據(jù)的記錄:

db.collection.aggregate([{ $group: { _id: { firstField: "$firstField", secondField: "$secondField" }, uniqueIds: { $addToSet: "$_id" },count: { $sum: 1 } }}, { $match: { count: { $gt: 1 } }}]) 

  替換_id屬性的值以指定你想要進行判斷的字段。相應(yīng)地,在Node.js中代碼如下:

var deferred = Q.defer();var group = { firstField: "$firstField", secondField: "$secondField"};model.aggregate().group({_id: group,uniqueIds: {$addToSet: '$_id'},count: {$sum: 1}}).match({ count: {$gt: 1}}).exec(deferred.makeNodeResolver());return deferred.promise; 

上述代碼使用了Q來替換函數(shù)執(zhí)行中的回調(diào)。在Node.js的異步編程中,使用Q來處理回調(diào)是個不錯的選擇。

  下面是返回的結(jié)果:

/* 1 */{"result" : [ {"_id" : {"cellPhone" : "15827577345","actId" : ObjectId("5694565fa50fea7705f01789")},"uniqueIds" : [ ObjectId("569b5d03b3d206f709f97685"), ObjectId("569b5d01b3d206f709f97684")],"count" : 2.0000000000000000}, {"_id" : {"cellPhone" : "18171282716","actId" : ObjectId("566b0d8dc02f61ae18e68e48")},"uniqueIds" : [ ObjectId("566d16e6cf86d12d1abcee8b"), ObjectId("566d16e6cf86d12d1abcee8a")],"count" : 2.0000000000000000}],"ok" : 1.0000000000000000}

  從結(jié)果中可以看到,一共有兩組數(shù)據(jù)相同的記錄,所以返回的result數(shù)組的長度為2。uniqueIds屬性為一個數(shù)組,其中存放了重復記錄的_id字段的值,通過該值我們可以使用remove()方法來查找并刪除對應(yīng)的數(shù)據(jù)。



注:相關(guān)教程知識閱讀請移步到MongoDB頻道。
發(fā)表評論 共有條評論
用戶名: 密碼:
驗證碼: 匿名發(fā)表
主站蜘蛛池模板: 新河县| 花垣县| 金阳县| 景谷| 神池县| 丹东市| 屯门区| 塔城市| 江源县| 凉城县| 华坪县| 鹤庆县| 云梦县| 大洼县| 伊宁市| 宁化县| 祁门县| 孟村| 贵州省| 清远市| 卢龙县| 林周县| 海南省| 赤壁市| 洛扎县| 天津市| 唐河县| 湘潭县| 祥云县| 塔城市| 天峨县| 富顺县| 富蕴县| 天水市| 易门县| 富阳市| 巴彦淖尔市| 丰宁| 井陉县| 乐都县| 凤山县|