亚洲综合中文字幕国产精品欧美,少妇久久久久久人妻无码,三年片在线观看免费观看高清电影

主頁 > 知識庫 > 使用aggregate在MongoDB中查詢重復(fù)數(shù)據(jù)記錄的方法

使用aggregate在MongoDB中查詢重復(fù)數(shù)據(jù)記錄的方法

MongoDB中聚合(aggregate)主要用于處理數(shù)據(jù)(諸如統(tǒng)計平均值,求和等)，并返回計算后的數(shù)據(jù)結(jié)果。有點類似sql語句中的 count(*)。

aggregate() 方法

MongoDB中聚合的方法使用aggregate()。

語法

aggregate() 方法的基本語法格式如下所示：

>db.COLLECTION_NAME.aggregate(AGGREGATE_OPERATION)

我們知道，MongoDB屬于文檔型數(shù)據(jù)庫，其存儲的文檔類型都是JSON對象。正是由于這一特性，我們在Node.js中會經(jīng)常使用MongoDB進(jìn)行數(shù)據(jù)的存取。但由于Node.js是異步執(zhí)行的，這就導(dǎo)致我們無法保證每一次的數(shù)據(jù)庫save操作都是原子型的。也就是說，如果客戶端連續(xù)兩次發(fā)起同一事件將數(shù)據(jù)存入數(shù)據(jù)庫，很可能會導(dǎo)致數(shù)據(jù)被重復(fù)保存。高并發(fā)的情況下，哪怕是你在代碼中已經(jīng)做了非常嚴(yán)格的校驗，例如插入數(shù)據(jù)前判斷要保存的數(shù)據(jù)是否已經(jīng)存在，但仍然有可能會出現(xiàn)數(shù)據(jù)被重復(fù)保存的風(fēng)險。因為在異步執(zhí)行中，你沒有辦法保證哪個線程先執(zhí)行，哪個線程后執(zhí)行，客戶端發(fā)起的所有請求并非按我們想象的都是順序執(zhí)行的。一個較好的解決辦法是在Mongo數(shù)據(jù)庫的所有表中創(chuàng)建唯一索引。事實上，MongoDB默認(rèn)會為所有表創(chuàng)建一個_id字段的唯一索引（可以取消）。如果你想在Node.js中通過mongoose.schema來自動創(chuàng)建索引，可以參考下面的代碼：

var mongoose = require('mongoose');
var Schema = mongoose.Schema;
var customerSchema = new mongoose.Schema({
cname: String,
cellPhone, String,
sender: String,
tag: String,
behaviour: Number,
createTime: {
type: Date,
default: Date.now
},
current:{
type: Boolean,
default: true
}
}, {
versionKey: false
});
customerSchema.index({cname:1,cellPhone:1,sender:1,tag:1,behaviour:1}, {unique: true});module.exports = mongoose.model('customer', customerSchema);

　　上面的model中我們定義了表customer的結(jié)構(gòu)，并通過index()方法在字段cname，cellPhone，sender，tag，behaviour上創(chuàng)建了唯一索引，這樣當(dāng)包含這些字段的重復(fù)數(shù)據(jù)被插入時，數(shù)據(jù)庫會拋出異常。借用mongoose，如果數(shù)據(jù)庫表之前已經(jīng)被創(chuàng)建并且程序正在運行中，當(dāng)我們修改model并添加索引，然后重新啟動app，只要有對該model的訪問，mongoose會自動進(jìn)行檢測并創(chuàng)建索引。當(dāng)然，如果數(shù)據(jù)出現(xiàn)重復(fù)，則索引創(chuàng)建會失敗。此時我們可以通過在創(chuàng)建索引時添加dropDups選項，讓數(shù)據(jù)庫自動將重復(fù)的數(shù)據(jù)刪除，如：

customerSchema.index({cname:1,cellPhone:1,sender:1,tag:1,behaviour:1}, {unique: true, dropDups: true});

　　不過據(jù)MongoDB的官方說明，自3.0以后的版本不再使用該選項，而且也并沒有提供替代的解決辦法。貌似官方不再提供創(chuàng)建索引時自動刪除重復(fù)記錄的功能。那如何才能快速有效地找出重復(fù)的記錄并且刪除呢？首先我們要找出這些記錄，然后通過remove()方法進(jìn)行刪除。下面的查詢語句可以找出給定字段有重復(fù)數(shù)據(jù)的記錄：

db.collection.aggregate([
{ $group: { 
_id: { firstField: "$firstField", secondField: "$secondField" }, 
uniqueIds: { $addToSet: "$_id" },
count: { $sum: 1 } 
}}, 
{ $match: { 
count: { $gt: 1 } 
}}
])

　　替換_id屬性的值以指定你想要進(jìn)行判斷的字段。相應(yīng)地，在Node.js中代碼如下：

var deferred = Q.defer();
var group = { firstField: "$firstField", secondField: "$secondField"};
model.aggregate().group({
_id: group,
uniqueIds: {$addToSet: '$_id'},
count: {$sum: 1}
}).match({ count: {$gt: 1}}).exec(deferred.makeNodeResolver());
return deferred.promise;

上述代碼使用了Q來替換函數(shù)執(zhí)行中的回調(diào)。在Node.js的異步編程中，使用Q來處理回調(diào)是個不錯的選擇。

　　下面是返回的結(jié)果：

/* 1 */
{
"result" : [ 
{
"_id" : {
"cellPhone" : "15827577345",
"actId" : ObjectId("5694565fa50fea7705f01789")
},
"uniqueIds" : [ 
ObjectId("569b5d03b3d206f709f97685"), 
ObjectId("569b5d01b3d206f709f97684")
],
"count" : 2.0000000000000000
}, 
{
"_id" : {
"cellPhone" : "18171282716",
"actId" : ObjectId("566b0d8dc02f61ae18e68e48")
},
"uniqueIds" : [ 
ObjectId("566d16e6cf86d12d1abcee8b"), 
ObjectId("566d16e6cf86d12d1abcee8a")
],
"count" : 2.0000000000000000
}
],
"ok" : 1.0000000000000000
}

　　從結(jié)果中可以看到，一共有兩組數(shù)據(jù)相同的記錄，所以返回的result數(shù)組的長度為2。uniqueIds屬性為一個數(shù)組，其中存放了重復(fù)記錄的_id字段的值，通過該值我們可以使用remove()方法來查找并刪除對應(yīng)的數(shù)據(jù)。

您可能感興趣的文章:

MongoDB aggregate 運用篇個人總結(jié)
Mongodb在CSharp里實現(xiàn)Aggregate實例
nodejs+mongodb aggregate級聯(lián)查詢操作示例
mongodb中非常好用的Aggregate入門教程

標(biāo)簽：丹東吉安景德鎮(zhèn) 邯鄲本溪大理鶴崗昭通

巨人網(wǎng)絡(luò)通訊聲明：本文標(biāo)題《使用aggregate在MongoDB中查詢重復(fù)數(shù)據(jù)記錄的方法》，本文關(guān)鍵詞使用,aggregate,在,MongoDB,中,；如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題，煩請?zhí)峁┫嚓P(guān)信息告之我們，我們將及時溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò)，涉及言論、版權(quán)與本站無關(guān)。