如何将 MongoDB MapReduce 速度提升 20 倍

 我来答

1个回答

#热议# 应届生在签三方时要注意什么？

day忘不掉的痛
2015-05-19 · 知道合伙人数码行家

day忘不掉的痛
知道合伙人数码行家

采纳数：62646 获赞数：223939

本人担任公司网络部总经理多年，有充足的网络经验、互联网相关知识和资讯。

向TA提问私信TA

关注

展开全部

MongoDB对单独的MR作业并不使用多线程——它仅仅对多作业使用多线程。但通过多核CPU，在单个服务器使用Hadoop风格来并行作业非常有优势。我们需要做的是把输入分成几块，通过各个块来加速一个MR作业。也许数据集有简单的方法来分割，但其他使用splitVector命令（不明确）可以使你很快的找到分割点：
> db.runCommand({splitVector: "test.uniques", keyPattern: {dim0: 1}, maxChunkSizeBytes: 32000000})

{
"timeMillis" : 6006,
"splitKeys" : [
{
"dim0" : 18171
},
{
"dim0" : 36378
},
{
"dim0" : 54528
},
{
"dim0" : 72717
},
…
{
"dim0" : 963598
},
{
"dim0" : 981805
}
],
"ok" : 1
}

已赞过 已踩过<

评论收起

推荐律师服务：若未解决您的问题，请您详细描述您的问题，通过百度律临进行免费专业咨询

如何将 MongoDB MapReduce 速度提升 20 倍

其他类似问题

为你推荐：