摘要: 转自:兵马俑BBS http://bbs.xjtu.edu.cn 发信人: appsony (懒羊羊), 信区: Algorithm 标  题: 跟风发点补充的--大数据处理 发信站: 兵... 阅读全文
posted @ 2010-07-24 11:34 Chevalier 阅读(1401) 评论(0) 推荐(0) 编辑
摘要: 转自:http://bbs.xjtu.edu.cn 作者phylips@bmy   大数据量的问题是很多面试笔试中经常出现的问题,比如baidu google 腾讯 这样的一些涉及到海... 阅读全文
posted @ 2010-07-24 11:28 Chevalier 阅读(1252) 评论(0) 推荐(0) 编辑
摘要: 作者:小橋流水 来源:博客园 时间:2010-07-20 阅读:149 次 原文链接 [收藏]1. 给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url?方案1:可以估计每个文件安的大小为50G×64=320G,远远大于内存限制的4G。所以不可能将其完全加载到内存中处理。考虑采取分而治之的方法。s 遍历文件a,对每个url求取... 阅读全文
posted @ 2010-07-24 11:21 Chevalier 阅读(340) 评论(0) 推荐(0) 编辑