2020年8月1日

2020暑假第5周

摘要: 这周学习了Hadoop的相关知识。 Hadoop最早起源于Nutch。Nutch的设计目标是构建一个大型的全网搜索引擎,包括网页抓取、索引、查询等功能,但随着抓取网页数量的增加,遇到了严重的可扩展性问题——如何解决数十亿网页的存储和索引问题。可行的解决方案有分布式文件系统和分布式计算框架,Nutch 阅读全文

posted @ 2020-08-01 19:46 FF冯静妃 阅读(72) 评论(0) 推荐(0) 编辑

导航