摘要: C#特别适合于构造蜘蛛程序,这是因为它已经内置了HTTP访问和多线程的能力,而这两种能力对于蜘蛛程序来说都是非常关键的。下面是构造一个蜘蛛程序要解决的关键问题:  ⑴ HTML分析:需要某种HTML解析器来分析蜘蛛程序遇到的每一个页面。  ⑵ 页面处理:需要处理每一个下载得到的页面。下载得到的内容可能要保存到磁盘,或者进一步分析处理。  ⑶ 多线程:只有拥有多线... 阅读全文
posted @ 2009-11-19 08:35 Hellen.Li 阅读(238) 评论(0) 推荐(0) 编辑