摘要: lmth1 一个便捷的网页信息提取工具0, Why lmth1?玩Python的人十有八九用过urllib,扒数据的十有八九用过BeautifulSoup。我也不例外,平时抓数据几乎全用BeautifulSoup。BeautifulSoup的功能挺不错,但就是API挫了点,用起来不顺。相对于中规中矩的API,我更中意jQuery的Fluent API。所以,花了两个晚上,以BeautifulSoup作为基础,搞了两个库lmth和lmth1:lmth提供基本功能,并负责Hpath解析;lmth1提供Fluent API,进行数据抓取。lmth1的接口非常简单,它的实现更简单——不超过300行代码 阅读全文
posted @ 2012-02-15 22:03 _Luc_ 阅读(9375) 评论(4) 推荐(6) 编辑