用正则表达式自动下载网页中的图片

首先获得网页的Html代码,然后用正则表达式分析其中图片的下载地址,最后自动逐个下载。

Code

Html部分代码如下:
Html code

要用正则表达式从中获得图片下载地址(例如:/docfile/dyn/12345678LANGCCCCDDDDEEEEEEEERT09)和图片名称(例如:BMW 3-series

正则表达式部分如下:
Regular expression

注意其中group的用法(? *?),和引号的匹配用法,匹配双引号前面需要再带一个双引号。其中Uri这个group在dyn/后面,直到双引号结束;后面跟随着双引号和>,然后就是Name这个group;它以<号结束,最后跟随</dt>。

posted on 2008-03-01 20:28  Mainz  阅读(1322)  评论(1编辑  收藏  举报

导航