如何用火车头采集当前页面url网址

首先创建一个标签为本文网址,勾选后面的“从网址中采集”。
选择下面的“正则提取”,点击通配符“(?<content>?)”,这样在窗口中就显示为(?<content>[\s\S]*?)
我们再在它前加一个与字符串开始的地方匹配的符号^,又在它后面加一个与字符串结束的地方匹配的符号$,这样就变成了^(?<content>[\s\S]*?)$。如图:火车头采集文章url网址

Content  代表内容
?  表示匹配0次或者1次
\s  匹配所有空白字符
\S  匹配所有非空白字符
*  修饰匹配次数为 0 次或任意次

posted @ 2013-12-18 15:42  ytkah  阅读(5800)  评论(1编辑  收藏  举报
IPO发家故事 网址导航 gg N / G Sitemap

部分内容来源于网络,如有版权问题请联系删除