python 去除html 超链接href 如何实现?
今天持久男 在抓取数据的时候发现很多内容都加了锚文本, 这怎么办呢? 没办法只能通过工具解决
我是这样解决的:
例如:
soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') for a in soup.findAll('a'): del a['href'] print (soup) 结果: <p>Hello <a>Google</a></p>
成功了.
岁月里,寒暑交替。人世间,北来南往。铭心的,云烟的。都付往事,不念,不问。