python 去除html 超链接href 如何实现?

今天持久男 在抓取数据的时候发现很多内容都加了锚文本, 这怎么办呢? 没办法只能通过工具解决

我是这样解决的:

 

例如:

 

soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') 
for a in soup.findAll('a'):
 del a['href'] 
 print (soup) 

结果:
<p>Hello <a>Google</a></p>

  

成功了.

 

posted @ 2018-08-29 15:38  农民阿姨  阅读(1682)  评论(0编辑  收藏  举报