python 去除html 超连接href 如何实现?

今天持久男 在抓取数据的时候发现不少内容都加了锚文本, 这怎么办呢? 没办法只能经过工具解决工具

我是这样解决的:google

 

例如:spa

 

soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') 
for a in soup.findAll('a'):
 del a['href'] 
 print (soup) 

结果:
<p>Hello <a>Google</a></p>

  

成功了.code

相关文章
相关标签/搜索