今天持久男 在抓取数据的时候发现不少内容都加了锚文本, 这怎么办呢? 没办法只能经过工具解决工具
我是这样解决的:google
例如:spa
soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') for a in soup.findAll('a'): del a['href'] print (soup) 结果: <p>Hello <a>Google</a></p>
成功了.code