今天持久男 在抓取数据的时候发现很多内容都加了锚文本, 这怎么办呢? 没办法只能通过工具解决

我是这样解决的:

 

例如:

 

soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') 
for a in soup.findAll('a'):
 del a['href'] 
 print (soup) 

结果:
<p>Hello <a>Google</a></p>

  

成功了.

 

相关文章: