今天持久男 在抓取数据的时候发现很多内容都加了锚文本, 这怎么办呢? 没办法只能通过工具解决
我是这样解决的:
例如:
soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') for a in soup.findAll('a'): del a['href'] print (soup) 结果: <p>Hello <a>Google</a></p>
成功了.
今天持久男 在抓取数据的时候发现很多内容都加了锚文本, 这怎么办呢? 没办法只能通过工具解决
我是这样解决的:
例如:
soup = BeautifulSoup('<p>Hello <a href="http://google.com">Google</a></p>') for a in soup.findAll('a'): del a['href'] print (soup) 结果: <p>Hello <a>Google</a></p>
成功了.
转载于:https://www.cnblogs.com/chaoren399/p/9554713.html