使用requests和bs4库 静态爬取页面2017年数据 Soup获得部分源码如图 对应网页源码如图 可见,该tr中第一个<td>1</td>;在Soup中变成了<td>1<td> ,而末尾处也多了一个</td> 该问题发生在每一个tr中,但爬取2016年数据并没有出现该问题。 代码照抄教程,应该不存在问题
收起
网页中有js脚本的话,可以在下载网页后动态修改/添加网页本身,也就是ajax
报告相同问题?