sinat_38823778 2017-05-17 07:05 采纳率: 0%
浏览 3198

[python]BeautifulSoup4爬虫解析网页中data-*标签的问题

图片说明
我想要解析出图中的链接,通过先识别 li 定位。可是查看soup的文本,所有data-* 都没有解析出来
代码如下

 keywords = input('输入关键词PLZ')
res = requests.get('https://www.bing.com/search?q='+str(keywords)+'&qs=n&form=QBLH&scope=web&sp=-1&pq=abc&sc=8-5&sk=&cvid=3FE7B447AE744DD1AF25B5919EE1B675')
try:
    res.raise_for_status()
except Exception as ecp:
    print('There is an Exception:',ecp)

soup = bs4.BeautifulSoup(res.text,'html.parser')
ol = soup.find('ol',id='b_results')
linkElement = soup.find_all(attrs={'data-bm':'7'})

结果linkElement为空

  • 写回答

2条回答 默认 最新

  • oyljerry 2017-05-17 08:26
    关注

    先看你的soup 中拿到了什么数据,怀疑API返回的内容是异步的,你没有拿到网页的内容。如果这样,你需要用selenium等webdriver方式去拿页面内容

    评论

报告相同问题?

悬赏问题

  • ¥100 Jenkins自动化部署—悬赏100元
  • ¥15 关于#python#的问题:求帮写python代码
  • ¥20 MATLAB画图图形出现上下震荡的线条
  • ¥15 关于#windows#的问题:怎么用WIN 11系统的电脑 克隆WIN NT3.51-4.0系统的硬盘
  • ¥15 perl MISA分析p3_in脚本出错
  • ¥15 k8s部署jupyterlab,jupyterlab保存不了文件
  • ¥15 ubuntu虚拟机打包apk错误
  • ¥199 rust编程架构设计的方案 有偿
  • ¥15 回答4f系统的像差计算
  • ¥15 java如何提取出pdf里的文字?