AlphaCats 2021-05-09 14:36 采纳率: 62.5%
浏览 283
已结题

python爬虫 爬取百度文库

百度文库只能爬取到第一页,第二页的内容在Network中找不到

url:https://wenku.baidu.com/view/609b5c42daef5ef7bb0d3c3c.html

我用的python3

import requests
from bs4 import BeautifulSoup

headers = {'User-Agent':'Googlebot'}
url = str(input('url:    '))

res = requests.get(url,headers=headers)
bea = BeautifulSoup(res.text,'html.parser')
bea = bea.find_all('div',id='pageNo-2')
print(bea)


  • 写回答

4条回答 默认 最新

  • CSDN专家-黄老师 2021-05-10 10:14
    关注

    Network中找不到试试在doc里面能不能找到

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(3条)

报告相同问题?

问题事件

  • 系统已结题 10月29日
  • 已采纳回答 10月21日

悬赏问题

  • ¥15 AIC3204的示例代码有吗,想用AIC3204测量血氧,找不到相关的代码。
  • ¥20 CST怎么把天线放在座椅环境中并仿真
  • ¥15 任务A:大数据平台搭建(容器环境)怎么做呢?
  • ¥15 YOLOv8obb获取边框坐标时报错AttributeError: 'NoneType' object has no attribute 'xywhr'
  • ¥15 r语言神经网络自变量重要性分析
  • ¥15 基于双目测规则物体尺寸
  • ¥15 wegame打不开英雄联盟
  • ¥15 公司的电脑,win10系统自带远程协助,访问家里个人电脑,提示出现内部错误,各种常规的设置都已经尝试,感觉公司对此功能进行了限制(我们是集团公司)
  • ¥15 救!ENVI5.6深度学习初始化模型报错怎么办?
  • ¥30 eclipse开启服务后,网页无法打开