cyj2020014009 2023-02-12 21:37 采纳率: 100%
浏览 20
已结题

xpath获取数据时的一个问题

# 使用xpath去获取猪八戒网上的信息
# 获取页面源代码
url = 'https://jiangmen.zbj.com/search/service/?l=0&kw=saas&r=2'
resp = requests.get(url)
html = resp.text
resp.close()

# 用xpath去解析页面源代码
tree = etree.HTML(html)
a = tree.xpath('/html/body/div[2]/div/div/div[3]/div/div[4]/div[4]/div[1]/div[1]/div/div[3]/div[1]/span/text()')
print(a)
b = tree.xpath('//*[@id="__layout"]/div/div[3]/div/div[4]/div[4]/div[1]/div[1]/div/div[3]/div[1]/span/text()')
print(b)

运行结果:
[]
['¥500']
我遇到了一个使用xpath的问题,上面的a中的xpath是我用开发者工具使用 Copy full xpath得到的位置,我一一对应了一下,是没有错误的,但是运行的结果是一个空列表,而b是我用开发者工具中的copy xpath得到的位置,运行结果是正确的,我想不明白这是为什么?绞尽脑汁都想不明白,谢谢!

  • 写回答

3条回答 默认 最新

  • 威震四海 2023-02-13 10:54
    关注

    最好不要用全路径,路径写的越长月容易出错,页面经过浏览器渲染会增加一些诸如tbody的标签,而代码请求的相应中不一定会有,因此建议尽量简化xpath路径,我的宗旨是:在能准确定位的基础上,路径越短越好

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

问题事件

  • 系统已结题 2月21日
  • 已采纳回答 2月13日
  • 创建了问题 2月12日

悬赏问题

  • ¥15 在若依框架下实现人脸识别
  • ¥15 网络科学导论,网络控制
  • ¥100 安卓tv程序连接SQLSERVER2008问题
  • ¥15 利用Sentinel-2和Landsat8做一个水库的长时序NDVI的对比,为什么Snetinel-2计算的结果最小值特别小,而Lansat8就很平均
  • ¥15 metadata提取的PDF元数据,如何转换为一个Excel
  • ¥15 关于arduino编程toCharArray()函数的使用
  • ¥100 vc++混合CEF采用CLR方式编译报错
  • ¥15 coze 的插件输入飞书多维表格 app_token 后一直显示错误,如何解决?
  • ¥15 vite+vue3+plyr播放本地public文件夹下视频无法加载
  • ¥15 c#逐行读取txt文本,但是每一行里面数据之间空格数量不同