imyianswer 2020-11-13 11:01 采纳率: 50%
浏览 17

请教Python xpath 定位抓取信息问题

本人新手,想用python 抓取目标网站的认沽/认购信息,代码如下:

import requests
from lxml import etree
#1.将目标网页的数据抓取下来
headers = {
           'User-Agent':"Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:82.0) Gecko/20100101 Firefox/82.0"
           }
url ='http://www.sse.com.cn/assortment/options/date/'
resp = requests.get(url,headers=headers)
text = resp.text
#print(text)
#movies = []
#2.讲抓取下来的数据按一定规则进行提取
#print(resp.text)

html = etree.HTML(text)
ul = html.xpath("//div[@class='align_right']/text()")
#for i in ul:
print(ul)  

结果如下:

runfile('E:/Py file/practice/未命名0.py', wdir='E:/Py file/practice')
[]

显示没有,但我用Chrome 的 xpath helper却能查到好几个,请问应该如何解决,信息

 

  • 写回答

2条回答 默认 最新

  • LC1356 2020-11-13 21:13
    关注

    抓取的网页内容正常吗?一般直接右键获取xpath路径即可,而且网页有反爬虫行为,先确认你的网页爬取成功了。

    评论

报告相同问题?

悬赏问题

  • ¥50 如何用脚本实现输入法的热键设置
  • ¥20 我想使用一些网络协议或者部分协议也行,主要想实现类似于traceroute的一定步长内的路由拓扑功能
  • ¥30 深度学习,前后端连接
  • ¥15 孟德尔随机化结果不一致
  • ¥15 apm2.8飞控罗盘bad health,加速度计校准失败
  • ¥15 求解O-S方程的特征值问题给出边界层布拉休斯平行流的中性曲线
  • ¥15 谁有desed数据集呀
  • ¥20 手写数字识别运行c仿真时,程序报错错误代码sim211-100
  • ¥15 关于#hadoop#的问题
  • ¥15 (标签-Python|关键词-socket)