strivezr 2017-08-05 05:48 采纳率: 0%
浏览 8908

python爬虫xpath选择多个属性

python爬虫我需要获取商品的产地,

tree.xpath(
"//div[@class='p-parameter']/ul[@class='parameter2 p-parameter-list']/li[4]/text()")
这样写是没问题的,但是如果到了下一个产品,产地就可能不是在第四个位置了,可能在第三个位置了,所以按照这个xpath写法,获取的可能就不是产地了,这要如何解决呢?而且这个title会根据商品的不同一直变化的

目前我想到的可能的解决方案:

1.我查了半天,看下xpath能否支持通配符的匹配。

tree.xpath(
"//div[@class='p-parameter']/ul[@class='parameter2 p-parameter-list']/li[@title='*省*]/text()")
以上操作不行,本意是为了让xpath查找所有的title里是否有包含‘省’的title,如果有,就提取text()文件

2.更笨的办法,把所有的省市都列举出来,用“|”符号,这样实在太麻烦了,而且我不知道到底有多少个省市

所以想问下有没有其他的解决方法?

Python

  • 写回答

2条回答 默认 最新

  • oyljerry 2017-08-05 07:30
    关注

    tree.xpath(
    "//div[@class='p-parameter']/ul[@class='parameter2 p-parameter-list']

    先到这一层,然后根据条件判断,再决定下一层的数据获取

    评论

报告相同问题?

悬赏问题

  • ¥15 matlab实现基于主成分变换的图像融合。
  • ¥15 对于相关问题的求解与代码
  • ¥15 ubuntu子系统密码忘记
  • ¥15 信号傅里叶变换在matlab上遇到的小问题请求帮助
  • ¥15 保护模式-系统加载-段寄存器
  • ¥15 电脑桌面设定一个区域禁止鼠标操作
  • ¥15 求NPF226060磁芯的详细资料
  • ¥15 使用R语言marginaleffects包进行边际效应图绘制
  • ¥20 usb设备兼容性问题
  • ¥15 错误(10048): “调用exui内部功能”库命令的参数“参数4”不能接受空数据。怎么解决啊