xzajyjs 2021-12-25 14:09 采纳率: 100%
浏览 198
已结题

Xpath无法定位含a标签的span中的任意元素

成功定位到span标签

download = new_html.xpath('//*[@id="Zoom"]/span')
print(download)
output:[<Element span at 0x7fa9370bae80>]

但是如果这个span中包裹了a标签,就什么都无法匹配了

download = new_html.xpath('//*[@id="Zoom"]/span/a/@href')
print(download)
output: []

源码是这样的

<span>
    <img src="xxx" alt="xxx">
    For test.
    <br />
    For test.
    <br />
    <a target="_blank" href="abcabc">click on me.</a>   
</span>

请问我如果想用xpath拿到这个span中的a的href值该怎么办呢

  • 写回答

1条回答 默认 最新

  • chuifengde 2021-12-25 14:34
    关注
    from lxml import etree
    
    con = """<html>
    <body><span>
        <img src="xxx" alt="xxx">
        For test.
        <br />
        For test.
        <br />
        <a target="_blank" href="abcabc">click on me.</a>   
    </span>
    </body>
    </html>"""
    
    tree = etree.HTML(con)
    download = tree.xpath('//span/a/@href')
    print(download)
    
    '''--result
    ['abcabc']
    '''
    
    
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论

报告相同问题?

问题事件

  • 已结题 (查看结题原因) 12月31日
  • 已采纳回答 12月25日
  • 创建了问题 12月25日

悬赏问题

  • ¥17 pro*C预编译“闪回查询”报错SCN不能识别
  • ¥15 微信会员卡接入微信支付商户号收款
  • ¥15 如何获取烟草零售终端数据
  • ¥15 数学建模招标中位数问题
  • ¥15 phython路径名过长报错 不知道什么问题
  • ¥15 深度学习中模型转换该怎么实现
  • ¥15 HLs设计手写数字识别程序编译通不过
  • ¥15 Stata外部命令安装问题求帮助!
  • ¥15 从键盘随机输入A-H中的一串字符串,用七段数码管方法进行绘制。提交代码及运行截图。
  • ¥15 TYPCE母转母,插入认方向