用python爬取房天下的详情页,但是只有物业类别可以爬出来,其他均为空
2条回答 默认 最新
- CSDN专家-showbo 2022-03-08 09:03关注
第二个li的div下少了结束标签导致etree解析出错了
少了div结束标签后,etree将建筑类别后的几点全部归类到第二li下了,改下面这样就可以了import requests from lxml import etree from lxml import html url="https://wuxi.newhouse.fang.com/loupan/1821129836/housedetail.htm" headers={'user-agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/98.0.4758.102 Safari/537.36'} html=requests.get(url,headers=headers).text tree=etree.HTML(html) print(tree.xpath('/html/body/div[5]/div[5]/div/div[1]/div[1]/ul/li[1]/div[2]/a/text()')) print(tree.xpath('/html/body/div[5]/div[5]/div/div[1]/div[1]/ul/li[2]/div[2]/li[1]/div[2]/span/a/text()'))
这种不规则的html代码建议用正则或者bs4来解析。
本回答被题主选为最佳回答 , 对您是否有帮助呢?解决 2无用
悬赏问题
- ¥15 关于#python#的问题:求帮写python代码
- ¥20 MATLAB画图图形出现上下震荡的线条
- ¥15 LiBeAs的带隙等于0.997eV,计算阴离子的N和P
- ¥15 关于#windows#的问题:怎么用WIN 11系统的电脑 克隆WIN NT3.51-4.0系统的硬盘
- ¥15 来真人,不要ai!matlab有关常微分方程的问题求解决,
- ¥15 perl MISA分析p3_in脚本出错
- ¥15 k8s部署jupyterlab,jupyterlab保存不了文件
- ¥15 ubuntu虚拟机打包apk错误
- ¥199 rust编程架构设计的方案 有偿
- ¥15 回答4f系统的像差计算