Doria_yyy 2021-11-28 09:52 采纳率: 33.3%
浏览 53
已结题

python3爬虫,用正则怎么把重复标签下的内容分别拿出来?

python爬虫(pycharm),用的正则。怎么把重复标签下的内容分别拿出来
re.findall(r'.*?[2]', target_r.text) 我这样写返回来一个空表
[]

img

  • 写回答

2条回答 默认 最新

  • CSDN专家-HGJ 2021-11-28 11:27
    关注
    #使用正则 '<td>(.*)</td>',即可获取所有td标签下的文本内容。
    import requests
    import re
    url='http://cba.sports.sina.com.cn/cba/stats/teamrank/'
    res=requests.get(url)
    res.encoding=res.apparent_encoding
    result=re.findall('<td>(.*)</td>',res.text)
    print(result)
    
    #['1', '12', '1', '92.30%', '6胜0负', '6胜1负', '107.69', '92.77', '2', '11', '2', '84.60%', '5胜1负', '6胜1负', '101.62',...
    
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论 编辑记录
查看更多回答(1条)

报告相同问题?

问题事件

  • 系统已结题 12月6日
  • 已采纳回答 11月28日
  • 创建了问题 11月28日

悬赏问题

  • ¥100 嵌入式系统基于PIC16F882和热敏电阻的数字温度计
  • ¥20 BAPI_PR_CHANGE how to add account assignment information for service line
  • ¥500 火焰左右视图、视差(基于双目相机)
  • ¥100 set_link_state
  • ¥15 虚幻5 UE美术毛发渲染
  • ¥15 CVRP 图论 物流运输优化
  • ¥15 Tableau online 嵌入ppt失败
  • ¥100 支付宝网页转账系统不识别账号
  • ¥15 基于单片机的靶位控制系统
  • ¥15 真我手机蓝牙传输进度消息被关闭了,怎么打开?(关键词-消息通知)