qq_40866353 2021-06-08 18:01 采纳率: 100%
浏览 81
已采纳

爬取豆瓣电影top250最后只保留了一行数据,代码没出错

import requests

from lxml import etree

import time

for a in range(10):

 

    url= "https://movie.douban.com/top250?start={}&filter=".format(a*25)

headers = {

'User-Agent':

    'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3870.400 QQBrowser/10.8.4405.400'

 

}

response= requests.get(url,headers=headers).text

#print(response.text)

#第二步,通过Xpath来获得有效信息

html= etree.HTML(response)

 

lis = html.xpath('/html/body/div[3]/div[1]/div/div[1]/ol/li')

for li in lis :

    title = li.xpath("./div/div[2]/div[1]/a/span[1]/text()")[0]

    rating_num = li.xpath("./div/div[2]/div[2]/div/span[2]/text()")[0]

    pj= li.xpath("./div/div[2]/div[2]/div/span[4]/text()")[0]

    href = li.xpath("./div/div[2]/div[1]/a/@href")[0]

    #print(title,rating_num,pj,href)

    time.sleep(0.5)

#保存数据

with open(r"书单",'a+',encoding="utf-8")as f:

    f.write("{},{},{},{}".format(title,rating_num,pj

,href))

    f.write("\n")

  • 写回答

3条回答 默认 最新

  • CSDN专家-HGJ 2021-06-08 18:42
    关注

    #保存数据

    with open(r"书单",'a+',encoding="utf-8")as f:

        f.write("{},{},{},{}".format(title,rating_num,pj,href))

        f.write("\n")

    这段代码不要写在在循环外,要缩进到for li in lis的循环里。

     

    如有帮助请点击采纳。

     

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

悬赏问题

  • ¥15 微信小程序协议怎么写
  • ¥15 c语言怎么用printf(“\b \b”)与getch()实现黑框里写入与删除?
  • ¥20 怎么用dlib库的算法识别小麦病虫害
  • ¥15 华为ensp模拟器中S5700交换机在配置过程中老是反复重启
  • ¥15 java写代码遇到问题,求帮助
  • ¥15 uniapp uview http 如何实现统一的请求异常信息提示?
  • ¥15 有了解d3和topogram.js库的吗?有偿请教
  • ¥100 任意维数的K均值聚类
  • ¥15 stamps做sbas-insar,时序沉降图怎么画
  • ¥15 买了个传感器,根据商家发的代码和步骤使用但是代码报错了不会改,有没有人可以看看