海蓝色。 2022-05-12 22:09 采纳率: 89.7%
浏览 73
已结题

python爬虫爬取房源

获取mysql连接

conn=pymysql.connect(host="localhost",user="uroot",password="000000",port=3306,database='BeiKei')
cursor=conn.cursor()
sql='INSERT INTO zufang(housetitle,housetype,price) values(%s,%s,%s)'
for x in range(1,3):
doc=pq(bw.page_source)

房子主题

housetitle=doc('.twoline').text()

print(housetitle)

户型信息

housetype=doc('.content__list--item--des').text()

print(housetype)

价格

price=doc('.content__list--item-price').text()

print(price)

try:
cursor.execute(sql, (housetitle, housetype, price))
conn.commit()

except:
conn.rollback()
conn.close()
怎么写这个循环才能将数据写入数据库

  • 写回答

3条回答 默认 最新

  • CSDN专家-showbo 2022-10-19 11:52
    关注
    import time
    
    from selenium import webdriver
    from pyquery import PyQuery as pq
    import csv
    
    URL="https://beijing.anjuke.com/sale/p"
    bw=webdriver.Chrome()
    alldata=[['标题','价格','平米价格','户型', '面积', '朝向', '楼层', '修建时间','所处小区','区域地址']]#存储所有数据
    for x in range(2):
        new_url = URL+str(x)
        print(new_url)
        # 打开页面
        bw.get(new_url)
        html=bw.page_source
        doc =pq(html)
        #time.sleep(10)
    
        for item in doc('.property').items():#获取房产来遍历
            pdoc=pq(item.html())
            name=list(pdoc('.property-content-title-name').items())[0].text()#获取标题
            price=list(pdoc('.property-price-total').items())[0].text()#获取价格
            avgprice=list(pdoc('.property-price-average').items())[0].text()#获取平米价格
            #获取第一个property-content-info信息,每项房产有2~3个property-content-info信息,所以不能直接获取所有的property-content-info
            data=list(pdoc('.property-content-info').items())[0].text().split('\n')#基础信息
            addr=list(pdoc('.property-content-info').items())[1].text().split('\n')#地址
            if (len(data) == 4):
                data.append('')
            data.insert(0, name)
            data.insert(1, price)
            data.insert(2, avgprice)
            data.append(addr[0])
            data.append(addr[1])
            alldata.append(data)#存入数组中,最后再一次写入
    bw.close()
    
    
     
    #最后再一起写csv,而不是for循环中打开文件写,会覆盖内容
    with open('test13.csv','w',newline='')as f:
        writer = csv.writer(f)
        for data in alldata:
            writer.writerow(data)
    
    
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

问题事件

  • 系统已结题 10月27日
  • 已采纳回答 10月19日
  • 创建了问题 5月12日

悬赏问题

  • ¥15 远程桌面文档内容复制粘贴,格式会变化
  • ¥15 关于#java#的问题:找一份能快速看完mooc视频的代码
  • ¥15 这种微信登录授权 谁可以做啊
  • ¥15 请问我该如何添加自己的数据去运行蚁群算法代码
  • ¥20 用HslCommunication 连接欧姆龙 plc有时会连接失败。报异常为“未知错误”
  • ¥15 网络设备配置与管理这个该怎么弄
  • ¥20 机器学习能否像多层线性模型一样处理嵌套数据
  • ¥20 西门子S7-Graph,S7-300,梯形图
  • ¥50 用易语言http 访问不了网页
  • ¥50 safari浏览器fetch提交数据后数据丢失问题