weixin_40029476 2019-01-14 21:55 采纳率: 100%
浏览 1903
已采纳

爬取内容中文乱码(这种“ú̿£ºËļ¾¶È¡°Ãº¡±·êÈý¡°½Ù¡±”)是怎么回事??

用scrapy爬取新闻网站内容,结果爬下来的是一堆乱码?gb2312、utf-8、gbk各种解码都试过了还是不行!
仍然是这种乱码 Á½ÓÍÖÜÎåÊÕ¸ß µÚÈý¼¾¶ÈÕÇ·ù´´Ò»Äê¶àÒÔÀ´×î´ó

爬取的网址是:https://link.zhihu.com/?target=http%3A//www.chemall.com.cn/chemall/infocenter/newsfile/2017-10-17/20171017114532.html

储存入MongoDB也是这样

  • 写回答

3条回答 默认 最新

  • 清源君 2019-01-15 21:33
    关注

    写入的时候别忘记加上 ensure_ascii=False

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?