LuckyChend 2017-09-21 09:49 采纳率: 40%
浏览 1359

java 内存溢出,循环执行

写了三遍了,心累,不知道为啥发布出去
这个是一个爬虫程序,list传入的url,有三万多个,我要做的是抓取这三万多个页面的邮箱,用正则提取邮箱,但是抓取1900多条就会报内存溢出错误,怎么回事啊,很着急啊
图片说明
图片说明

  • 写回答

2条回答

  • 叮咚呛咚呛 2017-09-22 02:17
    关注

    老铁 请不要用字符串截取的方法 用jsoup 可以更加效率,更加简单,更加便于后期的维护
    jsoup利用json格式规则抓取网页内容:http://download.csdn.net/download/jkl012789/9949865
    jsoup利用json格式规则抓取网页内容带完整例子:http://download.csdn.net/download/jkl012789/9956793

    评论

报告相同问题?

悬赏问题

  • ¥15 有赏,i卡绘世画不出
  • ¥15 如何用stata画出文献中常见的安慰剂检验图
  • ¥15 c语言链表结构体数据插入
  • ¥40 使用MATLAB解答线性代数问题
  • ¥15 COCOS的问题COCOS的问题
  • ¥15 FPGA-SRIO初始化失败
  • ¥15 MapReduce实现倒排索引失败
  • ¥15 ZABBIX6.0L连接数据库报错,如何解决?(操作系统-centos)
  • ¥15 找一位技术过硬的游戏pj程序员
  • ¥15 matlab生成电测深三层曲线模型代码