pekingGavin 2014-02-10 09:59 采纳率: 0%
浏览 1997

请教nutch和solr集成问题

最近在学习搜索引擎,按照nutch官网上的教程下载了nutch2.2.1和solr4.6.1
通过执行bin/crawl 能够在hbase数据库中看到爬虫下载的网页,但是solr 里面没有数据且没有异常,为什么呢?
请高手帮忙

注:采用nutch1.7可以成功进行索引

  • 写回答

3条回答 默认 最新

  • 落落林 2014-07-21 10:06
    关注

    可以问你个问题么,我用的nutch2.2.1 solr4.8 hadoop1.1.2 hbase0.94 ,为什么nutException in thread "main" java.lang.NullPointerException
    at java.util.Hashtable.put(Hashtable.java:542)
    at java.util.Properties.setProperty(Properties.java:161)
    at org.apache.hadoop.conf.Configuration.set(Configuration.java:419)
    at org.apache.nutch.indexer.IndexerJob.createIndexJob(IndexerJob.java:128)
    at org.apache.nutch.indexer.solr.SolrIndexerJob.run(SolrIndexerJob.java:44)
    at org.apache.nutch.crawl.Crawler.runTool(Crawler.java:68)
    at org.apache.nutch.crawl.Crawler.run(Crawler.java:192)
    at org.apache.nutch.crawl.Crawler.run(Crawler.java:250)
    at org.apache.hadoop.util.ToolRunner.run(ToolRunner.java:65)
    at org.apache.nutch.crawl.Crawler.main(Crawler.java:257)
    at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)
    at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:57)
    at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)
    at java.lang.reflect.Method.invoke(Method.java:601)
    at org.apache.hadoop.util.RunJar.main(RunJar.java:156)ch在爬取过程报错
    你用的版本是多少的

    评论

报告相同问题?

悬赏问题

  • ¥50 有数据,怎么建立模型求影响全要素生产率的因素
  • ¥50 有数据,怎么用matlab求全要素生产率
  • ¥15 TI的insta-spin例程
  • ¥15 完成下列问题完成下列问题
  • ¥15 C#算法问题, 不知道怎么处理这个数据的转换
  • ¥15 YoloV5 第三方库的版本对照问题
  • ¥15 请完成下列相关问题!
  • ¥15 drone 推送镜像时候 purge: true 推送完毕后没有删除对应的镜像,手动拷贝到服务器执行结果正确在样才能让指令自动执行成功删除对应镜像,如何解决?
  • ¥15 求daily translation(DT)偏差订正方法的代码
  • ¥15 js调用html页面需要隐藏某个按钮