weixin_55043902 2021-05-10 22:02 采纳率: 50%
浏览 366
已采纳

向大佬请教,做LDA主题分析时,多个主题结果一样

如图中所示,我在做一些企业年报的分析,可能数据量比较小(100多篇)。分析的结果总是除了一个主题,其他主题结果一样。这是出什么问题了嘛?数据用Excel转csv保存的,一个报告放在一格中,去掉了换行符号。难道是每个句子放一格嘛?

  • 写回答

6条回答 默认 最新

  • CSDN专家-HGJ 2021-05-11 15:31
    关注

    1.数据上,读取时要设置header;2.在分词之前,要将各行数据进行处理。这样改:

    texts=pd.read_excel(r'data1.xlsx',header=None).astype(str)
    #通过jieba进行切词生成词袋
    
    text = [jp.cut(i) for i in texts.values.ravel()]
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(5条)

报告相同问题?

悬赏问题

  • ¥15 CVRP 图论 物流运输优化
  • ¥15 Tableau online 嵌入ppt失败
  • ¥100 支付宝网页转账系统不识别账号
  • ¥15 基于单片机的靶位控制系统
  • ¥15 真我手机蓝牙传输进度消息被关闭了,怎么打开?(关键词-消息通知)
  • ¥15 下图接收小电路,谁知道原理
  • ¥15 装 pytorch 的时候出了好多问题,遇到这种情况怎么处理?
  • ¥20 IOS游览器某宝手机网页版自动立即购买JavaScript脚本
  • ¥15 手机接入宽带网线,如何释放宽带全部速度
  • ¥30 关于#r语言#的问题:如何对R语言中mfgarch包中构建的garch-midas模型进行样本内长期波动率预测和样本外长期波动率预测