luoyanpin 2017-08-18 08:34 采纳率: 0%
浏览 2549

DocumentTermMatrix wordcloud都出现乱码

R编码设置之前默认是utf-8,运行DocumentTermMatrix报错

control=list(removePunctuation=T,minDocFreq=5,wordLengths = c(1, Inf),weighting = weightTfIdf)
dtm <- DocumentTermMatrix(txt_corpus, control =control)
inspect(dtm)
<>
Non-/sparse entries: 1934534/2563634714
Sparsity : 100%
Error in nchar(Terms(x), type = "chars") :
invalid multibyte string, element 27

接着我按网上的方法,先设置Sys.setlocale(locale="English"),再执行以上代码,后设回Sys.setlocale(locale="Chinese (Simplified)_People's Republic of China.936"),没有报错,但是结果却出现了乱码,实在不知道出现什么问题了,直接将

对语料库绘制成词云,也还是乱码

  • 写回答

1条回答 默认 最新

  • threenewbee 2017-08-18 15:52
    关注
    评论

报告相同问题?

悬赏问题

  • ¥50 如何用脚本实现输入法的热键设置
  • ¥20 我想使用一些网络协议或者部分协议也行,主要想实现类似于traceroute的一定步长内的路由拓扑功能
  • ¥30 深度学习,前后端连接
  • ¥15 孟德尔随机化结果不一致
  • ¥15 apm2.8飞控罗盘bad health,加速度计校准失败
  • ¥15 求解O-S方程的特征值问题给出边界层布拉休斯平行流的中性曲线
  • ¥15 谁有desed数据集呀
  • ¥20 手写数字识别运行c仿真时,程序报错错误代码sim211-100
  • ¥15 关于#hadoop#的问题
  • ¥15 (标签-Python|关键词-socket)