luoyanpin 2017-08-18 08:34 采纳率: 0%
浏览 2549

DocumentTermMatrix wordcloud都出现乱码

R编码设置之前默认是utf-8,运行DocumentTermMatrix报错

control=list(removePunctuation=T,minDocFreq=5,wordLengths = c(1, Inf),weighting = weightTfIdf)
dtm <- DocumentTermMatrix(txt_corpus, control =control)
inspect(dtm)
<>
Non-/sparse entries: 1934534/2563634714
Sparsity : 100%
Error in nchar(Terms(x), type = "chars") :
invalid multibyte string, element 27

接着我按网上的方法,先设置Sys.setlocale(locale="English"),再执行以上代码,后设回Sys.setlocale(locale="Chinese (Simplified)_People's Republic of China.936"),没有报错,但是结果却出现了乱码,实在不知道出现什么问题了,直接将

对语料库绘制成词云,也还是乱码

  • 写回答

1条回答

  • threenewbee 2017-08-18 15:52
    关注
    评论

报告相同问题?

悬赏问题

  • ¥15 关于#python#的问题:求帮写python代码
  • ¥20 MATLAB画图图形出现上下震荡的线条
  • ¥15 LiBeAs的带隙等于0.997eV,计算阴离子的N和P
  • ¥15 关于#windows#的问题:怎么用WIN 11系统的电脑 克隆WIN NT3.51-4.0系统的硬盘
  • ¥15 来真人,不要ai!matlab有关常微分方程的问题求解决,
  • ¥15 perl MISA分析p3_in脚本出错
  • ¥15 k8s部署jupyterlab,jupyterlab保存不了文件
  • ¥15 ubuntu虚拟机打包apk错误
  • ¥199 rust编程架构设计的方案 有偿
  • ¥15 回答4f系统的像差计算