csjvv 2016-04-11 09:16 采纳率: 14.3%
浏览 1315

如何将双字节字符排除在外 C++

我需要读取一个文件,然后统计文件中的英文单词,这个方法可以,但是如果文件中出现日语,就会统计出错 ,有人告诉我,要我排除双字节字符,我试过,没成功,应该怎么操作呢?
string word = "";
char ch;
int total=0;
fstream outFile;
fstream inFile;
inFile.open(strReadFilePath, ios::in);

while (inFile.get(ch))
{
    if((ch >= 'a' && ch <= 'z') || (ch >= 'A' && ch <= 'Z') || (ch == '\''))
        word += ch;
    else
    {
        if(word == "")
            continue;
        words[word]++;
        word = "";
    }
}

if(word != "")
{
    words[word]++;
}
  • 写回答

1条回答

  • threenewbee 2016-04-11 09:41
    关注

    http://ask.csdn.net/questions/229528
    之前回答过,你只需要把那代码反过来。
    if (c[i] > 256 || c[i] < 0)
    ->
    if (c[i] <= 256 && c[i] >= 0)

    评论

报告相同问题?

悬赏问题

  • ¥100 有人会搭建GPT-J-6B框架吗?有偿
  • ¥15 求差集那个函数有问题,有无佬可以解决
  • ¥15 【提问】基于Invest的水源涵养
  • ¥20 微信网友居然可以通过vx号找到我绑的手机号
  • ¥15 寻一个支付宝扫码远程授权登录的软件助手app
  • ¥15 解riccati方程组
  • ¥15 display:none;样式在嵌套结构中的已设置了display样式的元素上不起作用?
  • ¥15 使用rabbitMQ 消息队列作为url源进行多线程爬取时,总有几个url没有处理的问题。
  • ¥15 Ubuntu在安装序列比对软件STAR时出现报错如何解决
  • ¥50 树莓派安卓APK系统签名