weixin_40504861 2017-10-17 22:09 采纳率: 100%
浏览 1643
已采纳

java替换文件中的字符

现在有文本,按字节定长文件,gbk或者UTF8或者unicode编码都有可能包含敏感信息需要变形,变形规则如下,如果是中文和数字及字母,按已经定义好的对照表替换,如果是外文,则奇数位不变,偶数位统一换成字母A。本想按字节截取字段后转为string,然后逐个字符判断ascii码是否落在中文和英文字母及数字的区间判断。但又想既然都已经read 到byte了,转为字符又转ascii 似乎太绕了,但不同字符占的字节不同,直接根据byte怎么判断当前的byte 是属于中文还是外文呢还是英文和数字呢

  • 写回答

2条回答 默认 最新

  • 善良勤劳勇敢而又聪明的老杨 Java领域优质创作者 2017-10-18 03:51
    关注

    个人建议还是你还是先转成String再截取判断。因为Unicode里中文是2个字节,UTF-8里中文是3个字节,所以你想靠截取字节来判断的话应该是不大可能。

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

悬赏问题

  • ¥15 为什么使用javacv转封装rtsp为rtmp时出现如下问题:[h264 @ 000000004faf7500]no frame?
  • ¥15 乘性高斯噪声在深度学习网络中的应用
  • ¥15 运筹学排序问题中的在线排序
  • ¥15 关于docker部署flink集成hadoop的yarn,请教个问题 flink启动yarn-session.sh连不上hadoop,这个整了好几天一直不行,求帮忙看一下怎么解决
  • ¥30 求一段fortran代码用IVF编译运行的结果
  • ¥15 深度学习根据CNN网络模型,搭建BP模型并训练MNIST数据集
  • ¥15 C++ 头文件/宏冲突问题解决
  • ¥15 用comsol模拟大气湍流通过底部加热(温度不同)的腔体
  • ¥50 安卓adb backup备份子用户应用数据失败
  • ¥20 有人能用聚类分析帮我分析一下文本内容嘛