如何从一个文件中提取中文字符

 我来答
LILPIG
2018-01-27 · 超过45用户采纳过TA的回答
知道答主
回答量:106
采纳率:92%
帮助的人:33万
展开全部
汉字在unicode字符表中是在\u4e00-\u9fa5这一段之中的,你可以用正则表达式匹配这一段内容!
如Java:
String regex="[\\u4e00-\\u9fa5]"
StringBuffer sb=new StringBuffer();
Matcher matcher = Pattern.compile(regex).matcher(这里是文件内容);
while (matcher.find()) {
sb.append(matcher.group(0));
}
System.out.println(sb.toString());

纯手打,给个采纳,希望您生活愉快~
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式