如何从一个文件中提取中文字符

发布网友

我来回答

1个回答

热心网友

汉字在unicode字符表中是在\u4e00-\u9fa5这一段之中的,你可以用正则表达式匹配这一段内容!
如Java:
String regex="[\\u4e00-\\u9fa5]"
StringBuffer sb=new StringBuffer();
Matcher matcher = Pattern.compile(regex).matcher(这里是文件内容);
while (matcher.find()) {
sb.append(matcher.group(0));
}
System.out.println(sb.toString());

纯手打,给个采纳,希望您生活愉快~

声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com