正则匹配的中文包括中文标点符号吗?

 我来答
八哥说科技
高粉答主

2020-03-03 · 分享科技资讯,共享科技生活
八哥说科技
采纳数:113 获赞数:78618

向TA提问 私信TA
展开全部

不一定的,需要依表达式范围而定,例如:[\u4e00-\u9fa5] 可以识别出任何汉字,但不包含如:\u3002(匹配中文句号)。

解析:

“[\u3002\uff1b\uff0c\uff1a\u201c\u201d\uff08\uff09\u3001\uff1f\u300a\u300b] ”该表达式可以识别出: 。 ; , : “ ”( ) 、 ? 《 》 这些标点符号。 正则表达式“\un”匹配n,其中n是一个用四个十六进制数字表示的Unicode字符。例如,\u00A9匹配版权符号(©)。

 正则表达式匹配中文汉字 [\u4e00-\u9fa5] ,该表达式可以识别出任何汉字。但上述 \u3002 等匹配的符号不在范围内。

扩展资料:

汉字相关的正则表达式:

1、匹配双字节字符(包括汉字在内):[^\x00-\xff] ,注:可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1)

2、只含有汉字、数字、字母、下划线,下划线位置不限:^[a-zA-Z0-9_\u4e00-\u9fa5]+$

3、/^([\p{Han}\p{P}A-Za-z0-9])*$/u,其中 \p{Han}表示utf-8编码中的所有中文字符,\p{P}表示中英文标点,A-Z表示大写字母,a-z表示小写英文字母,0-9表示数字,*表示>=0,,/u 表示按unicode(utf-8)匹配(主要针对多字节比如汉字)。

参考资料来源:百度百科-正则表达式

帐号已注销
高粉答主

2020-03-03 · 说的都是干货,快来关注
知道小有建树答主
回答量:263
采纳率:95%
帮助的人:11.2万
展开全部

以Javascript为例:

<script>

var reg=/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])+/;

alert(reg.test("aa,"))。

基本符号:标号的作用在于标明,主要标明语句的性质和作用。常用的标点有9种,即:引号、括号、破折号、省略号、着重号、连接号、间隔号、书名号和专名号!标点符号是书面语言的有机组成部分,是书面语言不可缺少的辅助工具,它可以帮助人们确切地表达思想感情和理解书面语言。

扩展资料:

作用:

1、标点符号是辅助文字记录语言的符号,是书面语的有机组成部分,用来表示停顿、语气以及词语的性质和作用。

2、常用的标点符号有10种,分点号和标点两大类。

点号的作用在于点断,主要表示说话时的停顿和语气。点号又分为句末点号和句内点号。句末点号用在句末,有句号、问号、叹号3种,表示句末的停顿,同时表示句子的语气。句内点号用在句内,有逗号、顿号、分号、冒号4种,表示句内的各种不同性质的停顿。

参考资料来源:百度百科-标点符号




本回答被网友采纳
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
召秋梵悌p1
推荐于2017-11-25 · TA获得超过2282个赞
知道小有建树答主
回答量:616
采纳率:80%
帮助的人:684万
展开全部
如果你的正则表达式写的对,是没有问题的。
以Javascript为例:
<script>
var reg=/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])+/;
alert(reg.test("aa,"));
</script>
返回true。
满意请采纳!
追问
谢谢 那你擅长Java操作正则表达式吗?
追答
import java.util.regex.*;

public class Test {
public static void main(String[] args){
Pattern p = Pattern.compile("([\u4E00-\u9FA5]|[\uFE30-\uFFA0])+");
System.out.println(p.matcher("aa,").find());
}
}
满意请采纳吧。
本回答被提问者采纳
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
收起 更多回答(1)
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式