Java中 用正则表达式提取网页源码中的unicode编码

源码中有姓氏,以unicode显示,为\u5305。我写的表达式为"\\\\w{5}"。为什么不能匹配出来?... 源码中有姓氏,以unicode显示,为\u5305。我写的表达式为 "\\\\w{5}"。为什么不能匹配出来? 展开
 我来答
计名pS
2010-03-06 · TA获得超过3649个赞
知道大有可为答主
回答量:4189
采纳率:0%
帮助的人:2194万
展开全部
Non-Word, Capital W:

"\\W{2}"

"\u5305"

--因为"\u5305"是Unicode的表示方法,而不是 internal string representation"
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式