由于中文的ASCII码是有一定的范围的。所以你可以用下面的正则表达式来表示中文。五二电子网 管理员组文章数量: 1493
/^[chr(0xa1)-chr(0xff)]+$/
下面是一个使用的例子:
$str = "超越PHP";
if (preg_match("/^[".chr(0xa1)."-".chr(0xff)."]+$/", $str)) {
echo "这是一个纯中文字符串";echo "这不是一个纯中文字串";}
中文正则表达式匹配-正则中文匹配
\w匹配的仅仅是中文,数字,字母,对于国人来讲,仅匹配中文时常会用到,见下或许你也需要匹配双字节字符,中文也是双字节的字符
注:可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1)
更多常用正则表达式匹配规则:
匹配中文,英文字母和数字及_:
同时判断输入长度:
1、一个正则表达式,只含有汉字、数字、字母、下划线不能以下划线开头和结尾:
其中:
^ 与字符串开始的地方匹配
$ 与字符串结束的地方匹配
2、只含有汉字、数字、字母、下划线,下划线位置不限:
3、由数字、26个英文字母或者下划线组成的字符串
4、2~4个汉字
5、
用:(Abc)+ 来分析: XYZAbcAbcAbcXYZAbcAb
验证中文姓名的正则表达式是什么?
验证中文姓名的正则表达式:[\u4e00-\u9fa5],这个表达式是专门用来匹配中文姓名的。
【正则表达式】正则表达式,又称规则表达式,是计算机科学的一个概念,这个概念最初是由Unix中的工具软件普及开的。正则表通常被用来检索、替换那些符合某个模式(规则)的文本。正则引擎主要分为DFA、NFA两大类。许多程序设计语言都支持利用正则表达式进行字符串操作。例如,在Perl中就内建了一个功能强大的正则表达式引擎。
【起源】在1951 年,一位名叫Stephen Kleene的数学科学家,他在Warren McCulloch和Walter Pitts早期工作的基础之上,发表了一篇题目是《神经网事件的表示法》的论文,利用称之为正则集合的数学符号来描述此模型,引入了正则表达式的概念。正则表达式被作为用来描述其称之为“正则集的代数”的一种表达式,因而采用了“正则表达式”这个术语。
正则匹配的中文包括中文标点符号吗?
不一定的,需要依表达式范围而定,例如:[\u4e00-\u9fa5] 可以识别出任何汉字,但不包含如:\u3002(匹配中文句号)。
解析:
“[\u3002\uff1b\uff0c\uff1a\u201c\u201d\uff08\uff09\u3001\uff1f\u300a\u300b] ”该表达式可以识别出: 。 ; , : “ ”( ) 、 ? 《 》 这些标点符号。 正则表达式“\un”匹配n,其中n是一个用四个十六进制数字表示的Unicode字符。例如,\u00A9匹配版权符号(©)。
正则表达式匹配中文汉字 [\u4e00-\u9fa5] ,该表达式可以识别出任何汉字。但上述 \u3002 等匹配的符号不在范围内。
扩展资料:
汉字相关的正则表达式:
1、匹配双字节字符(包括汉字在内):[^\x00-\xff] ,注:可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1)
2、只含有汉字、数字、字母、下划线,下划线位置不限:^[a-zA-Z0-9_\u4e00-\u9fa5]+
$3、/^([\p{Han}\p{P}A-Za-z0-9])*$/u,其中 \p{Han}表示utf-8编码中的所有中文字符,\p{P}表示中英文标点,A-Z表示大写字母,a-z表示小写英文字母,0-9表示数字,*表示>=0,,/u 表示按unicode(utf-8)匹配(主要针对多字节比如汉字)。
参考资料来源:百度百科-正则表达式
以Javascript为例:
<script>
var reg=/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])+/;
st("aa,"))。
基本符号:标号的作用在于标明,主要标明语句的性质和作用。常用的标点有9种,即:引号、括号、破折号、省略号、着重号、连接号、间隔号、书名号和专名号!标点符号是书面语言的有机组成部分,是书面语言不可缺少的辅助工具,它可以帮助人们确切地表达思想感情和理解书面语言。
扩展资料:
作用:
1、标点符号是辅助文字记录语言的符号,是书面语的有机组成部分,用来表示停顿、语气以及词语的性质和作用。
2、常用的标点符号有10种,分点号和标点两大类。
点号的作用在于点断,主要表示说话时的停顿和语气。点号又分为句末点号和句内点号。句末点号用在句末,有句号、问号、叹号3种,表示句末的停顿,同时表示句子的语气。句内点号用在句内,有逗号、顿号、分号、冒号4种,表示句内的各种不同性质的停顿。
参考资料来源:百度百科-标点符号
以Javascript为例:
<script>
var reg=/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])+/;
st("aa,"));
</script>
返回true。
满意请采纳!
版权声明:本文标题:谁知道如何用正则表达式来表示中文? 内容由网友自发贡献,该文观点仅代表作者本人, 转载请联系作者并注明出处:http://www.freenas.com.cn/jishu/1686494465h1973.html, 本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容,一经查实,本站将立刻删除。
发表评论