.

正则表达式中匹配符号详解
分类:电脑知识 发表于:2009-08-23 10:13:50 评论(0)


1:\

在许多编程语言里面被用作转义符,一般来说

符号后面如果跟的是普通字符c,那么c就代表特殊的含义,例如n本来代表字符n,但n就代表换行。

符号后面如果跟的是特殊字符c,那么c就代表普通字符c,例如一般用作转义符,但\则调表普通字符。

Javascript的正则表达式中的用法与上面相同,只是不同的编程语言,特殊字符表可能不太一样罢了。

2:^ 

匹配输入字符串的起始端,如果是多行匹配,即表达式的附加参数中含有m,则也在一个换行符后匹配。

例子:/^B/匹配 “Bab Bc ”中的第一个B

例子2:/^B/gm匹配

“Badd B

cdaf

B dsfB”

中的第一行第一个B,第三行中的第一个B

3:$

匹配输入字符创的尾端,如果是多行匹配,即表达式的附加参数中含有m,则也在一个换行符前匹配。

与^的用法相反。

例子:/t$/匹配“bat”中的t,但是不匹配“hate”中的t

例子2:/t$/匹配

“tag at

bat”

中第一行的最后一个t和第二行的t。

4:*

匹配前一个字符0次或多次。

例子:/ab*/匹配“dddabbbbc”中的“abbbb”,也匹配“ddda”中的“a”

5:+

匹配前一个字符1次或多次。

例子:/ab+/匹配“dddabbbbc”中的“abbbb”,但不匹配“ddda”

与后面的{1,}(原型:{n,})的用法类似

6:?

?的用法比较特殊,一般来说它用来对前一个字符做0次或1次匹配,但是它有另外两种特殊的用法:

如果紧跟在*、+、?和{ }之后,则表示原始匹配的最小次数匹配,例如:

/ba*/本来匹配“bbbaaaa”中的“baaaa”,但是/ba*?/则匹配“bbbaaaa”中的“b”(因为*表示0次或多次匹配,而加?应该表示最少次数匹配,即0次匹配)。

同理:/ba+?/则匹配“baaaa”中的“ba”。

作为语法结构符号,使用于前置断言中,即后面要说到的x(?=y)和x(?!=y)

7:.

小数点中的“.”号,匹配任何一个单独的字符,但是换行符除外。

标准中总共有哪些字符?请参考:字符集

例如:/a.b/匹配“acbaa”中的“acb”,但是不匹配“abbb”。

8:(x)

表示匹配x(并非特指字符x或者特指一个字符,x表示一个字符串),而且匹配会被记住,在语法中这种()被称为“capturing parentheses ”,即捕捉用的小括号。

匹配会被记住,是因为在表达式提供的函数中,有些函数返回一个数组,该数组会保存所匹配的所有字符串,例如exec()函数。

另外还要注意()中的x被记住的前提是匹配x。

例子1:

var regx=/a(b)c/;

var rs=regx.exec(“abcddd”);

从上面可以看出,/a(b)c/匹配“abcddd”中的“abc”,因为()的原因,b也会记录下来,因此rs返回的数字内容为:

{abc,b}

例子2:

var regx=/a(b)c/;

var rs=regx.exec(“acbcddd”);

rs返回null,因为/a(b)c/不匹配“acbcddd”,所以()中的b不会被记录下来(尽管字符串中含有b)

9:(?:x)

匹配x,但不会记住x,这种格式中的()被称为“non-capturing parentheses ”,即非捕捉用的小括号。

例子:

var regx=/a(?:b)c/;

var rs=regx.exec(“abcddd”);

从上面可以看出,/a(?:b)c/匹配“abcddd”中的“abc”,因为(?:)的原因,b不会记录下来,因此rs返回的数字内容为:

{abc}

10:X(?=y)

匹配x,仅当后面紧跟着y时。如果符合匹配,则只有x会被记住,y不会被记住。

例子:

var regx=/user(?=name)/;

var rs=regx.exec(“The username is Mary”);

结果:匹配成功,而且rs的值为{user}

11:X(?!y)

匹配x,仅当后面不紧跟着y时。如果符合匹配,则只有x会被记住,y不会被记住。

例子:

var regx=/user(?!name)/;

var rs=regx.exec(“The user name is Mary”);

结果:匹配成功,而且rs的值为{user}

例子2:

var regx=/d+(?!.)/;

var rs=regx.exec(“54.235”);

结果:匹配成果,rs的值为{5},不匹配54是因为54后面跟着“.”号,当然235也匹配,但是由于exec方法的行为,235不会被返回

12:x|y

匹配x或y。注意如果x和y都匹配上了,那么只记住x。

例子:

var regx=/beijing|shanghai/;

var rs=regx.exec(“I love beijing and shanghai”);

结果:匹配成功,rs的值为{beijing},虽然shanghai也匹配,但不会被记住。

13:{n}

匹配前一个字符的n次出现。

n必须是一个非负数,当然如果是一个负数或小数也不会报语法错误。

例子:

var regx=/ab{2}c/;

var rs=regx.exec(“abbcd”);

结果:匹配成功,rs的值为:{abbc}。

14:{n,}

匹配前一个字符的至少n次出现。

例子:

var regx=/ab{2,}c/;

var rs=regx.exec(“abbcdabbbc”);

结果:匹配成功,rs的值为:{abbc}。注意为什么abbbc也符合条件为什么没有被记住,这与exec方法的行为有关,后面会统一讲解。

15:{n,m}

匹配前一个字符的至少n次最多m次的出现。

只要n与m为数字,而且m>=n就不会报语法错误。

例子:

var regx=/ab{2,5}c/;

var rs=regx.exec(“abbbcd”);

结果:匹配成功,rs的值为:{abbbc}。

例子2:

var regx=/ab{2,2}c/;

var rs=regx.exec(“abbcd”);

结果:匹配成功,rs的值为:{abbc}。

例子3:

var regx=/ab(2,5)/;

var rs=regx.exec(“abbbbbbbbbb”);

结果:匹配成功,rs的值为:{abbbbb},这说明,如果前一个字符出现多于m次,则只匹配m次。另外:

var regx=/ab(2,5)c/;

var rs=regx.exec(“abbbbbbbbbbc”);

结果:匹配失败,rs的值为:null,为什么匹配失败,因为b多于5个则b(2,5)会匹配前5个b,,而表达式/ab(2,5)c/中b后面是c,但字符串中5个b之后还是b所以会报错。

16:[xyz]

xyz表示一个字符串,该模式表示匹配[]中的一个字符,形式上[xyz]等同于[x-z]。

例子:

var regx=/a[bc]d/;

var rs=regx.exec(“abddgg”);

结果:匹配成功,rs的值为:{abd}

例子2:

var regx=/a[bc]d/;

var rs=regx.exec(“abcd”);

结果:匹配失败,rs的值为:null,之所以失败,是因为[bc]表示匹配b或c中的一个,但不会同时匹配。

17:[^xyz]

该模式表示匹配非[]中的一个字符,形式上[^xyz]等同于[^x-z]。

例子:

var regx=/a[^bc]d/;

var rs=regx.exec(“afddgg”);

结果:匹配成功,rs的值为:{afd}

例子2:

var regx=/a[^bc]d/;

var rs=regx.exec(“abd”);

结果:匹配失败,rs的值为:。

18:[b]

匹配退格键。

19:b

匹配一个词的边界符,例如空格和换行符等等,当然匹配换行符时,表达式应该附加参数m。

例子:

var regx=/bc./;

var rs=regx.exec(“Beijing is a beautiful city”);

结果:匹配成功,rs的值为:{ci},注意c前边的空格不会匹配到结果中,即{ ci}是不正确的。

20:B

代表一个非单词边界。

例子:

var regx=/Bi./;

var rs=regx.exec(“Beijing is a beautiful city”);

结果:匹配成功,rs的值为:{ij},即匹配了Beijing中的ij。

21:cX

匹配一个控制字符。例如, cM 匹配一个 Control-M 或

回车符。 x 的值必须为 A-Z 或 a-z 之一。否则,将 c 视为一

个原义的 ’c’ 字符。(实际的例子还需补充)

21:d

匹配一个数字字符,等同于[0-9]。

例子:

var regx=/userd/;

var rs=regx.exec(“user1”);

结果:匹配成功,rs的值为:{user1}

22:D

匹配一个非数字字符,等同于[^0-9]。

例子:

var regx=/userD/;

var rs=regx.exec(“userA”);

结果:匹配成功,rs的值为:{userA}

23:f

匹配一个换页符。

24:n

匹配一个换行符。因为是换行符,所以在表达式中要加入m参数。

例子:

var regx=/anbc/m;

var str=“a

bc”;

var rs=regx.exec(str);

结果:匹配成功,rs的值为:{ },如果表达式为/anrbc/,则不会被匹配,因此在一般的编辑器中一个”Enter”键代表着“回车换行”,而非“换行回车”,至少在textarea域中是这样的。

25:r

匹配一个回车符

26:s

匹配一个空格符,等同于[ fnrtvu00A0u2028u2029].

例子:

var regx=/si/;

var rs=regx.exec(“Beijing is a city”);

结果:匹配成功,rs的值为:{ i}

27:S

匹配一个非空格符,等同于[ ^fnrtvu00A0u2028u2029].

例子:

var regx=/Si/;

var rs=regx.exec(“Beijing is a city”);

结果:匹配成功,rs的值为:{ei}

28:t

匹配一个tab

例子:

var regx=/atb/;

var rs=regx.exec(“a bc”);

结果:匹配成功,rs的值为: {a bc}

29:v

匹配一个竖向的tab

30:w

匹配一个数字、_或字母表字符,即[A-Za-z0-9_ ]。

例子:

var regx=/w/;

var rs=regx.exec(“$25.23”);

结果:匹配成功,rs的值为:{2}

31:W

匹配一个非数字、_或字母表字符,即[^A-Za-z0-9_ ]。

例子:

var regx=/w/;

var rs=regx.exec(“$25.23”);

结果:匹配成功,rs的值为:{$}

32:n

注意不是n,这里n是一个正整数,表示匹配第n个()中的字符。

例子:

var regx=/user([,-])group1role/;

var rs=regx.exec(“user-group-role”);

结果:匹配成功,rs的值为:{user-group-role,-},同样对user,group,role的匹配也是成功的,但像user-group,role等就不对了。

33:?

匹配一个NUL字符。

34:xhh

匹配一个由两位16进制数字所表达的字符。

35:uhhhh

匹配一个由四位16进制数字所表达的字符。

  
邮箱: 密码: