as3强大的正则表达式:RegExp

2009年5月4日星期一

as3强大的正则表达式:RegExp

14.2.2正则表达式的两个构成部分
简写模式:
var正则对象:RegExp=/匹配模式/标志位
构造函数模式:
var正则对象:RegExp=newRegExp(匹配模式,标志位)
匹配模式就是正则表达式,标志位包括五个字母gimsx
14.3正则表达式语法
14.3.1正则表达式中的文字符号
普通文字和符号:A-Za-z0-9以及不是元字符的其它符号
输入Unicode字符时,同String一样,使用\uXXXX
元字符:三三二三个一(记忆口诀)
三个括号:{[(
三个匹配次数:*+?星加问
两个断言:^$定头定尾
三个一:|选择符.模糊匹配\转义
三个括号:
{定义匹配次数
[字符集
(子模式
三个匹配次数:
*匹配出现0次或多次
+匹配出现至少1次或多次
?匹配出现0次最多1次
两个断言:
^在/后出现时为左端断言,/^
$在/前出现时为右端断言,$/
三个独立元字符:
|选择符,匹配时兼容匹配选择符两边的字符
.模糊匹配,可以代替
不可见字符:比较一些转义的控制字符
14.3.2正则表达式中的字符集
1.字符集的概念和最简单的字符集形式
[字符集]
字符集用中括号括起来
Unicode字符请使用\uXXXX四位十六进制Unicode代码输入
如:/g[eo]t,分别匹配get和got,但不会匹配geot,因为字符集只能匹配一个字符
2.连字符在字符集中的运用
[字符-字符]
如:[a-z][A-Z],就是匹配英文字母字符集了

3.取反符号在字符集中的运用
[^字符集]
添加取反符号后,匹配时将忽略字符集中的所有元素
4.字符集中需要转义的特殊字符
\转义符号
常见要转义的字符有三类:
1.字符串:双引号单引号'反斜杠\
2.正则表达式的源字符
3.字符集中的:[\^-
尽可能将会产生歧义的字符转义

14.3.3特殊的点号(.)
.号可以替代任意单个字符,作为正则表达式中的模糊匹配字符
1.点号不匹配新行符(\n)
多行字符的模糊匹配中,.号不能匹配\n换行符,要匹配换行符,必须在标志位中使用s
2.尽量少使用点号.
只在明确不会模糊匹配时出错的情况下才用.模糊匹配,点号匹配所有的Unicode字符。

14.3.4选择符
|对选择符两边的元素作任意匹配。
使用|选择符时,尽可能使用括号将两边的操作数括起来,以方便区别。
14.3.5括号与分组
()圆括号将表达式的一部分括起来,就会将这部分定交成组,一旦命名了组,就可以通过向后引用来调用它。
它所括起的部分一般用于:
1.和选择符搭配,规定作用于选择符的范围,如/he(got|get)it/
2.和限定符搭配使用,指定匹配的重复次数,如/(get)*/

14.3.6用正则表达式描述字符串的重复
使用{}定义匹配的重复次数,跟在要重复的表达式或字符后面
{最小出现次数[,最多出现次数]}
还有常用的三个非显式限定符
*+?星加问
*出现0次或多次等同{0,}
+出现1次或多次等同{1,}
?出现0次或最多1次等同{0,1}

14.3.7注意正则表达式的贪婪性和懒惰性
使用*+?{}的时候,正则表达式总是尽可能向右搜寻尽可能多的匹配结果,如果想禁止此贪婪性,可在操作符后加上?,迫使程序运行时使用懒惰模式,优先使用左边匹配的第一个结果。

14.3.8用正则表达式来定位
断言:指定匹配发生的位置
^匹配字符串起始的位置,一般跟在起始/后,组合成/^
$匹配字符串结尾的位置,一般跟在结束/前,组合成$/
\b匹配字符边界
\B匹配非字符边界
字符边界指空格的位置,可跟在要匹配的表达式左边或右边

14.3.9正则表达式的5个标志位。
gglobal全局匹配,尽可能匹配全部结果
iignoreCase不区分大小写匹配
mmultiline断言控制符,使用后^$两个断言符才能生效
sdotall匹配换行符标志
xextended令正则表达式支持空格,但编译时会自动忽略,增加可视的友好度

14.3.10正则表达式元字符优先线
优先级顺序从高到低排列
\转义符
(),(?:),(?=),[]分级定义符号,字符集定义符号
*,+,?,{n},{n,},{n,m}限定符
^,$,\位置定义位置和顺序
|选择符


14.4正则表达式与字符串的结合使用详解
14.4.1RegExp的exec()和test()
test方法
varRegExp对象:RegExp=/正则表达式/或newRegExp(正则式,标志位)
varString对象:String=字符;
RegExp对象.test(String对象)
RegExp对象.exec(正则表达式):Array
exec返回一个匹配后的数组

14.4.3String类的replace()与正则表达式向后引用
()使用子表达式括起的表达式,可以在后边引用,使用\nn为索引从1至99
/\b([a-z]+)\1\b/gi其中的\1就是引用前面第一个([a-z])

0 评论:

发表评论