正则表达式语法_.NET_程序员俱乐部

您所在的位置：程序员俱乐部 > 编程开发 > .NET > 正则表达式语法

正则表达式语法

2015/4/14 3:22:29 电子灵魂程序员俱乐部我要评论(0)

摘要：http://msdn.microsoft.com/zh-cn/library/ae5bf541(VS.80).aspx正则表达式是一种文本模式，包括普通字符（例如，a到z之间的字母）和特殊字符（称为“元字符”）。模式描述在搜索文本时要匹配的一个或多个字符串。下面是正则的一些常用语法举例：\将下一个字符标记为特殊字符或字面值。例如"n"与字符"n"匹配。"\n"与换行符匹配。序列"\\"与"
标签：正则表达式表达式正则

http://msdn.microsoft.com/zh-cn/library/ae5bf541(VS.80).aspx

正则表达式是一种文本模式，包括普通字符（例如，a 到 z 之间的字母）和特殊字符（称为“元字符”）。模式描述在搜索文本时要匹配的一个或多个字符串。

下面是正则的一些常用语法举例：

将下一个字符标记为特殊字符或字面值。例如"n"与字符"n"匹配。"\n"与换行符匹配。序列"\\"与"\"匹配对面，"\("与"("匹配。

匹配输入的开始位置。

匹配输入的结尾。

匹配前一个字符零次或几次。例如，"zo*"可以匹配"z"、"zoo"。

匹配前一个字符一次或多次。例如，"zo+"可以匹配"zoo",但不匹配"z"。

匹配前一个字符零次或一次。例如，"a?ve?"可以匹配"never"中的"ve"。

匹配换行符以外的任何字符。

(pattern)

与模式匹配并记住匹配。匹配的子字符串可以从作为结果的Matches集合中使用Item[0]...[n]取得。如果要匹配括号字符(和)，可使用"$"或"$"。

x|y

匹配x或y。例如"z|food"可匹配"z"或"food"。"(z|f)ood"匹配"zoo"或"food"。

{n}

n为非负的整数。匹配恰好n次。例如，"o{2}"不能与"Bob中的"o"匹配，但是可以与"foooood"中的前两个o匹配。

{n,}

n为非负的整数。匹配至少n次。例如，"o{2,}"不匹配"Bob"中的"o"，但是匹配"foooood"中所有的o。"o{1,}"等价于"o+"。"o{0,}"等价于"o*"。

{n,m}

m和n为非负的整数。匹配至少n次，至多m次。例如，"o{1,3}"匹配"fooooood"中前三个o。"o{0,1}"等价于"o?"。

[xyz]

一个字符集。与括号中字符的其中之一匹配。例如，"[abc]"匹配"plain"中的"a"。

[^xyz]

一个否定的字符集。匹配不在此括号中的任何字符。例如，"[^abc]"可以匹配"plain"中的"p".

[a-z]

表示某个范围内的字符。与指定区间内的任何字符匹配。例如，"[a-z]"匹配"a"与"z"之间的任何一个小写字母字符。

[^m-z]

否定的字符区间。与不在指定区间内的字符匹配。例如，"[m-z]"与不在"m"到"z"之间的任何字符匹配。

与单词的边界匹配，即单词与空格之间的位置。例如，"er\b"与"never"中的"er"匹配，但是不匹配"verb"中的"er"。

与非单词边界匹配。"ea*r\B"与"neverearly"中的"ear"匹配。

与一个数字字符匹配。等价于[0-9]。

与非数字的字符匹配。等价于[^0-9]。

与分页符匹配。

与换行符字符匹配。

与回车字符匹配。\s

与任何白字符匹配，包括空格、制表符、分页符等。等价于"[\f\n\r\t\v]"。

与任何非空白的字符匹配。等价于"[^\f\n\r\t\v]"。

与制表符匹配。

与垂直制表符匹配。

与任何单词字符匹配，包括下划线。等价于"[A-Za-z0-9_]"。

与任何非单词字符匹配。等价于"[^A-Za-z0-9_]"。

\num

匹配num个，其中num为一个正整数。引用回到记住的匹配。例如，"(.)\1"匹配两个连续的相同的字符。

匹配n，其中n是一个八进制换码值。八进制换码值必须是1,2或3个数字长。例如，"\11"和"\011"都与一个制表符匹配。"\0011"等价于"\001"与"1"。八进制换码值不得超过256。否则，只有前两个字符被视为表达式的一部分。允许在正则表达式中使用ASCII码。

#########################################

正则表达式示例

表达式
匹配

/^\s*$/

匹配空行。

/\d{2}-\d{5}/

验证由两位数字、一个连字符再加 5 位数字组成的 ID 号。

/<\s*(\S+)(\s[^>]*)?>[\s\S]*<\s*\/\1\s*>/

匹配 HTML 标记。

下表包含了元字符的完整列表以及它们在正则表达式上下文中的行为：

字符
说明

将下一字符标记为特殊字符、文本、反向引用或八进制转义符。例如，“n”匹配字符“n”。“\n”匹配换行符。序列“\\”匹配“\”，“\(”匹配“(”。

匹配输入字符串开始的位置。如果设置了 RegExp 对象的 Multiline 属性，^ 还会与“\n”或“\r”之后的位置匹配。

匹配输入字符串结尾的位置。如果设置了 RegExp 对象的 Multiline 属性，$ 还会与“\n”或“\r”之前的位置匹配。

零次或多次匹配前面的字符或子表达式。例如，zo* 匹配“z”和“zoo”。* 等效于 {0,}。

一次或多次匹配前面的字符或子表达式。例如，“zo+”与“zo”和“zoo”匹配，但与“z”不匹配。+ 等效于 {1,}。

零次或一次匹配前面的字符或子表达式。例如，“do(es)?”匹配“do”或“does”中的“do”。? 等效于 {0,1}。

{n}

n 是非负整数。正好匹配 n 次。例如，“o{2}”与“Bob”中的“o”不匹配，但与“food”中的两个“o”匹配。

{n,}

n 是非负整数。至少匹配 n 次。例如，“o{2,}”不匹配“Bob”中的“o”，而匹配“foooood”中的所有 o。“o{1,}”等效于“o+”。“o{0,}”等效于“o*”。

{n,m}

M 和 n 是非负整数，其中 n <= m。匹配至少 n 次，至多 m 次。例如，“o{1,3}”匹配“fooooood”中的头三个 o。’o{0,1}’ 等效于 ‘o?’。注意：您不能将空格插入逗号和数字之间。

当此字符紧随任何其他限定符（*、+、?、{n}、{n,}、{n,m}）之后时，匹配模式是“非贪心的”。“非贪心的”模式匹配搜索到的、尽可能短的字符串，而默认的“贪心的”模式匹配搜索到的、尽可能长的字符串。例如，在字符串“oooo”中，“o+?”只匹配单个“o”，而“o+”匹配所有“o”。

匹配除“\n”之外的任何单个字符。若要匹配包括“\n”在内的任意字符，请使用诸如“[\s\S]”之类的模式。

(pattern)

匹配 pattern 并捕获该匹配的子表达式。可以使用 $0…$9 属性从结果“匹配”集合中检索捕获的匹配。若要匹配括号字符 ( )，请使用“$”或者“$”。

(?:pattern)

匹配 pattern 但不捕获该匹配的子表达式，即它是一个非捕获匹配，不存储供以后使用的匹配。这对于用“or”字符 (|) 组合模式部件的情况很有用。例如，’industr(?:y|ies) 是比 ‘industry|industries’ 更经济的表达式。

(?=pattern)

执行正向预测先行搜索的子表达式，该表达式匹配处于匹配 pattern 的字符串的起始点的字符串。它是一个非捕获匹配，即不能捕获供以后使用的匹配。例如，’Windows (?=95|98|NT|2000)’ 匹配“Windows 2000”中的“Windows”，但不匹配“Windows 3.1”中的“Windows”。预测先行不占用字符，即发生匹配后，下一匹配的搜索紧随上一匹配之后，而不是在组成预测先行的字符后。

(?!pattern)

执行反向预测先行搜索的子表达式，该表达式匹配不处于匹配 pattern 的字符串的起始点的搜索字符串。它是一个非捕获匹配，即不能捕获供以后使用的匹配。例如，’Windows (?!95|98|NT|2000)’ 匹配“Windows 3.1”中的 “Windows”，但不匹配“Windows 2000”中的“Windows”。预测先行不占用字符，即发生匹配后，下一匹配的搜索紧随上一匹配之后，而不是在组成预测先行的字符后。

x|y

匹配 x 或 y。例如，’z|food’ 匹配“z”或“food”。'(z|f)ood’ 匹配“zood”或“food”。

[xyz]

字符集。匹配包含的任一字符。例如，“[abc]”匹配“plain”中的“a”。

[^xyz]

反向字符集。匹配未包含的任何字符。例如，“[^abc]”匹配“plain”中的“p”。

[a-z]

字符范围。匹配指定范围内的任何字符。例如，“[a-z]”匹配“a”到“z”范围内的任何小写字母。

[^a-z]

反向范围字符。匹配不在指定的范围内的任何字符。例如，“[^a-z]”匹配任何不在“a”到“z”范围内的任何字符。

匹配一个字边界，即字与空格间的位置。例如，“er\b”匹配“never”中的“er”，但不匹配“verb”中的“er”。

非字边界匹配。“er\B”匹配“verb”中的“er”，但不匹配“never”中的“er”。