<转载>常用的正则表达式

2009年10月28日星期三 09:39 A.M.

匹配中文字符的正则表达式： [\u4e00-\u9fa5]

匹配双字节字符(包括汉字在内)：[^\x00-\xff]

匹配空白行的正则表达式：\n\s*\r

匹配HTML标记的正则表达式：< (\S*?)[^>]*>.*?|< .*? />，这个得改改

匹配首尾空白字符的正则表达式：^\s*|\s*$

匹配Email地址的正则表达式：\w+([-+.]\w+)*@\w+([-.]\w+)*\.\w+([-.]\w+)*

匹配网址URL的正则表达式：[a-zA-z]+://[^\s]*

匹配帐号是否合法(字母开头，允许5-16字节，允许字母数字下划线)：
^[a-zA-Z][a-zA-Z0-9_]{4,15}$

匹配国内电话号码：\d{3}-\d{8}|\d{4}-\d{7}

匹配腾讯QQ号：[1-9][0-9]{4,}

匹配中国邮政编码：[1-9]\d{5}(?!\d)

匹配身份证：\d{15}|\d{18}

匹配ip地址：\d+\.\d+\.\d+\.\d+

匹配特定数字：
^[1-9]\d*$　　 //匹配正整数
^-[1-9]\d*$ 　 //匹配负整数
^-?[1-9]\d*$　　 //匹配整数
^[1-9]\d*|0$　 //匹配非负整数（正整数 + 0）
^-[1-9]\d*|0$　　 //匹配非正整数（负整数 + 0）
^[1-9]\d*\.\d*|0\.\d*[1-9]\d*$　　 //匹配正浮点数
^-([1-9]\d*\.\d*|0\.\d*[1-9]\d*)$　 //匹配负浮点数
^-?([1-9]\d*\.\d*|0\.\d*[1-9]\d*|0?\.0+|0)$　 //匹配浮点数
^[1-9]\d*\.\d*|0\.\d*[1-9]\d*|0?\.0+|0$　　 //匹配非负浮点数（正浮点数 + 0）
^(-([1-9]\d*\.\d*|0\.\d*[1-9]\d*))|0?\.0+|0$　　//匹配非正浮点数（负浮点数 +
0）

匹配特定字符串：
^[A-Za-z]+$　　//匹配由26个英文字母组成的字符串
^[A-Z]+$　　//匹配由26个英文字母的大写组成的字符串
^[a-z]+$　　//匹配由26个英文字母的小写组成的字符串
^[A-Za-z0-9]+$　　//匹配由数字和26个英文字母组成的字符串
^\w+$　　//匹配由数字、26个英文字母或者下划线组成的字符串

匹配身份证：\d{15}|\d{18} 有问题啊，应该是
\d{15}|\d{18}|(\d{17}x$)

新版身份证最后一位是’x’

各个开发语言和工具对正则表达式的原子符的支持程度也不同。
perl对\d, \w 等原子符都有支持，但是grep, awk就不支持这两个原字符。
egrep对\w支持，但是对\d不支持。

posted on 2009-11-10 09:55 念时阅读(187) 评论(0) 编辑收藏举报