正则表达式的应用

2016-02-19 13:47 5 1 收藏

下面是个正则表达式的应用教程,撑握了其技术要点,学起来就简单多了。赶紧跟着图老师小编一起来看看吧!

【 tulaoshi.com - Web开发 】

一、正则表达式概述 

二、正则表达式在VBScript中的应用 

三、正则表达式在VavaScript中的应用 

四、示例

 

(本文来源于图老师网站,更多请访问http://www.tulaoshi.com/webkaifa/)

一、正则表达式概述 

如果原来没有使用过正则表达式,那么可能对这个术语和概念会不太熟悉。不过,它们并不是您想象的那么新奇。 

请回想一下在硬盘上是如何查找文件的。您肯定会使用 ? 和 * 字符来帮助查找您正寻找的文件。? 字符匹配文件名中的单个字符,而 * 则匹配一个或多个字符。一个如 ''data?.dat'' 的模式可以找到下述文件:data1.dat、data2.dat等等。如果使用 * 字符代替 ? 字符,则将扩大找到的文件数量。''data*.dat'' 可以匹配下述所有文件名:data.dat、data1.dat、data12.dat等等,尽管这种搜索文件的方法肯定很有用,但也十分有限。? 和 * 通配符的有限能力可以使你对正则表达式能做什么有一个概念,不过正则表达式的功能更强大,也更灵活。 

在我们编写ASP程序时,经常会判断一个字符串的有效性,如;一个串是否是数字、是否是有效的Email地址等等。如果不使用正则表达式,那么判断的程序会很长,并且容易出错,如果使用正则表达式,这些判断就是一件很轻松的工作了。后面我们将介绍如何判断数字和Email地址的有效性。 

在典型的搜索和替换操作中,必须提供要查找的确切文字。这种技术对于静态文本中的简单搜索和替换任务可能足够了,但是由于它缺乏灵活性,因此在搜索动态文本时就有困难了,甚至是不可能的。

使用正则表达式,能完成些什么事情呢? 

测试字符串的某个模式。例如,可以对一个输入字符串进行测试,看在该字符串是否存在一个电话号码模式或一个信用卡号码模式。这称为数据有效性验证。 

替换文本。可以在文档中使用一个正则表达式来标识特定文字,然后可以全部将其删除,或者替换为别的文字。 

根据模式匹配从字符串中提取一个子字符串。可以用来在文本或输入字段中查找特定文字。 

例如,如果需要搜索整个 web 站点来删除某些过时的材料并替换某些HTML 格式化标记,则可以使用正则表达式对每个文件进行测试,看在该文件中是否存在所要查找的材料或 HTML 格式化标记。用这个方法,就可以将受影响的文件范围缩小到包含要删除或更改的材料的那些文件。然后可以使用正则表达式来删除过时的材料,最后,可以再次使用正则表达式来查找并替换那些需要替换的标记。 

那么,正则表达式语法的语法是如何呢? 

一个正则表达式就是由普通字符(例如字符 a 到 z)以及特殊字符(称为元字符)组成的文字模式。该模式描述在查找文字主体时待匹配的一个或多个字符串。正则表达式作为一个模板,将某个字符模式与所搜索的字符串进行匹配。 

这里有一些可能会遇到的正则表达式示例: 

/^[ ]*$/ "^[ ]*$" 匹配一个空白行。 

/d{2}-d{5}/ "d{2}-d{5}" 验证一个ID 号码是否由一个2位数字,一个连字符以及一个5位数字组成。 

/(.*).*/1/ "(.*).*/1" 匹配一个 HTML 标记。

 

(本文来源于图老师网站,更多请访问http://www.tulaoshi.com/webkaifa/)

二、正则表达式在VBScript中的应用 

VBScript使用RegExp对象、Matches集合以及Match对象提供正则表达式支持功能。我们还是先看一个例子。 



Function RegExpTest(patrn, strng) 

Dim regEx, Match, Matches   ''建立变量。 

Set regEx = New RegExp   ''建立正则表达式。 

regEx.Pattern = patrn  ''设置模式。 

regEx.IgnoreCase = True   ''设置是否区分字符大小写。 

regEx.Global = True   ''设置全局可用性。 

Set Matches = regEx.Execute(strng)  ''执行搜索。 

For Each Match in Matches  ''遍历匹配集合。 

RetStr = RetStr & "Match found at position " 

RetStr = RetStr & Match.FirstIndex & ". Match Value is ''" 

RetStr = RetStr & Match.Value & "''." & "BR" 

Next 

RegExpTest = RetStr 

End Function 

response.write RegExpTest("[ij]s.", "IS1 Js2 IS3 is4") 



在这个例子中,我们查找字符串中有无is或者js这两个词,忽略大小写。运行的结果如下: 

Match found at position 0. Match Value is ''IS1''. 

Match found at position 4. Match Value is ''Js2''. 

Match found at position 8. Match Value is ''IS3''. 

Match found at position 12. Match Value is ''is4''. 

下面我们就介绍这三个对象和集合。 

1、RegExp对象是最重要的一个对象,它有几个属性,其中: 

○Global 属性,设置或返回一个 Boolean 值,该值指明在整个搜索字符串时模式是全部匹配还是只匹配第一个。如果搜索应用于整个字符串,Global 属性的值为 True,否则其值为 False。默认的设置为 False。 

○IgnoreCase 属性,设置或返回一个Boolean值,指明模式搜索是否区分大小写。如果搜索是区分大小写的,则 IgnoreCase 属性为 False;否则为 True。缺省值为 False。 

○Pattern 属性,设置或返回被搜索的正则表达式模式。必选项。总是一个 RegExp 对象变量。 

2、Match 对象 

匹配搜索的结果是存放在Match对象中,提供了对正则表达式匹配的只读属性的访问。 Match 对象只能通过 RegExp 对象的 Execute 方法来创建,该方法实际上返回了 Match 对象的集合。所有的 Match 对象属性都是只读的。在执行正则表达式时,可能产生零个或多个 Match 对象。每个 Match 对象提供了被正则表达式搜索找到的字符串的访问、字符串的长度,以及找到匹配的索引位置等。 

○FirstIndex 属性,返回在搜索字符串中匹配的位置。FirstIndex 属性使用从零起算的偏移量,该偏移量是相对于搜索字符串的起始位置而言的。换言之,字符串中的第一个字符被标识为字符 0 

○Length 属性,返回在字符串搜索中找到的匹配的长度。 

○Value 属性,返回在一个搜索字符串中找到的匹配的值或文本。 

3、Matches 集合 

正则表达式 Match 对象的集合。Matches 集合中包含若干独立的 Match 对象,只能使用 RegExp 对象的 Execute 方法来创建之。与独立的 Match 对象属性相同,Matches `集合的一个属性是只读的。在执行正则表达式时,可能产生零个或多个 Match 对象。每个 Match 对象都提供了与正则表达式匹配的字符串的访问入口、字符串的长度,以及标识匹配位置的索引。 

学习了这三个对象和集合,如何应用于字符串的判断和替换呢?regExp对象的三个方法正好解决了这个问题,它们是Replace方法、Test方法和Execute方法。 

1、Replace 方法 

替换在正则表达式查找中找到的文本。我们还是先看个例子:下面的例子说明了 Replace 方法的用法。 



Function ReplaceTest(patrn, replStr) 

Dim regEx, str1 '' 建立变量。 

str1 = "The quick brown fox jumped over the lazy dog." 

Set regEx = New RegExp '' 建立正则表达式。 

regEx.Pattern = patrn '' 设置模式。 

regEx.IgnoreCase = True '' 设置是否区分大小写。 

ReplaceTest = regEx.Replace(str1, replStr) '' 作替换。 

End Function 

Response.write ReplaceTest("fox", "cat") & "BR" '' 将 ''fox'' 替换为 ''cat''。 

Response.write ReplaceTest("(S+)(s+)(S+)", "$3$2$1") '' 交换词对. 



2、Test 方法 

对指定的字符串执行一个正则表达式搜索,并返回一个 Boolean 值指示是否找到匹配的模式。正则表达式搜索的实际模式是通过RegExp对象的Pattern属性来设置的。RegExp.Global属性对Test方法没有影响。 

如果找到了匹配的模式,Test方法返回True;否则返回False。下面的代码说明了Test 方法的用法。



Function RegExpTest(patrn, strng) 

Dim regEx, retVal '' 建立变量。 

Set regEx = New RegExp '' 建立正则表达式。 

regEx.Pattern = patrn '' 设置模式。 

regEx.IgnoreCase = False '' 设置是否区分大小写。 

retVal = regEx.Test(strng) '' 执行搜索测试。 

If retVal Then 

RegExpTest = "找到一个或多个匹配。" 

Else 

RegExpTest = "未找到匹配。" 

End If 

End Function 

Response.write RegExpTest("is.", "IS1 is2 IS3 is4") 



3、Execute 方法 

对指定的字符串执行正则表达式搜索。正则表达式搜索的设计模式是通过 RegExp 对象的 Pattern 来设置的。 

Execute 方法返回一个 Matches 集合,其中包含了在 string 中找到的每一个匹配的 Match 对象。如果未找到匹配,Execute 将返回空的 Matches 集合。

 

(本文来源于图老师网站,更多请访问http://www.tulaoshi.com/webkaifa/)

三、JavaScript中正则表达式的使用 

在JavaScript 1.2版以后,JavaScript也支持正则表达式。 

1、replace 

replace在一个字符串中通过正则表达式查找替换相应的内容。replace并不改变原来的字符串,只是重新生成了一个新的字符串。如果需要执行全局查找或忽略大小写,那么在正则表达式的最后添加g和i。

例: 

SCRIPT 

re = /apples/gi; 

str = "Apples are round, and apples are juicy."; 

newstr=str.replace(re, "oranges"); 

document.write(newstr) 

/SCRIPT 

结果是:"oranges are round, and oranges are juicy." 

例: 

SCRIPT 

str = "Twas the night before Xmas..."; 

newstr=str.replace(/xmas/i, "Christmas"); 

document.write(newstr) 

/SCRIPT 

结果是:"Twas the night before Christmas..." 

例: 

SCRIPT 

re = /(w+)s(w+)/;str = "John Smith"; 

newstr = str.replace(re, "$2, $1"); 

document.write(newstr) 

/SCRIPT 

结果是:"Smith, John". 

2、search 

search通过正则表达式查找相应的字符串,只是判断有无匹配的字符串。如果查找成功,search返回匹配串的位置,否则返回-1。 

(本文来源于图老师网站,更多请访问http://www.tulaoshi.com/webkaifa/)

      search(regexp) 

SCRIPT 

function testinput(re, str){ 

if (str.search(re) != -1) 

midstring = " contains "; 

else 

midstring = " does not contain "; 

document.write (str + midstring + re.source); 



testinput(/^[1-9]/i,"123") 

/SCRIPT 

3、match 

match方法执行全局查找,查找结果存放在一个数组里。 

例一: 

SCRIPT 

str = "For more information, see Chapter 3.4.5.1"; 

re = /(chapter d+(.d)*)/i; 

found = str.match(re); 

document.write(found); 

/SCRIPT 

显示结果:Chapter 3.4.5.1,Chapter 3.4.5.1,.1 

例二: 

SCRIPT 

str = "abcDdcba"; 

newArray = str.match(/d/gi); 

document.write(newArray); 

/SCRIPT 

显示结果D, d.

 

(本文来源于图老师网站,更多请访问http://www.tulaoshi.com/webkaifa/)

四、示例 

1 、判断数字的正确性 

%@ Language=VBScript % 

script language="javascript" runat="server" 

function isNumeric(strNumber) { 

return (strNumber.search(/^(-|+)?d+(.d+)?$/) != -1); 



function isUnsignedNumeric(strNumber) { 

return (strNumber.search(/^d+(.d+)?$/) != -1); 



function isInteger(strInteger) { 

return (strInteger.search(/^(-|+)?d+$/) != -1); 



function isUnsignedInteger(strInteger) { 

return (strInteger.search(/^d+$/) != -1); 



/script 

HTML 

BODY 

b判断数字的正确性/b 



Dim strTemp 

strTemp = CStr(Request.Form("inputstring")) 

If strTemp = "" Then strTemp = "0" 



TABLE BORDER="1" CELLPADDING="4" CELLSPACING="2" 

TR 

TD ALIGN="right"B原始字符串/B/TD 

TD%= strTemp %/TD 

/TR 

TR 

TD ALIGN="right"B数字/B/TD 

TD%=isNumeric(strTemp)%/TD 

/TR 

TR 

TD ALIGN="right"B非负数字/B/TD 

TD%=isUnsignedNumeric(strTemp)%/TD 

/TR 

TR 

TD ALIGN="right"B整数/B/TD 

TD%=isInteger(strTemp)%/TD 

/TR 

TR 

TD ALIGN="right"B非负整数()/B/TD 

TD%=isUnsignedInteger(strTemp)%/TD 

/TR 

/TABLE 

FORM ACTION="%=Request.ServerVariables("SCRIPT_NAME")%" METHOD="post" 

请输入一个数字:BR 

INPUT TYPE="text" NAME="inputstring" SIZE="50"/INPUTBR 

INPUT TYPE="submit" Value="提交"/INPUTBR 

/FORM 

/BODY 

/HTML 

2、判断Email地址的正确性 



Function isemail(strng) 

isemail = false 

Dim regEx, Match 

Set regEx = New RegExp 

regEx.Pattern = "^w+((-w+)|(.w+))*@[A-Za-z0-9]+((.|-)[A-Za-z0-9]+)*.[A-Za-z0-9]+$" 

regEx.IgnoreCase = True 

Set Match = regEx.Execute(strng) 

if match.count then isemail= true 

End Function 

来源:http://www.tulaoshi.com/n/20160219/1605243.html

延伸阅读
标签: Web开发
####################### #作者:雨浪 版权所有,翻版说一下 # #QQ:270499458 # ####################### 近段日子几个刚学了正则表达式的朋友问我在asp中怎么用.呵呵.虽然简单,还是写出来吧,正则表达式的基本知识我就不说了.其实已经有...
标签: Web开发
前言 正则表达式是烦琐的,但是强大的,学会之后的应用会让你除了提高效率外,会给你带来绝对的成就感。只要认真去阅读这些资料,加上应用的时候进行一定的参考,掌握正则表达式不是问题。 索引 1. 引子 目前,正则表达式已经在很多软件中得到广泛的应用,包括*nix(Linux, Unix等),HP等操作系统,PHP,C#,Java等开发环境,以...
标签: Web开发
最后写了一个IP地址的正则表达式验证程序。 代码如下: ((25[0-5]|2[0-4]\d|1?\d?\d)\.){3}(25[0-5]|2[0-4]\d|1?\d?\d) 截图如下:
标签: ASP
       最近很多帖子问如何将内容从数据库取出后换行,这就要用到正则表达式。简单的说,正则表达式是一种可以用于模式匹配和替换的强有力的工具。我们可以在许多编程语言中找到正则表达式的身影,例如,vi编辑器,Perl或PHP脚本语言,以及awk或sed shell程序等。此外,象JavaScript这种客户端的脚本语言也...
标签: ASP
  14.后向引用 正则表达式一个最重要的特性就是将匹配成功的模式的某部分进行存储供以后使用这一能力。请回想一下,对一个正则表 达式模式或部分模式两边添加圆括号将导致这部分表达式存储到一个临时缓冲区中。可以使用非捕获元字符 '?:', '?=', or '?!' 来忽略对这部分正则表达式的保存。 所捕获的每个子匹配都按照在正则表达式模式中...

经验教程

644

收藏

66
微博分享 QQ分享 QQ空间 手机页面 收藏网站 回到头部