在IOS里使用正则表达式

来源:互联网 发布:人工智能真的来了 jd 编辑:程序博客网 时间:2024/05/17 23:13
在没有学习正则表达式之前,我们可以用NSString的

rangeOfStringoptions:


等方法来实现对字符串的查询,但是这种查询方式有个问题,就是需要匹配一定规律的字符串,需要编写的代码就很庞大了。正则表达式就可以用来处理这类问题。


正则表达式,就是用来匹配一定规则的字符串。

正则表达式可以用于验证用户名,验证邮箱地址,验证出生日期,采集网页数据等等。

iOS 的SDK没有提供正则表达式的API,只提供了一个libicucore.dylib框架
所以在IOS中使用正则表达式,最好是调用第三方类库的方法。
本文演示的是RegexKitLite,是NSString的一个类目。

@interface NSString (RegexKitLiteAdditions)


1.首先要去下载一个RegexKitLite的文件夹。下载地址:http://www.cocoachina.com/bbs/job.php?action-download-pid-135286-tid-18111-aid-11143.html
2.然后把文件夹里的RegexKitLite.h和RegexKitLite.m两个文件添加到工程里。
3.添加libicucore.dylib框架。
4.引入RegexKitLite.h头文件。
#import "RegexKitLite.h"

这样就可以使用了。
以下列举一些常用的方法:

- (NSArray *)captureComponentsMatchedByRegex:(NSString *)regex;
字符串匹配,返回第一个匹配的字符串(数组)

NSString * email =@"abc@163.coma1c@163.coma2c@163.coma3c@163.coma4c@163.com";

        

       NSString * regex = @"[0-9]{1,3}";

       NSArray * result = [email captureComponentsMatchedByRegex:regex];

       for (NSString * strin result) {

           NSLog(@"%@",str);

        }

运行结果:

2013-08-13 16:35:40.052 20130813_zhengze[18190:303] 163


- (NSArray *)arrayOfCaptureComponentsMatchedByRegex:(NSString *)regex;
字符串匹配,返回所有匹配的字符串的(数组)

NSString * email =@"abc@163.coma1c@163.coma2c@163.coma3c@163.coma4c@163.com";

       NSString * regex = @"[a-z].[c]";

        NSArray * result = [emailarrayOfCaptureComponentsMatchedByRegex:regex];

       for (NSString * strin result) {

           NSLog(@"%@",str);

        }

运行结果:

2013-08-13 16:36:46.460 20130813_zhengze[18200:303] (

    abc

)

2013-08-13 16:36:46.462 20130813_zhengze[18200:303] (

    a1c

)

2013-08-13 16:36:46.462 20130813_zhengze[18200:303] (

    a2c

)

2013-08-13 16:36:46.463 20130813_zhengze[18200:303] (

    a3c

)

2013-08-13 16:36:46.463 20130813_zhengze[18200:303] (

    a4c

)


- (NSString *)stringByMatching:(NSString *)regex;
字符串匹配,返回匹配的字符串

  NSString * email =@"a1234567c@163.coma1c@163.coma2c@163.coma3c@163.coma4c@163.com";

       NSString * regex = @"[a-z].{1,3}[c]";

       NSString * result = [email stringByMatching:regex];

       NSLog(@"%@",result);

运行结果:

2013-08-13 16:26:11.621 20130813_zhengze[18177:303] oma1c


- (BOOL)isMatchedByRegex:(NSString *)regex;

字符串和正则表达式进行匹配,如果有匹配的,就返回YES

NSString * email = @"abc@163.com";

        if ([email isMatchedByRegex:@"\\b([a-zA-Z0-9%_.+\\-]+)@([a-zA-Z0-9.\\-]+?\\.[a-zA-Z]{2,6})\\b"]) {

            NSLog(@"匹配");

        }else{

            NSLog(@"不匹配");

        }

运行结果:

2013-08-13 16:38:38.615 20130813_zhengze[18221:303]匹配


- (NSString *)stringByReplacingOccurrencesOfRegex:(NSString *)regex withString:(NSString *)replacement;
查询字符串,替换匹配的字符串,返回替换后的字符串

NSString * email =@"a1234567c@163.coma1c@163.coma2c@163.coma3c@163.coma4c@163.com";

       NSString * regex = @"[a-z].[c]";

        NSString * result = [emailstringByReplacingOccurrencesOfRegex:regex withString:@"!!!!!"];

       NSLog(@"%@",result);

运行结果:

2013-08-13 16:37:37.310 20130813_zhengze[18207:303] a1234567c@163.com!!!!!@163.com!!!!!@163.com!!!!!@163.com!!!!!@163.com


以下是一些常用的正则表达式:

  匹配双字节字符(包括汉字在内):[^x00-xff] 

  评注:可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1) 
  匹配空白行的正则表达式:ns*r 
  评注:可以用来删除空白行 
  匹配HTML标记的正则表达式:<(S*?)[^>]*>.*?|<.*? /> 
  评注:网上流传的版本太糟糕,上面这个也仅仅能匹配部分,对于复杂的嵌套标记依旧无能为力 
  匹配首尾空白字符的正则表达式:^s*|s*$ 
  评注:可以用来删除行首行尾的空白字符(包括空格、制表符、换页符等等),非常有用的表达式 
  匹配Email地址的正则表达式:w+([-+.]w+)*@w+([-.]w+)*.w+([-.]w+)* 
  评注:表单验证时很实用 
  匹配网址URL的正则表达式:[a-zA-z]+://[^s]* 
  评注:网上流传的版本功能很有限,上面这个基本可以满足需求 
  匹配帐号是否合法(字母开头,允许5-16字节,允许字母数字下划线):^[a-zA-Z][a-zA-Z0-9_]{4,15}$ 
  评注:表单验证时很实用 
  匹配国内电话号码:d{3}-d{8}|d{4}-d{7} 
  评注:匹配形式如 0511-4405222 或 021-87888822 
  匹配腾讯QQ号:[1-9][0-9]{4,} 
  评注:腾讯QQ号从10000开始 
  匹配中国邮政编码:[1-9]d{5}(?!d) 
  评注:中国邮政编码为6位数字 
  匹配身份证:d{15}|d{18} 
  评注:中国的身份证为15位或18位 
  匹配ip地址:d+.d+.d+.d+ 
  评注:提取ip地址时有用 
  匹配特定数字: 
  ^[1-9]d*$    //匹配正整数 
  ^-[1-9]d*$   //匹配负整数 
  ^-?[1-9]d*$   //匹配整数 
  ^[1-9]d*|0$  //匹配非负整数(正整数 + 0)
  ^-[1-9]d*|0$   //匹配非正整数(负整数 + 0) 
  ^[1-9]d*.d*|0.d*[1-9]d*$   //匹配正浮点数 
  ^-([1-9]d*.d*|0.d*[1-9]d*)$  //匹配负浮点数 
  ^-?([1-9]d*.d*|0.d*[1-9]d*|0?.0+|0)$  //匹配浮点数 
  ^[1-9]d*.d*|0.d*[1-9]d*|0?.0+|0$   //匹配非负浮点数(正浮点数 + 0) 
  ^(-([1-9]d*.d*|0.d*[1-9]d*))|0?.0+|0$  //匹配非正浮点数(负浮点数 + 0) 
  评注:处理大量数据时有用,具体应用时注意修正 
  匹配特定字符串: 
  ^[A-Za-z]+$  //匹配由26个英文字母组成的字符串 
  ^[A-Z]+$  //匹配由26个英文字母的大写组成的字符串 
  ^[a-z]+$  //匹配由26个英文字母的小写组成的字符串 
  ^[A-Za-z0-9]+$  //匹配由数字和26个英文字母组成的字符串 
  ^w+$  //匹配由数字、26个英文字母或者下划线组成的字符串 
  在使用RegularExpressionValidator验证控件时的验证功能及其验证表达式介绍如下: 
  只能输入数字:“^[0-9]*$” 
  只能输入n位的数字:“^d{n}$” 
  只能输入至少n位数字:“^d{n,}$” 
  只能输入m-n位的数字:“^d{m,n}$” 
  只能输入零和非零开头的数字:“^(0|[1-9][0-9]*)$” 
  只能输入有两位小数的正实数:“^[0-9]+(.[0-9]{2})?$” 
  只能输入有1-3位小数的正实数:“^[0-9]+(.[0-9]{1,3})?$” 
  只能输入非零的正整数:“^+?[1-9][0-9]*$” 
  只能输入非零的负整数:“^-[1-9][0-9]*$” 
  只能输入长度为3的字符:“^.{3}$” 
  只能输入由26个英文字母组成的字符串:“^[A-Za-z]+$” 
  只能输入由26个大写英文字母组成的字符串:“^[A-Z]+$” 
  只能输入由26个小写英文字母组成的字符串:“^[a-z]+$” 
  只能输入由数字和26个英文字母组成的字符串:“^[A-Za-z0-9]+$” 
  只能输入由数字、26个英文字母或者下划线组成的字符串:“^w+$” 
  验证用户密码:“^[a-zA-Z]w{5,17}$”正确格式为:以字母开头,长度在6-18之间,
  只能包含字符、数字和下划线。 
  验证是否含有^%&',;=?$"等字符:“[^%&',;=?$x22]+” 
  只能输入汉字:“^[u4e00-u9fa5],{0,}$” 
  验证Email地址:“^w+[-+.]w+)*@w+([-.]w+)*.w+([-.]w+)*$” 
  验证InternetURL:“^http://([w-]+.)+[w-]+(/[w-./?%&=]*)?$” 
  验证电话号码:“^((d{3,4})|d{3,4}-)?d{7,8}$” 
  正确格式为:“XXXX-XXXXXXX”,“XXXX-XXXXXXXX”,“XXX-XXXXXXX”,
  “XXX-XXXXXXXX”,“XXXXXXX”,“XXXXXXXX”。 
  验证身份证号(15位或18位数字):“^d{15}|d{}18$” 
  验证一年的12个月:“^(0?[1-9]|1[0-2])$”正确格式为:“01”-“09”和“1”“12” 
  验证一个月的31天:“^((0?[1-9])|((1|2)[0-9])|30|31)$” 
  正确格式为:“01”“09”和“1”“31”。 
  匹配中文字符的正则表达式: [u4e00-u9fa5] 
  匹配双字节字符(包括汉字在内):[^x00-xff] 
  匹配空行的正则表达式:n[s| ]*r 
  匹配HTML标记的正则表达式:/<(.*)>.*|<(.*) />/ 
  匹配首尾空格的正则表达式:(^s*)|(s*$) 
  匹配Email地址的正则表达式:w+([-+.]w+)*@w+([-.]w+)*.w+([-.]w+)* 
  匹配网址URL的正则表达式:[url=http://%28[w-]+.%29+[w-]+%28/[w]http://([w-]+.)+[w-]+(/[w[/url]- ./?%&=]*)?











原创粉丝点击