使用Ruby re模块创建复杂的正则表达式

 更新时间:2014年03月21日 11:03:58   作者:  
复杂的正则表达式很难构建,甚至很难阅读。Ruby的Re模块可以帮助你利用简单的表达式构建复杂的正则表达式
例如,考虑下面的匹配日期的正则表达式:
复制代码 代码如下:
/\A((?:19|20)[0-9]{2})[\- \/.](0[1-9]|1[012])[\- \/.](0[1-9]|[12][0-9]|3[01])\z/

使用Re之后,正则表达式可以短小易读的表达式为基础,一步一步地构建出来,例如:
复制代码 代码如下:

require 're'

include Re

delim                = re.any("- /.")
century_prefix       = re("19") | re("20")
under_ten            = re("0") + re.any("1-9")
ten_to_twelve        = re("1") + re.any("012")
ten_and_under_thirty = re.any("12") + re.any("0-9")
thirties             = re("3") + re.any("01")

year = (century_prefix + re.digit.repeat(2)).capture(:year)
month = (under_ten | ten_to_twelve).capture(:month)
day = (under_ten | ten_and_under_thirty | thirties).capture(:day)

date = (year + delim + month + delim + day).all


虽然代码量增加了,但是每个部分都很短小,也很容易验证。同时,捕获的部分可以通过相应的变量名访问:
复制代码 代码如下:

result = date.match("2009-01-23")
result[:year]      # => "2009"
result[:month]     # => "01"
result[:day]       # => "23"

注意,用Re构建正则表达式会很慢,所以推荐创建正则表达式并复用。匹配的时候,性能和原生的正则表达式很接近。(额外的方法调用和创建Re::Result以返回匹配结果影响一点点性能。)如果你需要追求极致的性能,你仍然可以使用Re来构建正则表达式,然后抽取出原始的Ruby Regexp来匹配。这样的话,性能就和使用原生正则表达式一样了。

例如,构建匹配电话号码的正则表达式:

复制代码 代码如下:

PHONE_RE = re.digit.repeat(3).capture(:area) +
               re("-") +
               re.digit.repeat(3).capture(:exchange) +
               re("-") +
               re.digit.repeat(4)).capture(:subscriber)

然后抽取出原始的正则对象,直接使用它来匹配:
复制代码 代码如下:

PHONE_REGEXP = PHONE_RE.regexp

if PHONE_REGEXP =~ string
  # blah blah blah
end

相关文章

  • 实例解析Ruby中的数值类型以及常量

    实例解析Ruby中的数值类型以及常量

    这篇文章主要介绍了Ruby中的数值类型以及常量,是Ruby入门学习中的基础知识,需要的朋友可以参考下
    2015-10-10
  • 使用Ruby来编写访问Twitter的命令行应用程序的教程

    使用Ruby来编写访问Twitter的命令行应用程序的教程

    这篇文章主要介绍了使用Ruby来编写访问Twitter的命令行应用程序的教程,文章来自于IBM官方网站技术文档,需要的朋友可以参考下
    2015-04-04
  • ruby基本数据类型简明介绍

    ruby基本数据类型简明介绍

    这篇文章主要介绍了ruby基本数据类型简明介绍,本文讲解了数值类型、字符串、区间、数组、散列表、符号等基本数据类型,需要的朋友可以参考下
    2015-05-05
  • CentOS7下搭建ruby on rails开发环境

    CentOS7下搭建ruby on rails开发环境

    听说rails是一个比较流行的快速开发框架,对于我这个web不熟悉的人来说,那是极好的!可以快速上手,又能真正了解服务器端的各种,所以rails搞起来。不过一个完整的开发环境搭建过程完成后,真的只能用各种坑来形容~
    2016-02-02
  • RUBY 新手教程 跟我一起学ruby

    RUBY 新手教程 跟我一起学ruby

    从今天起我就要开始学Ruby了。怎么样,没见吧?一个新人写教程。就凭我坚强的毅力,科学的自学方法,以及我的钻研精神,我有信心学通Ruby,而同样是新手的你也可以!
    2011-01-01
  • 编写Ruby脚本来对Twitter用户的数据进行深度挖掘

    编写Ruby脚本来对Twitter用户的数据进行深度挖掘

    这篇文章主要介绍了编写Ruby脚本来对Twitter用户的数据进行深度挖掘的一些例子,通过调用Twitter API来实现各种功能(内地注意墙),需要的朋友可以参考下
    2015-11-11
  • 详细解析Ruby中的变量

    详细解析Ruby中的变量

    这篇文章主要介绍了详细解析Ruby中的变量,是Ruby学习中最基础的知识之一,需要的朋友可以参考下
    2015-05-05
  • 对优化Ruby on Rails性能的一些办法的探究

    对优化Ruby on Rails性能的一些办法的探究

    这篇文章主要介绍了对优化Ruby on Rails性能的一些办法的一些探究,包括避免内存密集型的应用和GC等相关问题的探讨,需要的朋友可以参考下
    2015-11-11
  • rudy 重载方法 详解

    rudy 重载方法 详解

    rudy 重载方法 详解...
    2007-11-11
  • 详解Ruby中的块的知识

    详解Ruby中的块的知识

    这篇文章主要介绍了详解Ruby中的块的知识,包括yield语句和begin/end块等知识点,需要的朋友可以参考下
    2015-05-05

最新评论