Python正则表达式教程之一：基础篇

更新时间：2017年03月02日 10:13:26 作者：一根笨茄子

正则表达式并不是Python的一部分。正则表达式是用于处理字符串的强大工具，拥有自己独特的语法以及一个独立的处理引擎，效率上可能不如str自带的方法，但功能十分强大。下面这篇文章主要介绍了关于Python正则表达式基础的相关资料，需要的朋友可以参考下。

前言

之前有人提了一个需求，我一看此需求用正则表达式最合适不过。考虑到之前每次使用正则表达式，都是临时抱佛脚，于是这次我就一边完成任务一边系统的学习了一遍正则表达式。主要参考PyCon2016上的一个视频Regular Expressions。

我将分几篇文章对正则表达式进行总结。

以下是第一部分，基础：

基础部分

这里总结了正则表达式最基础的用法，其中大部分内容对我（以及大部分程序员）来说都是平时经常用到的，所以我就一笔带过了，只对其中的几处用例子说明。

. 除了换行之外的其他所有字符

^ 行首

$ 行尾

[abcd] abcd其中的一个字符

[^abcd] 除了abcd之外的任意字符

[a-d] 相当于[abcd]

[a-dz] 相当于[abcdz]

\b 单词边界

\w 字母数字或下划线相当于[a-zA-Z0-9_]

\W 与\w相反

\d 数字，相当于[0-9]

\D 与\d相反

\s 空白字符，相当于[ \t\n\r\f\v]

\S 与\s相反

{5} 在此之前的正则表达式部分（下同）准确的出现5次

{2,5} ~出现2到5次

{2,} ~出现2次或多次

{,5} ~出现0到5次

* ~出现0次或多次

？ ~出现0次或1次

+ ~出现1次或多次

ABC|DEF 匹配ABC或者DEF

\ 转义字符，如\表示匹配*，\$表示匹配$*

\b、 \用以下几个例子简单说明一下：

\b：

>>> re.search(r'\bhello\b', 'hello')
<_sre.SRE_Match object; span=(0, 5), match='hello'>
>>> re.search(r'\bhello\b', 'hello world')
<_sre.SRE_Match object; span=(0, 5), match='hello'>
>>> re.search(r'\bhello\b', 'hello,world')
<_sre.SRE_Match object; span=(0, 5), match='hello'>
>>> re.search(r'\bhello\b', 'hello_world') 
>>>

其实这里，\b大体上和\W一支，但是\b可以匹配行首行尾等非显示类的字符，而\W不可以。

>>> re.search(r'\$100', '$100')
<_sre.SRE_Match object; span=(0, 4), match='$100'>
>>> re.search(r'$100', '$100') 
>>>

想要匹配那些在正则表达式中有特殊含义的字符，如$、^、*等，就需要用\进行转义。

raw string:

另外，前面例子中，模式字符串（pattern）前面都加了一个r，这个r的意思是raw string，后面所接的字符串，Pyhton解释器无需对其进行转义。因为，\在Python字符串中和正则表达式中都有特殊含义，所以如果不是raw string，那么要表达一个\字符，就需要四个\了（在Python解释器中先转义一次，2个\表示1个\，剩下2个\，在正则表达式中又转义一次，最终剩下一个\）。例如：

>>> re.search(r'\bhello\b', 'hello')
<_sre.SRE_Match object; span=(0, 5), match='hello'>
>>> re.search('\bhello\b', 'hello') 
>>> re.search('\\bhello\\b', 'hello')
<_sre.SRE_Match object; span=(0, 5), match='hello'>

>>> re.search('\\\\hello\\\\', '\\hello\\') 
<_sre.SRE_Match object; span=(0, 7), match='\\hello\\'>
>>> re.search(r'\\hello\\', '\\hello\\') 
<_sre.SRE_Match object; span=(0, 7), match='\\hello\\'>
>>> print('\\hello\\')
\hello\

总结

以上就是关于Python正则表达式之基础的全部内容了，有了这些知识，正则表达式的基本运用就没什么问题了。对于一些特殊情况，还需要掌握另外一些高级用法，敬请期待后续文章。希望本文的内容对大家的学习或者工作能带来一定的帮助，如果有疑问大家可以留言交流，如果有疑问大家可以留言交流。

您可能感兴趣的文章:

Python自动录入ERP系统数据
这篇文章主要介绍了Python如何自动录入ERP系统数据，用Python解决Excel问题的最佳方法，文章中有详细的代码示例，需要的朋友可以参考阅读
2023-04-04
Python文件常见操作实例分析【读写、遍历】
这篇文章主要介绍了Python文件常见操作,结合实例形式分析Python针对文件的读写、遍历等相关操作技巧,需要的朋友可以参考下
2018-12-12
解决hive中导入text文件遇到的坑
这篇文章主要介绍了解决hive中导入text文件遇到的坑，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2021-04-04
Python 实现驱动AI机器人
这篇文章主要介绍了Python 实现驱动AI机器人,下文围绕利用Python 实现驱动AI机器人的相关资料展开内容，需要的小伙伴可以参考一下
2022-02-02
Python 文件处理注意事项总结
这篇文章主要介绍了Python 文件处理注意事项总结的相关资料,需要的朋友可以参考下
2017-04-04
Python缺失值处理方法
这篇文章主要介绍了Python缺失值处理方法，文章围绕主题展开详细内容介绍，具有一定的参考价值，需要的小伙伴可以参考一下
2022-05-05
深度学习Tensorflow2.8实现GRU文本生成任务详解
这篇文章主要为大家介绍了深度学习Tensorflow 2.8 实现 GRU 文本生成任务示例详解，有需要的朋友可以借鉴参考下，希望能够有所帮助，祝大家多多进步，早日升职加薪
2023-01-01
使用Python实现ELT统计多个服务器下所有数据表信息
这篇文章主要介绍了使用Python实现ELT统计多个服务器下所有数据表信息,ETL，是英文Extract-Transform-Load的缩写，用来描述将数据从来源端经过抽取(extract)、转换(transform)、加载(load)至目的端的过程,需要的朋友可以参考下
2023-07-07
Tensorflow中批量读取数据的案列分析及TFRecord文件的打包与读取
这篇文章主要介绍了Tensorflow中批量读取数据的案列分析及TFRecord文件的打包与读取,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2020-06-06
python简单的三元一次方程求解实例
这篇文章主要介绍了python简单的三元一次方程求解实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-04-04

Python正则表达式教程之一：基础篇

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具