RWRui Wang / Ideas
← All notes

Learn

Interlude - Regex

Interlude - Regex cover
这一章并非是一个正式章节,因为这一章要讲的内容和前后并没有太大的关系,也不连贯,所以按难度来划分,这一张排在了第三个Note的位置。


这一张,我们将讲解在Python里非常重要(至少个人认为)的一个语言:Regular Expressions。


regular expressions的第一个比较重要的作用就是找单一符合要求的元素,没错,就是这么简单。


这里给出一个简单的Cheat Sheet,不然的话后面的内容就会变得听天书了。

Screenshot 2026-08-04 at 22.49.38

这里摘自Google Gemini,shout out to google AI


具体怎么样搜寻呢?这里给出一个简单的例子,不需要完全理解原理,会用就可以了,因此这里不过多赘述。

import re

text = " I am an 18-year-olguy. "
match = re.search(r'\d+')

if(match):
    print(match.group())

#那么这里Match被赋的值是“18”

这里为什么match.group()打印出来是18,就不赘述了,大家可以看上表,考验一下大家。


第二个功能:找到全部符合要求的元素。


这里附上代码实现:

import re

text = "123-453-2144 and 134-435-2323"

match = re.findall(r'\d{3}-\d{4}-\d{3}', text)

#这里的match就等于这两串随机生成的电话号码(如有雷同,纯属无意冒犯)


第三个功能:替换


这里附上实现:

import re

text = "TheGoat: Micheal Jordan"

result = re.sub(r'TheGoat: ', '', text)
#这里result就是Micheal Jordan

我个人认为这个功能十分有用,当你在处理很多数据时,看到名字前的Title,这个个人就会不会非常得Distinctive,很烦。这时去掉前面的title,很爽。


最后,但不仅限于这些功能:分割一个String


附上代码:

import re

text = "We, Should; Seperate. the String From: Here"

result = re.split(r'[\s:;.,]', text)
#这样根据index的位置,分割一个字符


Regex的比较重要的功能及用法已经讲完了,显然,仍有大量的功能我没有提及,限于篇幅,就不一一列举了,今天(8.4)产出了两篇内容,真的算高产了,那我们下期见~88~