Go 语言入门很简单:正则表达式(上)

简介: 在计算中,我们经常需要将特定模式的字符或字符子集匹配为另一个字符串中的字符串。此技术用于使用特别的语法来搜索给定字符串中的特定字符集。比如邮件、手机号、身份证号等等。如果搜索到的模式匹配,或者在目标字符串中找到给定的子集,则搜索被称为成功;否则被认为是不成功的。那么此时该用到正则表达式了。

网络异常,图片无法展示
|


前言

在计算中,我们经常需要将特定模式的字符或字符子集匹配为另一个字符串中的字符串。此技术用于使用特别的语法来搜索给定字符串中的特定字符集。比如邮件、手机号、身份证号等等。

如果搜索到的模式匹配,或者在目标字符串中找到给定的子集,则搜索被称为成功;否则被认为是不成功的。

那么此时该用到正则表达式了。

什么是正则表达式

正则表达式(或 RegEx)是一个特殊的字符序列,它定义了用于匹配特定文本的搜索模式。在 Golang 中,有一个内置的正则表达式包:  regexp  包,其中包含所有操作列表,如过滤、修改、替换、验证或提取。

正则表达式可以用于文本搜索和更高级的文本操作。正则表达式内置于 grep 和 sed 等工具,vi 和 emacs 等文本编辑器,Go、Java 和 Python 等编程语言中。


表达式的语法主要遵循这些流行语言中使用的已建立的 RE2 语法。 RE2 语法是 PCRE 的一个子集,有各种注意事项。


以下是正则表达式模式表格:


网络异常,图片无法展示
|


Go 语言的 regexp 包中有几个典型的函数:

  • MatchString()
  • Compile()
  • FindString()
  • FindAllString()
  • FindStringIndex()
  • FindAllStringIndex()
  • FindStringSubmatch()
  • Split()
  • ReplaceAllString
  • ReplaceAllStringFunc()


现在来一一看看这些函数的使用

MatchString 函数

MatchString() 函数报告作为参数传递的字符串是否包含正则表达式模式的任何匹配项。

 package main
 ​
 import (
   "fmt"
   "log"
   "regexp"
 )
 ​
 func main() {
 ​
   words := [...]string{"Seven", "even", "Maven", "Amen", "eleven"}
 ​
   for _, word := range words {
 ​
     found, err := regexp.MatchString(".even", word)
 ​
     if err != nil {
       log.Fatal(err)
     }
 ​
     if found {
 ​
       fmt.Printf("%s matches\n", word)
     } else {
 ​
       fmt.Printf("%s does not match\n", word)
     }
   }
 }
 ​

运行该代码:

 Seven matches
 even does not match
 Maven does not match
 Amen does not match
 eleven matches

但同时我们能看到编辑器有提示:

网络异常,图片无法展示
|

编译器已经开始提醒我们,MatchString 直接使用性能很差,所以考虑使用 regexp.Compile 函数。

Compile 函数

Compile 函数解析正则表达式,如果成功,则返回可用于匹配文本的 Regexp 对象。编译的正则表达式产生更快的代码。

MustCompile 函数是一个便利函数,它编译正则表达式并在无法解析表达式时发生 panic。

 package main
 ​
 import (
   "fmt"
   "log"
   "regexp"
 )
 ​
 func main() {
 ​
   words := [...]string{"Seven", "even", "Maven", "Amen", "eleven"}
 ​
   re, err := regexp.Compile(".even")
 ​
   if err != nil {
     log.Fatal(err)
   }
 ​
   for _, word := range words {
 ​
     found := re.MatchString(word)
 ​
     if found {
 ​
       fmt.Printf("%s matches\n", word)
     } else {
 ​
       fmt.Printf("%s does not match\n", word)
     }
   }
 }
 ​

在代码示例中,我们使用了编译的正则表达式。

 re, err := regexp.Compile(".even")

即使用 Compile 编译正则表达式。然后在返回的正则表达式对象上调用 MatchString 函数:

 found := re.MatchString(word)

运行程序,能看到同样的代码:

 Seven matches
 even does not match
 Maven does not match
 Amen does not match
 eleven matches

MustCompile 函数

 package main
 ​
 import (
   "fmt"
   "regexp"
 )
 ​
 func main() {
 ​
   words := [...]string{"Seven", "even", "Maven", "Amen", "eleven"}
 ​
   re := regexp.MustCompile(".even")
 ​
   for _, word := range words {
 ​
     found := re.MatchString(word)
 ​
     if found {
 ​
       fmt.Printf("%s matches\n", word)
     } else {
 ​
       fmt.Printf("%s does not match\n", word)
     }
   }
 }

FindAllString 函数

FindAllString 函数返回正则表达式的所有连续匹配的切片。

 package main
 ​
 import (
     "fmt"
     "os"
     "regexp"
 )
 ​
 func main() {
 ​
     var content = `Foxes are omnivorous mammals belonging to several genera 
 of the family Canidae. Foxes have a flattened skull, upright triangular ears, 
 a pointed, slightly upturned snout, and a long bushy tail. Foxes live on every 
 continent except Antarctica. By far the most common and widespread species of 
 fox is the red fox.`
 ​
     re := regexp.MustCompile("(?i)fox(es)?")
 ​
     found := re.FindAllString(content, -1)
 ​
     fmt.Printf("%q\n", found)
 ​
     if found == nil {
         fmt.Printf("no match found\n")
         os.Exit(1)
     }
 ​
     for _, word := range found {
         fmt.Printf("%s\n", word)
     }
 ​
 }

在代码示例中,我们找到了单词 fox 的所有出现,包括它的复数形式。

 re := regexp.MustCompile("(?i)fox(es)?")

使用 (?i) 语法,正则表达式不区分大小写。 (es)?表示“es”字符可能包含零次或一次。

 found := re.FindAllString(content, -1)

我们使用 FindAllString 查找所有出现的已定义正则表达式。第二个参数是要查找的最大匹配项; -1 表示搜索所有可能的匹配项。

运行结果:

 ["Foxes" "Foxes" "Foxes" "fox" "fox"]
 Foxes
 Foxes
 Foxes
 fox
 fox

FindAllStringIndex 函数

 package main
 ​
 import (
     "fmt"
     "regexp"
 )
 ​
 func main() {
 ​
     var content = `Foxes are omnivorous mammals belonging to several genera 
 of the family Canidae. Foxes have a flattened skull, upright triangular ears, 
 a pointed, slightly upturned snout, and a long bushy tail. Foxes live on every 
 continent except Antarctica. By far the most common and widespread species of 
 fox is the red fox.`
 ​
     re := regexp.MustCompile("(?i)fox(es)?")
 ​
     idx := re.FindAllStringIndex(content, -1)
 ​
     for _, j := range idx {
         match := content[j[0]:j[1]]
         fmt.Printf("%s at %d:%d\n", match, j[0], j[1])
     }
 }

在代码示例中,我们在文本中找到所有出现的 fox 单词及其索引。

 Foxes at 0:5
 Foxes at 81:86
 Foxes at 196:201
 fox at 296:299
 fox at 311:314
相关文章
|
4天前
|
监控 Linux PHP
【02】客户端服务端C语言-go语言-web端PHP语言整合内容发布-优雅草网络设备监控系统-2月12日优雅草简化Centos stream8安装zabbix7教程-本搭建教程非docker搭建教程-优雅草solution
【02】客户端服务端C语言-go语言-web端PHP语言整合内容发布-优雅草网络设备监控系统-2月12日优雅草简化Centos stream8安装zabbix7教程-本搭建教程非docker搭建教程-优雅草solution
51 20
|
2天前
|
存储 监控 算法
探秘员工泄密行为防线:基于Go语言的布隆过滤器算法解析
在信息爆炸时代,员工泄密行为对企业构成重大威胁。本文聚焦布隆过滤器(Bloom Filter)这一高效数据结构,结合Go语言实现算法,帮助企业识别和预防泄密风险。通过构建正常操作“指纹库”,实时监测员工操作,快速筛查可疑行为。示例代码展示了如何利用布隆过滤器检测异常操作,并提出优化建议,如调整参数、结合日志分析系统等,全方位筑牢企业信息安全防线,守护核心竞争力。
|
10天前
|
Go C语言
Go语言入门:分支结构
本文介绍了Go语言中的条件语句,包括`if...else`、`if...else if`和`switch`结构,并通过多个练习详细解释了它们的用法。`if...else`用于简单的条件判断;`if...else if`处理多条件分支;`switch`则适用于基于不同值的选择逻辑。特别地,文章还介绍了`fallthrough`关键字,用于优化重复代码。通过实例如判断年龄、奇偶数、公交乘车及成绩等级等,帮助读者更好地理解和应用这些结构。
34 14
|
24天前
|
存储 监控 算法
内网监控系统之 Go 语言布隆过滤器算法深度剖析
在数字化时代,内网监控系统对企业和组织的信息安全至关重要。布隆过滤器(Bloom Filter)作为一种高效的数据结构,能够快速判断元素是否存在于集合中,适用于内网监控中的恶意IP和违规域名筛选。本文介绍其原理、优势及Go语言实现,提升系统性能与响应速度,保障信息安全。
28 5
|
1月前
|
算法 安全 Go
Go语言中的加密和解密是如何实现的?
Go语言通过标准库中的`crypto`包提供丰富的加密和解密功能,包括对称加密(如AES)、非对称加密(如RSA、ECDSA)及散列函数(如SHA256)。`encoding/base64`包则用于Base64编码与解码。开发者可根据需求选择合适的算法和密钥,使用这些包进行加密操作。示例代码展示了如何使用`crypto/aes`包实现对称加密。加密和解密操作涉及敏感数据处理,需格外注意安全性。
46 14
|
1月前
|
Go 数据库
Go语言中的包(package)是如何组织的?
在Go语言中,包是代码组织和管理的基本单元,用于集合相关函数、类型和变量,便于复用和维护。包通过目录结构、文件命名、初始化函数(`init`)及导出规则来管理命名空间和依赖关系。合理的包组织能提高代码的可读性、可维护性和可复用性,减少耦合度。例如,`stringutils`包提供字符串处理函数,主程序导入使用这些函数,使代码结构清晰易懂。
95 11
|
1月前
|
存储 安全 Go
Go语言中的map数据结构是如何实现的?
Go 语言中的 `map` 是基于哈希表实现的键值对数据结构,支持快速查找、插入和删除操作。其原理涉及哈希函数、桶(Bucket)、动态扩容和哈希冲突处理等关键机制,平均时间复杂度为 O(1)。为了确保线程安全,Go 提供了 `sync.Map` 类型,通过分段锁实现并发访问的安全性。示例代码展示了如何使用自定义结构体和切片模拟 `map` 功能,以及如何使用 `sync.Map` 进行线程安全的操作。
|
9天前
|
监控 关系型数据库 MySQL
【01】客户端服务端C语言-go语言-web端PHP语言整合内容发布-优雅草网络设备监控系统-硬件设备实时监控系统运营版发布-本产品基于企业级开源项目Zabbix深度二开-分步骤实现预计10篇合集-自营版
【01】客户端服务端C语言-go语言-web端PHP语言整合内容发布-优雅草网络设备监控系统-硬件设备实时监控系统运营版发布-本产品基于企业级开源项目Zabbix深度二开-分步骤实现预计10篇合集-自营版
19 0
|
1月前
|
监控 安全 算法
深度剖析核心科技:Go 语言赋能局域网管理监控软件进阶之旅
在局域网管理监控中,跳表作为一种高效的数据结构,能显著提升流量索引和查询效率。基于Go语言的跳表实现,通过随机化索引层生成、插入和搜索功能,在高并发场景下展现卓越性能。跳表将查询时间复杂度优化至O(log n),助力实时监控异常流量,保障网络安全与稳定。示例代码展示了其在实际应用中的精妙之处。
44 9
|
2月前
|
算法 安全 Go
Go 语言中实现 RSA 加解密、签名验证算法
随着互联网的发展,安全需求日益增长。非对称加密算法RSA成为密码学中的重要代表。本文介绍如何使用Go语言和[forgoer/openssl](https://github.com/forgoer/openssl)库简化RSA加解密操作,包括秘钥生成、加解密及签名验证。该库还支持AES、DES等常用算法,安装简便,代码示例清晰易懂。
64 12

热门文章

最新文章