Go语言,string 实现原理

简介: 在 Go 中,string 不包含内存空间,它只有一个内存指针,所以 string 非常轻量,很方便进行传递且不用担心内存拷贝

string 概念

源代码中 src/builtin/builtin.go string 的描述如下:

// string is the set of all strings of 8-bit bytes, conventionally but not
// necessarily representing UTF-8-encoded text. A string may be empty, but
// not nil. Values of string type are immutable.
type string string
复制代码
  1. string 是所有 8 位字节字符串的集合,通常但不一定代表 UTF-8 编码的文本。
  2. 字符串可以为空(长度为0),但不会是 nil。
  3. 字符串类型的值是不可变的。

string 数据结构

源码包中 src/runtime/string.go:stringStruct 定义的 string 的数据结构如下:

type stringStruct struct {
  str unsafe.Pointer
  len int
}
复制代码
  • str : 字符串的首地址
  • len : 字符串的长度

发现 string 的数据结构有点类似于切片,切片比它多了一个容量成员。string 和 byte 切片经常互转。

string 操作

字符串的构建是先构建 stringStruct,再转换成 string:

//go:nosplit
func gostringnocopy(str *byte) string {
  ss := stringStruct{str: unsafe.Pointer(str), len: findnull(str)} // 先构造 stringStruct
  s := *(*string)(unsafe.Pointer(&ss)) // stringStruct 转换成 string
  return s
}
复制代码

[]byte 转 string

示例:

func ByteToString(s []byte) string {
  return string(s)
}
复制代码

注意这里的转换进行一次内存拷贝:

  1. 根据切片长度申请内存空间(假设内存地址为 p,切片长度为 len(b))
  2. 构建 string(string.str = p; string.len = len)
  3. 拷贝数据(切片中的数据拷贝到新的内存空间)

string 转 []byte

示例:

func StringToByte(str string) []byte {
  return []byte(str)
}
复制代码

注意这里的转换也会进行一次内存拷贝:

  1. 申请切片内存空间
  2. 将 string 拷贝到切片

字符串拼接

示例:

str := "str1" + "str2" + "str3" + "str4"
复制代码
  • 新字符串的内存空间是一次性分配好的,所以即使有很多的字符串进行拼接,性能也会有很好的保证。
  • 拼接语句在编译时会先放到一个切片中,然后再两次遍历此切片,一次获取字符串长度用来申请内存,一次用来把字符串逐个拷贝过去。
  • 由于 string 是不能修改的,源码在拼接过程中会用 rawstring() 方法生成一个指定大小的 string,并同时返回一个切片,二者共享同一块内存空间,后面向切片中拷贝数据,也就间接修改了 string。

rawstring()源代码如下:

// rawstring allocates storage for a new string. The returned
// string and byte slice both refer to the same storage.
// The storage is not zeroed. Callers should use
// b to set the string contents and then drop b.
func rawstring(size int) (s string, b []byte) {
  p := mallocgc(uintptr(size), nil, false)
  stringStructOf(&s).str = p
  stringStructOf(&s).len = size
  *(*slice)(unsafe.Pointer(&b)) = slice{p, size, size}
  return
}
复制代码

string 不能修改

在 Go 中,string 不包含内存空间,它只有一个内存指针,所以 string 非常轻量,很方便进行传递且不用担心内存拷贝。 string 通常指向字符串字面量,字面量存储的位置是只读段,并不是堆或栈上,所以 string 不能被修改。

[]byte 转 string 不拷贝内存的情况

有时只是临时需要字符串的场景下,byte切片转换成 string 时并不会拷贝内存,而是直接返回一个 string,这个 string 的指针指向切片的内存。

如:

  • 使用 m[string(b)] 来查找map(map是string为key,临时把切片 b 转成string)
  • 字符串拼接,如”<” + “string(b)” + “>”
  • 字符串比较:string(b) == “foo”

用 []byte 还是 string

[]byte 和 string 都可以表示字符串,它们数据结构不同,其衍生出来的方法也不同。

string 擅长的场景:

  • 需要字符串比较;
  • 不需要nil字符串;

[]byte擅长的场景:

  • 修改字符串的时候;
  • 函数返回值,需要使用 nil 来表示含义;
  • 需要切片操作;
相关文章
|
6天前
|
存储 安全 Java
【Golang】(4)Go里面的指针如何?函数与方法怎么不一样?带你了解Go不同于其他高级语言的语法
结构体可以存储一组不同类型的数据,是一种符合类型。Go抛弃了类与继承,同时也抛弃了构造方法,刻意弱化了面向对象的功能,Go并非是一个传统OOP的语言,但是Go依旧有着OOP的影子,通过结构体和方法也可以模拟出一个类。
53 1
|
2月前
|
Cloud Native 安全 Java
Go:为云原生而生的高效语言
Go:为云原生而生的高效语言
238 1
|
2月前
|
Cloud Native Go API
Go:为云原生而生的高效语言
Go:为云原生而生的高效语言
278 0
|
2月前
|
Cloud Native Java Go
Go:为云原生而生的高效语言
Go:为云原生而生的高效语言
193 0
|
2月前
|
Cloud Native Java 中间件
Go:为云原生而生的高效语言
Go:为云原生而生的高效语言
160 0
|
2月前
|
Cloud Native Java Go
Go:为云原生而生的高效语言
Go:为云原生而生的高效语言
243 0
|
2月前
|
数据采集 Go API
Go语言实战案例:多协程并发下载网页内容
本文是《Go语言100个实战案例 · 网络与并发篇》第6篇,讲解如何使用 Goroutine 和 Channel 实现多协程并发抓取网页内容,提升网络请求效率。通过实战掌握高并发编程技巧,构建爬虫、内容聚合器等工具,涵盖 WaitGroup、超时控制、错误处理等核心知识点。
|
2月前
|
数据采集 JSON Go
Go语言实战案例:实现HTTP客户端请求并解析响应
本文是 Go 网络与并发实战系列的第 2 篇,详细介绍如何使用 Go 构建 HTTP 客户端,涵盖请求发送、响应解析、错误处理、Header 与 Body 提取等流程,并通过实战代码演示如何并发请求多个 URL,适合希望掌握 Go 网络编程基础的开发者。
|
3月前
|
JSON 前端开发 Go
Go语言实战:创建一个简单的 HTTP 服务器
本篇是《Go语言101实战》系列之一,讲解如何使用Go构建基础HTTP服务器。涵盖Go语言并发优势、HTTP服务搭建、路由处理、日志记录及测试方法,助你掌握高性能Web服务开发核心技能。
|
3月前
|
Go
如何在Go语言的HTTP请求中设置使用代理服务器
当使用特定的代理时,在某些情况下可能需要认证信息,认证信息可以在代理URL中提供,格式通常是:
290 0

热门文章

最新文章