首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >Go程序例子(18):字符串与“字符”

Go程序例子(18):字符串与“字符”

原创
作者头像
用户11078756
发布2024-12-13 10:26:59
发布2024-12-13 10:26:59
3100
举报
文章被收录于专栏:go程序例子go程序例子

Go 字符串是一个只读的字节切片。Go 语言及其标准库将字符串特殊处理——它们被视为以 UTF-8 编码的文本容器。在其他语言中,字符串由“字符”组成。而在 Go 中,“字符”的概念被称为 rune,它是表示 Unicode 代码点的整数。这篇 Go 官方博客文章是一个很好的入门资源。

代码语言:go
复制
package main

import (
    "fmt"
    "unicode/utf8"
)

func main() {
	// s 是一个字符串,赋值为表示泰语中“hello”一词的字面量。Go 的字符串字面量是以 UTF-8 编码的文本。
    const s = "สวัสดี"
	// 由于字符串等价于 []byte,这将返回存储在其中的原始字节的长度。
    fmt.Println("Len:", len(s))
	// 对字符串进行索引会返回每个索引处的原始字节值。这个循环会生成字符串 s 中构成代码点的所有字节的十六进制值。
    for i := 0; i < len(s); i++ {
        fmt.Printf("%x ", s[i])
    }
    fmt.Println()
	// 要计算字符串中有多少个 rune,可以使用 utf8 包。需要注意的是,RuneCountInString 的运行时间取决于字符串的大小,因为它需要逐个解码每个 UTF-8 rune。一些泰语字符由多个字节的 UTF-8 代码点表示,因此计数结果可能会令人意外。
    fmt.Println("Rune count:", utf8.RuneCountInString(s))
	// range 循环对字符串进行了特殊处理,会解码每个 rune 及其在字符串中的偏移量。
    for idx, runeValue := range s {
        fmt.Printf("%#U starts at %d\n", runeValue, idx)
    }
	// 我们可以通过显式使用 utf8.DecodeRuneInString 函数实现相同的迭代效果。
    fmt.Println("\nUsing DecodeRuneInString")
    for i, w := 0, 0; i < len(s); i += w {
        runeValue, width := utf8.DecodeRuneInString(s[i:])
        fmt.Printf("%#U starts at %d\n", runeValue, i)
        w = width
		// 这展示了将一个 rune 值传递给函数的用法。
        examineRune(runeValue)
    }
}

func examineRune(r rune) {
	// 用单引号括起来的值是 rune 字面量。我们可以直接将一个 rune 值与 rune 字面量进行比较。
    if r == 't' {
        fmt.Println("found tee")
    } else if r == 'ส' {
        fmt.Println("found so sua")
    }
}

运行结果:

代码语言:javascript
复制
➜ go run main.go
Len: 18
e0 b8 aa e0 b8 a7 e0 b8 b1 e0 b8 aa e0 b8 94 e0 b8 b5 
Rune count: 6
U+0E2A 'ส' starts at 0
U+0E27 'ว' starts at 3
U+0E31 'ั' starts at 6
U+0E2A 'ส' starts at 9
U+0E14 'ด' starts at 12
U+0E35 'ี' starts at 15

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档