0

0

Go语言中如何正确遍历字符串并获取字符值

霞舞

霞舞

发布时间:2025-11-02 12:53:14

|

574人浏览过

|

来源于php中文网

原创

Go语言中如何正确遍历字符串并获取字符值

本文详细介绍了在go语言中如何正确遍历字符串以获取其字符值,而非原始的字节数值。通过深入理解go字符串的utf-8编码特性和`for...range`循环对字符串的处理机制,演示了如何利用`rune`类型和类型转换来准确地访问和打印字符串中的unicode字符,并提供了清晰的代码示例和注意事项。

在Go语言中处理字符串时,一个常见的需求是遍历字符串并访问其内部的单个字符。然而,由于Go字符串的内部表示是只读的字节切片([]byte),并且采用UTF-8编码,直接通过索引str[i]访问字符串元素通常会得到字节值,而不是我们期望的Unicode字符。这对于初学者来说可能是一个困惑点,尤其是在处理包含多字节UTF-8字符的字符串时。

Go语言字符串与UTF-8编码

Go语言中的字符串是不可变的字节序列。它默认使用UTF-8编码来表示Unicode字符。这意味着一个字符可能由一个或多个字节组成。例如,英文字符通常占用一个字节,而中文或某些特殊符号可能占用三个或更多字节。

当我们尝试使用传统的索引方式str[i]来访问字符串时,str[i]会返回在索引i处的字节值,其类型为byte(uint8的别名)。如果一个字符由多个字节组成,那么单独获取其中一个字节并不能代表完整的字符。

考虑以下示例代码,它展示了直接通过索引和range循环的初始尝试:

立即学习go语言免费学习笔记(深入)”;

package main

import "fmt"

func main() {
    str := "Hello"
    // 尝试1:直接通过索引和range的第二个返回值
    for i, elem := range str {
        // str[i] 返回的是字节值
        // elem 返回的是rune(Unicode码点)的int32表示
        fmt.Println(i, str[i], elem)
    }

    fmt.Println("\n--- 仅遍历索引 ---")
    // 尝试2:仅遍历range的索引
    for elem := range str { // 这里的elem实际上是索引i
        fmt.Println(elem)
    }
}

上述代码的输出可能会是这样:

0 72 72
1 101 101
2 108 108
3 108 108
4 111 111

--- 仅遍历索引 ---
0
1
2
3
4

可以看到,str[i]和elem(在第一个循环中)都输出了数字。str[i]输出的是字符'H'、'e'等的ASCII码(即字节值),而elem也输出了对应的Unicode码点(rune)的整数值。这与我们期望的直接打印字符'H'、'e'等有所不同。第二个循环for elem := range str实际上只迭代了字符串的字节索引,elem在这里是索引值。

使用 for...range 循环正确获取字符

在Go语言中,遍历字符串并获取其字符(Unicode码点)的正确方式是使用for...range循环。当for...range用于字符串时,它会迭代字符串中的Unicode码点。

数说Social Research
数说Social Research

社媒领域的AI Agent,全能营销智能助手

下载

其语法通常是 for index, runeValue := range stringVariable。

  • index:表示当前Unicode码点在字符串中第一个字节的起始索引。
  • runeValue:表示当前Unicode码点的,其类型为rune(int32的别名)。rune类型专门用于表示一个Unicode码点。

要将这个runeValue转换为可打印的字符形式,我们需要将其显式地转换为string类型。Go语言允许将单个rune值转换为一个包含该字符的字符串。

以下是实现所需输出的正确方法:

package main

import "fmt"

func main() {
    str := "Hello"

    fmt.Println("--- 仅打印字符 ---")
    for _, r := range str { // _ 忽略索引,r 是 rune 类型
        c := string(r) // 将 rune 转换为 string
        fmt.Println(c)
    }

    fmt.Println("\n--- 打印索引、码点和字符 ---")
    for i, r := range str { // i 是字节索引,r 是 rune 类型
        // r 是 int32 类型的 Unicode 码点值
        // string(r) 将该码点转换为对应的字符串字符
        fmt.Println(i, r, string(r))
    }

    fmt.Println("\n--- 包含多字节字符的示例 ---")
    multibyteStr := "你好Go"
    for i, r := range multibyteStr {
        fmt.Printf("索引: %d, Rune值: %d, 字符: %s\n", i, r, string(r))
    }
}

上述代码的输出将是:

--- 仅打印字符 ---
H
e
l
l
o

--- 打印索引、码点和字符 ---
0 72 H
1 101 e
2 108 l
3 108 l
4 111 o

--- 包含多字节字符的示例 ---
索引: 0, Rune值: 20320, 字符: 你
索引: 3, Rune值: 22909, 字符: 好
索引: 6, Rune值: 71, 字符: G
索引: 7, Rune值: 111, 字符: o

从输出中我们可以观察到:

  • 第一个循环成功地将每个字符单独打印出来。
  • 第二个循环展示了i是当前字符的起始字节索引,r是其Unicode码点(整数值),string(r)则将其转换为对应的字符。
  • 在处理多字节字符串"你好Go"时,可以看到"你"和"好"的索引分别是0和3,这意味着它们各占用了3个字节,而英文字符'G'和'o'则只占用1个字节。range循环正确地识别并处理了这些多字节字符。

注意事项与总结

  1. rune 类型的重要性: 在Go语言中,rune是int32的别名,专门用于表示一个Unicode码点。当你需要处理单个字符时,应始终考虑使用rune类型。
  2. string(r) 的转换: for...range循环返回的rune值是一个整数。要将其作为实际字符打印或使用,必须通过string(r)进行类型转换。
  3. 索引的含义: for...range循环中的index变量表示的是当前rune在原始字符串中UTF-8编码的第一个字节的索引,而不是字符的逻辑位置索引。这意味着对于多字节字符,后续字符的索引会跳跃。
  4. 无效UTF-8序列: 如果range循环遇到无效的UTF-8序列,它会将该序列视为一个字节,并将runeValue设置为0xFFFD(Unicode替换字符),然后继续处理下一个字节。

通过理解Go字符串的UTF-8编码特性和for...range循环的工作原理,我们可以有效地遍历字符串并准确地访问其字符值。始终记住,当需要处理Go字符串中的单个字符时,使用for i, r := range str并结合string(r)是推荐且最安全的方式。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
string转int
string转int

在编程中,我们经常会遇到需要将字符串(str)转换为整数(int)的情况。这可能是因为我们需要对字符串进行数值计算,或者需要将用户输入的字符串转换为整数进行处理。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

421

2023.08.02

js 字符串转数组
js 字符串转数组

js字符串转数组的方法:1、使用“split()”方法;2、使用“Array.from()”方法;3、使用for循环遍历;4、使用“Array.split()”方法。本专题为大家提供js字符串转数组的相关的文章、下载、课程内容,供大家免费下载体验。

298

2023.08.03

js截取字符串的方法
js截取字符串的方法

js截取字符串的方法有substring()方法、substr()方法、slice()方法、split()方法和slice()方法。本专题为大家提供字符串相关的文章、下载、课程内容,供大家免费下载体验。

212

2023.09.04

java基础知识汇总
java基础知识汇总

java基础知识有Java的历史和特点、Java的开发环境、Java的基本数据类型、变量和常量、运算符和表达式、控制语句、数组和字符串等等知识点。想要知道更多关于java基础知识的朋友,请阅读本专题下面的的有关文章,欢迎大家来php中文网学习。

1498

2023.10.24

字符串介绍
字符串介绍

字符串是一种数据类型,它可以是任何文本,包括字母、数字、符号等。字符串可以由不同的字符组成,例如空格、标点符号、数字等。在编程中,字符串通常用引号括起来,如单引号、双引号或反引号。想了解更多字符串的相关内容,可以阅读本专题下面的文章。

623

2023.11.24

java读取文件转成字符串的方法
java读取文件转成字符串的方法

Java8引入了新的文件I/O API,使用java.nio.file.Files类读取文件内容更加方便。对于较旧版本的Java,可以使用java.io.FileReader和java.io.BufferedReader来读取文件。在这些方法中,你需要将文件路径替换为你的实际文件路径,并且可能需要处理可能的IOException异常。想了解更多java的相关内容,可以阅读本专题下面的文章。

592

2024.03.22

php中定义字符串的方式
php中定义字符串的方式

php中定义字符串的方式:单引号;双引号;heredoc语法等等。想了解更多字符串的相关内容,可以阅读本专题下面的文章。

587

2024.04.29

go语言字符串相关教程
go语言字符串相关教程

本专题整合了go语言字符串相关教程,阅读专题下面的文章了解更多详细内容。

170

2025.07.29

拼多多赚钱的5种方法 拼多多赚钱的5种方法
拼多多赚钱的5种方法 拼多多赚钱的5种方法

在拼多多上赚钱主要可以通过无货源模式一件代发、精细化运营特色店铺、参与官方高流量活动、利用拼团机制社交裂变,以及成为多多进宝推广员这5种方法实现。核心策略在于通过低成本、高效率的供应链管理与营销,利用平台社交电商红利实现盈利。

31

2026.01.26

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Go 教程
Go 教程

共32课时 | 4.2万人学习

Go语言实战之 GraphQL
Go语言实战之 GraphQL

共10课时 | 0.8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号