假设您的输入字符串是有效的 UTF-8,这个线程 (Golang - ToUpper() on a single byte?) 就足够接近了,虽然不是完全完美的副本。我们可以在此基础上,在字符串的第一个 rune 上使用 unicode.ToUpper 得出一个可接受的解决方案。
r := []rune(s)
r[0] = unicode.ToUpper(r[0])
s := string(r)
或者使用“聪明”的单线:
s := string(append([]rune{unicode.ToUpper(r[0])}, r[1:]...))
与字符串不同,符文切片不是不可变的,因此您可以将第一个符文替换为 ToUpper,这将处理非 ASCII 和/或具有大写字母的多字节代码点(例如俄语)和别管那些不知道的(例如亚洲脚本)
注意: UPPER case 和 TITLE case 是有区别的,简单解释here。简而言之,像DŽ 这样的二合字母将有不同的标题大小写(Dž,只有第一个字素大写)和大写(DŽ,两个字素都大写)。如果您确实需要大写字母,请使用unicode.ToTitle。
注意 2: 在string 和[]rune 之间的转换涉及复制,因为您从不可变字符串中获得了可变切片。如果您希望在对性能敏感的代码中使用您的应用程序,请对其进行分析。
游乐场:https://go.dev/play/p/HpCBM7cRflZ
如果您有一个相当大的输入字符串,其中完整的符文切片转换变得过于昂贵,您可以在某个分隔符上使用带上限的strings.SplitN 来解决此问题,本质上是提取文本的第一个单词并仅在转换:
sep := " "
ss := strings.SplitN(s, sep, 2)
r := []rune(ss[0])
r[0] = unicode.ToUpper(r[0])
s = string(r) + sep + ss[1])
使用约 30K 输入字符串进行基准测试显示出显着差异:
go test -v -bench=. -benchmem
goos: darwin
goarch: arm64
pkg: example.com
BenchmarkRuneConv-10 6376 183691 ns/op 258049 B/op 3 allocs/op
BenchmarkSplitN-10 1709989 706.1 ns/op 4152 B/op 3 allocs/op
PASS
ok example.com 3.477s