用 #s 统计带中文的字符串长度,以为得到字符个数——# 返回的是字节数,UTF-8 里一个汉字占 3 字节,两个汉字的“长度”是 6。学员拿 6 去做显示宽度或截取边界,排版和切分全部错位。错误场景:
local s = "裁决"
print(#s)
输出 6——不是 2 个字,是 6 个字节;拿 6 当 6 个字符用必然错位。
需要字符个数时按 UTF-8 首字节计数,或改用定长逻辑。规范写法。示例代码如下:
local s = "裁决"
local _, count = string.gsub(s, "[\128-\255][\128-\191]*", "")
print(count + select(2, string.gsub(s, "[%1-\127]", "")) * 0)
更直白的逐字计数。示例代码如下:
local function charCount(s)
local n = 0
for _ in string.gmatch(s, "[\128-\255][\128-\191]*") do
n = n + 1
end
for _ in string.gmatch(s, "[%c\32-\126]") do
n = n + 1
end
return n
end
print(charCount("裁决AB"))
输出 4——两个汉字加两个字母,中文按字、英文按符分别计数。
三步验证:#s 对 "裁决" 返回 6 确认字节口径;charCount("裁决AB") 返回 4 确认字符口径;用同串对比两种口径的差值,理解字节与字符的换算关系。
按字符截取同样不能直接 sub——中文会被从字节中间切开变乱码。示例代码如下:
local s = "裁决之杖"
print(string.sub(s, 1, 6))
输出 裁决之(6 字节恰好是前两个汉字)——按 3 字节一步长截取才不会切碎汉字。
全站技术干货持续更新:996 引擎 / Lua 实战帖,语法、参数与示例一篇讲透。进入文章地图 · 查看全部 →
【游戏】 一、业务场景 帮会成员各自散在地图挂机,聊天频道冷冷清清,帮会没了人气。聚义厅上线:帮会驻地开放聚义同堂玩法,同厅…
【语法】 一、隐蔽陷阱 三类资源要在五个进程间分配:随手分出去,可能出现每个进程都差一点资源、互相等待的死局——逐种分配方案…
【游戏】 一、业务场景 帮会之间的摩擦全靠野外乱斗,多次引发大规模群架被官方警告。龙头棍玩法上线:每晚八点龙头棍刷新在公共据…
【游戏】 一、业务场景 敌对帮会夜间偷袭资源点,从东门到主坛传话靠人跑,信息到时资源已被搬空。烽火台上线:沿城墙三座烽火台逐…
【语法】 一、隐蔽陷阱 判断滑块开局能否还原,直接搜索穷举所有走法:状态数上万,一个局能跑几十秒——其实奇偶性一条规则即可判…
【语法】 一、隐蔽陷阱 变长编码压缩文本时按出现顺序随意编号:解码端无法切分,因为某个编码恰是另一个编码的前缀——哈夫曼树的…