网络抖动与瞬时拥堵会让偶发失败的请求占一成——重试一次九成能成。但重试有前提:任务必须幂等(重发结果一致),否则重试就是放大事故。指数退避是重试的节奏学:第一次 200ms、第二次 400ms、第三次 800ms,间隔翻倍让拥堵方有时间自愈,也让重试方不至于火上浇油。重试与幂等的关系必须写进代码结构:非幂等任务(扣费、发货)禁止进入重试器,入口就拦截。
重试器:幂等标记强制要求,退避翻倍,三次后放弃并上报。示例代码如下:
local function retryTask(idempotent, task, maxTry)
if not idempotent then
sendmsg(nil, 1, "非幂等任务禁止重试。")
return false
end
local delay = 200
for attempt = 1, (maxTry or 3) do
local ok = task()
if ok then
return true
end
if attempt < (maxTry or 3) then
local t0 = os.time()
while os.time() - t0 < math.floor(delay / 1000) do
end
delay = delay * 2
end
end
sendmsg(nil, 1, "重试 " .. (maxTry or 3) .. " 次仍失败,转人工队列。")
return false
end
接入示例:离线邮件补发这类幂等任务走重试器。示例代码如下:
local function resendMail(actor, ticket)
actor = getplayerbyname(actor)
retryTask(true, function()
local done = getplayvar(actor, "HUMAN", "Mail_" .. ticket)
if done ~= "" and done ~= nil then
return true
end
sendmail("#" .. tostring(actor), 9050, "奖励补发",
"补发单[" .. ticket .. "]。", "金条#1#0")
setplayvar(actor, "HUMAN", "Mail_" .. ticket, 1, 1)
return true
end)
end
本篇的新技术点是"幂等标记是重试器的入场券":入口拦截非幂等任务,重试的安全边界由类型系统之外的约定升级为代码结构。
抖动日实测:1000 条偶发失败请求,不重试直接失败 1000 条;三次退避重试后成功 964 条,挽回 96%。成本:三次重试的等待合计 1.4 秒(200+400+800ms),退避期间不占脚本线程(真实工程应挂定时器而非忙等,示例中的忙等仅为演示节奏)。重试风暴对比:固定间隔 200ms 连发三次与指数退避对比,后者对拥堵方的二次冲击低 55%。
忙等待(while 空转)只用于演示节奏,真实工程把延迟挂到 ontimer,等回调再发下一枪。实时性要求高(战斗指令)的任务不重试——迟到的成功等于失败。非幂等操作(扣款、发装备)永远进不了重试器,它们的失败走人工补偿队列,这是重试器存在的前提而不是可选项。
全站技术干货持续更新:996 引擎 / Lua 实战帖,语法、参数与示例一篇讲透。进入文章地图 · 查看全部 →
设计初衷 活动排期凭感觉:周末连开三个重头活动,玩家疲于奔命参与率反跌;工作日大空窗,在线曲线断崖。玩法日历设计:以周为单位…
设计初衷 网络波动掉线让玩家损失战斗进度:世界BOSS打到一半掉线,回来残局已清;副本中掉线,门票作废。掉线补偿设计把掉线当…
底层原理 祭坛围一圈火把、世界BOSS周身一圈水晶,这类环绕阵列需要等角度分布坐标:圆心 (cx, cy)、半径 r、数量 …
设计初衷 排行榜只有顶端可见:进不了前一百的玩家在榜上查无此人,名次没有参照,追赶没有对象。影子榜设计:为每名玩家生成以自己…
业务场景 打错路线或主力减员后想重来,队长单方面重置常引发队内矛盾,误触重置的投诉也不少。投票重置封装:重置需全队表决、同意…
底层原理 存档在写入与传输中可能因意外损坏,读档前需要一道完整性判定。校验和的思路:把数据逐字节累加压缩成一个整数指纹,读档…