ap6.1实操⏱ 约 12 分钟
兜底与降级:模型挂了,产品不能跟着挂
实测——重试让可用性纹丝不动、耗时涨 3.5 倍;熔断器让它快 2.5 倍
🔎 最后验证 2026-08📚 来源:本节四种策略对比为 ECS 实测(2026-08,主通道用不可路由地址模拟宕机,备用通道为真实 DeepSeek,脚本与原始输出见本节代码)🧰 Python、DeepSeek API
为什么学这个
ap1.1 教过重试:超时、限流、5xx——该重试的重试。那一节的结论在那一节是对的。
但这一节要打破它:当服务是"挂了"而不是"抖了一下"的时候,重试是这套体系里最没用、也最贵的动作。
实测:主模型宕机,12 次请求——
- 只用主模型:成功 0/12,耗时 36 秒;
- 加上重试 3 次:成功还是 0/12,耗时 126 秒;
- 失败就切备用:12/12,49 秒;
- 再加个熔断器:12/12,20 秒。
重试把耗时涨了 3.5 倍,可用性一点没动。这一节讲的就是:什么时候该重试,什么时候该换条路走。
💡 打个比方
你开车去公司,前面路口堵死了。
重试 = 在原地按喇叭,过一会儿再按一次、再按一次。 降级 = 掉头走另一条路,虽然远一点但到得了。 熔断器 = 记住这条路今天堵死了,接下来一小时不再去试,直接走备用路线。
按喇叭对"临时会车"有用,对"路塌了"毫无意义——而你在原地按喇叭的每一秒,用户都在盯着一个转圈的加载动画。

都看到这了,打个赏呗!
接下来 · ap6.2
提示注入攻防:实测 4 种防御,没有一种能靠自己赢
继续读下一节 →