← 返回目录
ap6.1实操⏱ 约 12 分钟

兜底与降级:模型挂了,产品不能跟着挂

实测——重试让可用性纹丝不动、耗时涨 3.5 倍;熔断器让它快 2.5 倍

🔎 最后验证 2026-08📚 来源:本节四种策略对比为 ECS 实测(2026-08,主通道用不可路由地址模拟宕机,备用通道为真实 DeepSeek,脚本与原始输出见本节代码)🧰 Python、DeepSeek API
为什么学这个

ap1.1 教过重试:超时、限流、5xx——该重试的重试。那一节的结论在那一节是对的。

但这一节要打破它:当服务是"挂了"而不是"抖了一下"的时候,重试是这套体系里最没用、也最贵的动作。

实测:主模型宕机,12 次请求——

  • 只用主模型:成功 0/12,耗时 36 秒;
  • 加上重试 3 次:成功还是 0/12,耗时 126 秒;
  • 失败就切备用:12/12,49 秒;
  • 再加个熔断器:12/12,20 秒

重试把耗时涨了 3.5 倍,可用性一点没动。这一节讲的就是:什么时候该重试,什么时候该换条路走。

💡 打个比方

你开车去公司,前面路口堵死了。

重试 = 在原地按喇叭,过一会儿再按一次、再按一次。 降级 = 掉头走另一条路,虽然远一点但到得了。 熔断器 = 记住这条路今天堵死了,接下来一小时不再去试,直接走备用路线。

按喇叭对"临时会车"有用,对"路塌了"毫无意义——而你在原地按喇叭的每一秒,用户都在盯着一个转圈的加载动画。

智图软件的赞赏码
都看到这了,打个赏呗!
接下来 · ap6.2
提示注入攻防:实测 4 种防御,没有一种能靠自己赢
继续读下一节 →