← 返回概念解读

Concept Fable精修版

模型回退

Model Fallback · Reliability pattern

先读故事。这里不急着给定义,先让问题自己长出来。

寓言故事

主桥封住时,商队不该停在雨里

雨季里,商队过河全靠北桥。北桥宽、稳、收费高,却能让货车准时到城。掌柜把所有路线都押在这座桥上,觉得最好的桥自然该承担所有通行。

一天夜里山洪冲断桥面,清晨三十辆货车堵在雨里。车夫们等修桥,药材泡湿,鲜果发酸,客户的宴席也误了时辰。

掌柜第一次修补,是派人催桥匠快修。桥匠再快,也要半天。商队真正需要的不是催促,而是在主路不可用时仍能继续前进。

第二次,他让车夫临时找小渡口。有人找到了浅滩,却不能过重车;有人绕去南桥,多花一倍路费;还有人走散,货单全乱。

老管事提前画了备用路册。北桥正常时走北桥;若桥封且货物轻,走东渡;若货物贵重,转南桥并通知客户改时辰;若两路都断,先入最近仓房保货。

下一场洪水来时,车队没有停在雨里。不同货物按备用路分流,路费和延迟都被记录,客户也提前收到新到达时间。

掌柜明白,依赖最强的一条路并不等于可靠。可靠来自主路失败时,有可接受的替代、清楚的触发条件和对结果的持续交代。

后来掌柜还给备用路定期试走。没出事时,也让空车偶尔过东渡和南桥,确认船夫、仓房和通知方式仍在。备用路若只写在册子里,从未验证,真出事时也可能断。可靠需要平时维护,而不是灾时才想起。 老管事还提醒车夫,备用不等于更差,有时是为了保住承诺。主桥最快,东渡便宜,南桥稳,仓房能保货。不同失败对应不同退路,商队才不会被单点事故拖垮。 后来客户反而更信任商队,因为他们知道坏天气来时也有人管下一步。 这句话后来被写进新人的手册里,提醒大家先看现场代价,再谈省力。 也正因为这层提醒,后来再遇到相似难题时,众人不会急着套旧办法。 他们学会先问哪一步承担风险,再决定该放手、该收紧,还是该重排流程。

揭示

这个故事讲的是:模型回退

Model fallback 是当主模型或供应商失败、超时、超预算或违反策略时,把请求路由到备用模型或供应商的可靠性模式。它需要预先定义触发条件、备用模型能力、质量降级、成本边界、数据权限、用户影响和人工接管。对企业 Agent,fallback 可避免单点模型故障导致整条工作流停摆。

它重要的地方在于:它不只是一个术语,而是在真实 AI / Agent 系统里会反复出现的结构性问题。理解它,才能判断什么时候该加模型,什么时候该改流程,什么时候该补治理。

隐喻映射

  • 主桥:主力模型、模型供应商或首选推理路径
  • 旧渡口和山路:备用模型、备用供应商、本地模型或人工处理
  • 要求主桥不再坏:只依赖供应商承诺的天真修补
  • 封闭、拥堵、收费超预算:错误、超时、限流、成本和策略触发条件
  • 预先写清备用路线:fallback policy 和 routing rules
  • 定期试走备用路:fallback drill 和 evals
  • 承诺分级处理:SLA、优先级和 graceful degradation
  • 最后洞察:模型回退用预先设计的替代路径保护业务连续性

Soloharness 判断

这个概念的实战价值,是帮你把“看起来聪明的 AI 功能”拆成可交付、可验收、可治理的工作单元。

provider routingmodel gatewayfailoverLiteLLMreliabilitySLA

相关辨析

这个概念容易和相邻概念混用,建议继续看对比页。