← 返回概念解读

Concept Fable精修版

拒绝服务攻击

Denial-of-Service (DoS) on LLM · 攻击类型

先读故事。这里不急着给定义,先让问题自己长出来。

寓言故事

图书馆被一张无限借书单拖垮

城里的图书馆有一位很快的检索员。读者递问题,他就跑进书库,找资料、写摘要、交答案。普通问题几分钟就能完成,大家都夸馆里办事快。

后来有人发现,只要把问题写得足够长,要求他比较所有版本、引用所有脚注、再反复检查每条线索,检索员就会在书库里跑上一整天。捣乱者没有抢书,也没有砸门,只是递来一张看似认真的借书单。

馆长起初以为这是勤奋读者。于是规定检索员要尽量完整回答,不能轻易拒绝。队伍很快排到门外,真正赶着查药方、契约和路引的人,反而拿不到服务。

账房发现墨水、纸张和灯油消耗暴涨;检索员没有被偷走书,却被消耗到无法工作。有人建议买更多灯油、雇更多检索员。捣乱者立刻递来更长的借书单,还同时从几个门口排队。

第一次修补只是扩资源,成本跟着对方的胃口上涨。副馆长改了规则:每张借书单有长度上限、时间预算、递归深度、并发额度和费用阈值;异常模式会降级,陌生读者要排队,危险请求直接截断。

他们还把资源消耗写进账本:哪个入口最贵,哪类问题最容易拖慢,哪些常客需要更高配额,哪些行为像攻击。正常读者若确有长题,可以预约专门时段;故意挖无底洞的人,不能占住公共窗口。

图书馆后来明白,拒绝服务不一定要砸门。只要诱使检索员把昂贵劳动投进无底洞,正常业务就会被挤出去;守门不仅要看内容是否有害,也要看它会吃掉多少公共能力。

后来馆门口多了一块小牌:认真问题欢迎,吞掉整座书库的问题要先说明用途和预算。读者起初不习惯,几周后反而满意,因为真正需要帮助的人不用再被一张荒唐长单挡在门外。

揭示

这个故事讲的是:拒绝服务攻击

Denial-of-Service (DoS) on LLM 是通过超长上下文、递归任务、大量并发、昂贵工具调用或诱导模型长时间推理来耗尽模型服务资源的攻击或滥用。它的防护需要速率限制、上下文长度限制、超时、成本预算、递归深度限制、队列隔离、异常检测和降级策略。对企业 Agent 来说,DoS 防护直接关系到可用性、成本和 SLA。

它重要的地方在于:它不只是一个术语,而是在真实 AI / Agent 系统里会反复出现的结构性问题。理解它,才能判断什么时候该加模型,什么时候该改流程,什么时候该补治理。

隐喻映射

  • 无限借书单:超长提示、递归请求或复杂工具链
  • 检索员跑上一整天:模型推理和工具调用资源被耗尽
  • 队伍排到门外:正常用户请求被阻塞
  • 买更多灯油:单纯扩容但没有治理资源消耗
  • 长度上限、时间预算和递归深度:LLM DoS 防护控制
  • 陌生读者排队:速率限制和队列隔离
  • 资源消耗日志:成本监控与异常检测

Soloharness 判断

这个概念的实战价值,是帮你把“看起来聪明的 AI 功能”拆成可交付、可验收、可治理的工作单元。

计算资源耗尽超长提示攻击速率限制