面试官问:多 Agent 拆完反而把活转来转去,什么时候才该拆?
多 Agent 该不该拆,你可能见过两种截然相反的答案。2025 年 6 月 12 日,Cognition 公开劝人别在生产里搭;隔一天 Anthropic 却贴出评测,多 Agent 比单跑 Claude Opus 4 高 90.2%。
两边都不是空口说的,各自都有线上系统撑着。
这事吵了快一年,最后吵到了同一个地方。该不该拆、什么时候真需要拆、拆完怎么交接,面试里问的也正是这几件事。
先认四个词
多 Agent:几个各带分工的 Agent 搭伙干一件事
handoff(交接):一个 Agent 把手头任务转给另一个接着干
编排器:负责拆任务、派活、收结果的总调度
上下文窗口:一个 Agent 一次能装下的工作记忆
01面试现场
面试官提问
“多 Agent 拆完反而把活转来转去,什么时候才该拆?”
面试官来自 Agent 平台岗,顺着简历里的「多 Agent 协作系统」把问题倒了过来。活转来转去,病根多半不在编排写得糙,而在没分清"并行"和"接力"。前者各查各的,拆开能同时跑;后者步步等上一步的结果,拆了只是把上下文切碎传话。
**直接回答。**转来转去是拆错了位置——互不依赖才拆,强依赖链顺序做。
能拆和不能拆,各往哪一边走。

02大多数人怎么答的
典型翻车回答
“任务复杂了当然拆,几个 Agent 各管一段,互相把关。”
这直觉有一半站得住。能拆的任务,多 Agent 确实赢,Anthropic 那套系统就是主 Agent 把大调研题拆给几个子 Agent 同时查,每支独立上下文。代价也写在同一篇复盘里,token 约是普通对话的 15 倍。
天花板在强依赖任务上。Cognition 举过一个小游戏 demo,任务劈两半给两个子 Agent 各写各的,拼回来画风都对不上,谁也看不见对方写了什么;每个动作都藏着决策,决策冲突,结果就烂。
所以「各管一段互相把关」恰恰最危险,每次交接都在漏信息,下面这次翻车就是。
03运维工单团队的一次翻车
一个做 IT 运维工单自动化的团队(复盘已脱敏,数字为示意口径)最初拆了三个 Agent:排查、修复、汇报,环状交接,谁觉得信息不够就退回上一家。
上线第二周,一张磁盘告警工单出了状况:修复 Agent 嫌排查结论太薄退回去,排查 Agent 认为早查完了又原样转回来。值班工程师在群里数了一遍:
「转给修复」「转给排查」交替出现 23 次,token 预算烧完,工单停在原地,谁都认为自己那段干完了。
复盘时把交接摊开看,三段活根本不是并行关系。修复要用排查的结论,汇报要用修复的结果——一条强依赖接力,被硬拆成了三个人传话。
他们后来把主链收了回去,排查、修复、汇报由单 Agent 顺序做完;互不依赖的部分才拆出去,查日志、查监控、查变更记录三路只读调查并行跑,各回一份结构化结论。
| 指标 | 三 Agent 环状 | 主链+并行调查 |
|---|---|---|
| 单张工单平均耗时 | 14 分钟 | 6 分钟 |
| 单张工单 token 消耗 | 约 8.6 万 | 约 2.4 万 |
| 一周互踢卡死的工单 | 11 单 | 0 单 |
表里最该看的是 token,8.6 万降到 2.4 万。这降幅不靠换模型,靠的是砍掉反复传历史的交接;耗时 14→6 分钟、互踢 11→0 单,都是同一刀砍出来的。
兜底是全链 40 步上限,碰到就熔断(也就是停掉整条链转人工);上线后只熔断过一次,起因是工具超时。
评审模板也多了一行:拆之前先答「这几支互不依赖吗」。
没砍掉的是三路并行调查,互不依赖、只读不写,正是多 Agent 该待的位置。
04判据:拿并行换上下文
多 Agent 买到的不是更聪明的决策,而是一份新的独立上下文窗口——几路调查互不挤占而已。往哪边走,看任务本身:
① 能拆:子任务互不依赖、谁先谁后无所谓、只读不改,像并行调研、多路检索 → 多 Agent,每支独立上下文
② 不能拆:下一步要用上一步的产出,或几步都改同一份东西 → 单 Agent 顺序做,全程一份上下文
两边放反了,代价并不对称。能拆不拆,上下文塞爆、后半程丢主线,慢但能干完;强依赖硬拆,接缝全靠 handoff 传话,一条没传到的假设就是一个 bug——运维团队那 23 次互踢就是这么来的。

交接该传什么,Anthropic 给过一份清单:目标、产出格式、可用工具、任务边界,合起来就是一张结构化任务书。聊天记录不传,整份复制等于退回没拆,还多付一遍钱。
2026 年 4 月,开篇那场路线之争有了结局。Cognition(《Don’t Build Multi-Agents》那家)更新了立场,和 Anthropic 收敛到同一条线——只读并行调查放心开,写操作保持单线程。截至 2026-08-12,两家在这条判据上已没有分歧。
05面试官追问链
追问 1
Supervisor、层级、群聊三种模式怎么选
别急着背模式。组织结构(行话叫拓扑,就是几个 Agent 谁指挥谁)是拆完之后的问题,多数任务在「要不要拆」那一步就该停下。真要选,三种大概是这样:
① Supervisor(主管式):一个主管派活收结果,适合互不依赖的并行调查,好查好停
② 层级式:主管下面再挂主管,子任务多到一层派不过来才值得
③ 群聊式:平级互转、谁合适谁接手,自由度最高,也最容易转出环
答完补一句「我的默认是单层 Supervisor」,比背定义更像做过的人。

追问 2
两个 Agent 把任务踢来踢去停不下来,怎么办
这题考护栏设计,答「提示词里写清别循环」等于没答。工程上的口径是三道:最大步数按整个任务全局计数,比如全链 40 步封顶;token 和时长各设硬上限,烧到线就熔断;再放一个仲裁者专管意见相左,升级拍板,禁止平级对踢。
结构上还能补一手。handoff 单向化,交接只许往前走,退回必须经仲裁者,环从结构上就成不了;发现则靠监控同一任务的转交次数,过阈值告警。
06本题总结
一句话总结
多 Agent 买的是并行的上下文,不是更聪明的决策;能拆才拆,交接只传任务书。
面试锦囊
**先说判据。**任务能不能拆成互不依赖的分支,能拆就开多 Agent、每支独立上下文,不能拆就单 Agent 顺序做。
**再说交接。**只传任务书,目标、边界、产出格式加可用工具,不传聊天记录;能提一句两家从唱反调到收敛的路线之争更好。
**最后补护栏。**全局步数、token 预算、仲裁者,加上交接单向化;追问死循环就答监控转交次数。
学AI大模型的正确顺序,千万不要搞错了
🤔2026年AI风口已来!各行各业的AI渗透肉眼可见,超多公司要么转型做AI相关产品,要么高薪挖AI技术人才,机遇直接摆在眼前!
有往AI方向发展,或者本身有后端编程基础的朋友,直接冲AI大模型应用开发转岗超合适!
就算暂时不打算转岗,了解大模型、RAG、Prompt、Agent这些热门概念,能上手做简单项目,也绝对是求职加分王🔋

📝给大家整理了超全最新的AI大模型应用开发学习清单和资料,手把手帮你快速入门!👇👇
学习路线:
✅大模型基础认知—大模型核心原理、发展历程、主流模型(GPT、文心一言等)特点解析
✅核心技术模块—RAG检索增强生成、Prompt工程实战、Agent智能体开发逻辑
✅开发基础能力—Python进阶、API接口调用、大模型开发框架(LangChain等)实操
✅应用场景开发—智能问答系统、企业知识库、AIGC内容生成工具、行业定制化大模型应用
✅项目落地流程—需求拆解、技术选型、模型调优、测试上线、运维迭代
✅面试求职冲刺—岗位JD解析、简历AI项目包装、高频面试题汇总、模拟面经
以上6大模块,看似清晰好上手,实则每个部分都有扎实的核心内容需要吃透!
我把大模型的学习全流程已经整理📚好了!抓住AI时代风口,轻松解锁职业新可能,希望大家都能把握机遇,实现薪资/职业跃迁~
这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

更多推荐



所有评论(0)