多智能体连续工作 16 天,验证契约和串行执行是关键

Factory 工程师 Luke 分享多智能体系统 Missions 架构,核心在于解决人的注意力瓶颈。该系统采用编排、工作、验证三角色分工,强调“先定义完成标准”再写代码,通过串行执行降低协调开销,并强制结构化交接以支撑长周期任务。不同角色匹配专用模型,编排逻辑主要依赖提示词,使团队能同时处理的工作流数量从 10 条提升至 30 条。

发布于2026年5月9日 22:53
编辑小创
评论0
阅读81

Factory 的开发工程师 Luke 分享了他们内部多智能体系统 Missions 的架构设计。架构的技术并不炫,但体现了一个非常朴素的思想,软件工程的瓶颈已经从"模型够不够聪明" 变成了"人的注意力够不够用"。工程师手边堆着 50 个需求,每天只能推几个。模型能力早就不是卡点,人的带宽才是。

五种协作模式,Missions 用了四种

Luke 总结了多智能体协作的五种模式:委派、创建者-验证者、直接通信、协商、广播。Missions 选了其中四种,搭成一个“三角色”架构:

编排者:负责规划,拆任务,决定下一步做什么

工作者:负责写代码,实现功能

验证者:负责检查,确认做到没有

三个角色,各司其职,听起来简单。但魔鬼藏在细节中。

验证契约:写代码之前先定义"完成"

这是我觉得整个设计里最聪明的一环。在写任何代码之前,系统就定义好“完成”意味着什么。不是模糊的“能跑就行”,而是可能包含数百个具体的确认点。为什么这很重要?因为智能体自己写代码自己测试,本质上是在确认自己已经做出的决策,很难抓到自己的 bug。而验证者从不看代码,天然就是对抗性的。就不存在“既当运动员又当裁判”的问题。

串行执行:慢就是快

这个选择挺反直觉。并行跑多个智能体,听起来效率更高对吧?他们试了,结果协调开销把速度提升全吃掉了。智能体之间互相覆盖改动、做重复工作、架构决策打架。所以 Missions 的做法是:功能层面串行,只读操作才并行。表面慢了,但错误率大幅下降。长期任务里,正确性的提高会产生复利,越跑越快。

结构化交接:每个智能体离场必须交班

工作智能体完成功能后,必须填一份交接文档,什么完成了、什么没有、跑了哪些命令、退出码是什么。一旦捕获到错误,系统会自动拉回正轨。他们最长的任务跑了 16 天,比一个完整 sprint 还长。能跑 16 天不崩,靠的就是这种严格的交接纪律。

不同角色用不同模型

这个点也很关键。规划需要慢而审慎的推理,实现需要代码流畅度,验证需要精确的指令遵循。甚至验证者可以用完全不同的模型提供商,避免相同训练数据带来的偏见累积。Luke 他们管这个叫 "机器人耳语术",理解不同 LLM 怎么交互、在哪里失败、失败如何在连续几天的运行中叠加放大。这不是调参数,这是在对不同模型的性格做编排。

编排逻辑几乎全在提示词里

这意味着每次模型升级,系统都会自动变强,不需要重写代码。通过这种多智能体架构,一个五人团队以前同时处理 10 条工作流,现在能跑 30 条。

相关文章

Jev 实操指南,用概率闸门重构智能体决策流
AI 新闻资讯
2026年9月18日
0 条评论
小创

Jev 实操指南,用概率闸门重构智能体决策流

TypeSafe AI 推出系统一模型 Jev,作为智能体概率决策闸门,仅返回带校准概率的结构化结果而不生成文本。该模型具备低成本、低延迟及零输出错误率特性,支持 Choice、Score、Noul 三种提问原语。文章详解了其 API 调用、SDK 集成及推测式并行、置信度路由等五种落地模式,并指出其本质是强类型函数调用而非廉价 LLM。建议在生产环境中锁定版本、规避算术任务,并通过影子模式实测校准效果。

#智能体#AI 编程#提示词工程
阅读全文
Anthropic 开源知识工作插件库,111 个无代码技能包重塑智能体工作流
AI 教程知识
2026年9月18日
0 条评论
小创

Anthropic 开源知识工作插件库,111 个无代码技能包重塑智能体工作流

Anthropic 开源 knowledge-work-plugins 项目,提供 111 个无代码智能体技能包。该体系基于 Markdown 和 JSON 构建标准化模块,支持渐进式披露与 MCP 工具集成,标志提示词工程向软件工程化转型。内置 marketing 与 productivity 等插件展示了结构化输入及分层记忆范式,支持语义路由与轻量化定制。尽管存在多插件上下文竞争及云端连接器限制内网访问等问题,仍为智能体工作流提供了可复用的模块化规范。

#智能体#AI工具#提示词工程
阅读全文
把 LLM 当文字编辑而非代写枪手:两条铁律与改稿提示词
智能体工程
2026年9月18日
0 条评论
小创

把 LLM 当文字编辑而非代写枪手:两条铁律与改稿提示词

使用 LLM 辅助写作应将其定位为文字编辑而非代写枪手。核心原则包括绝不采纳模型生成的具体词汇及禁止其提供夸奖,以避免内容同质化。推荐采用“诊断-重写-比对”三阶段改稿流程,利用模型查找语法与逻辑硬伤,但由作者亲自重写。实践中可借助专用提示词库或本地工具提升效率。此外,需警惕长上下文压缩摘要可能引发的指令注入风险。AI 仅是批判性审视的效率放大器,人类创作者必须始终掌握写作主导权。

#AI写作#提示词工程#AI工具
阅读全文
互动讨论

评论区

围绕《多智能体连续工作 16 天,验证契约和串行执行是关键》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。