中文开源技术专著 · 全十章
生产级多智能体系统¶
从架构判断到工程落地
本书讨论的不是如何快速堆出一组 Agent,而是如何把目标、权限、状态、上下文、证据和故障边界组织成一个可验证的生产系统。十章沿同一条工程主线展开,从是否需要 Agent,一直走到评测、运营和公开交付。
从一个判断开始¶
许多 Agent 项目从框架、角色和 Prompt 开始。本书把顺序反过来:先确认哪些路径需要动态决策,哪些状态必须由确定性系统拥有,哪些副作用无论模型多自信都不能越权执行。只有当责任边界成立,增加 Agent 才可能带来净收益。
架构判断
区分工作流、单 Agent 与多 Agent,确定自治范围和真实拆分边界。
受控执行
把工具、状态、上下文、权限和恢复语义写成可执行合同。
生产保障
建立部署、可观测性、安全、评测和 AgentOps 运营闭环。
可验证交付
让第三方能够复现系统、追溯证据并验证发布制品来源。
全书结构¶
第一部分 · 第 01—03 章
架构判断与执行控制
理解 Agent 的本质,建立工具调用控制面,再处理多 Agent 的控制权、状态所有权和协作合同。
查看本部分 →第二部分 · 第 04—06 章
可信上下文与生产保障
把检索结果治理为证据,为系统建立可服务、可恢复且能够限制攻击影响的生产底座。
查看本部分 →第三部分 · 第 07—10 章
系统合龙与持续交付
贯通跨 Agent 因果链,以评测和 AgentOps 持续验证,最终形成可复现、可维护的公开交付物。
查看本部分 →贯穿全书的 CaseOps¶
CaseOps 是本书独立维护的生产导向参考系统。它围绕理赔案件 C-102 展开:调查案件为何未完成,确认缺失材料与适用规则;如果需要联系客户,只生成草稿,不自动发送。
这条业务链同时包含动态调查、多源证据、租户隔离、审批边界、长任务、故障恢复和质量验证。读者可以用 v1.0.0 运行完整系统,也可以使用章节标签观察每项能力为何出现。
读完之后,你将能够¶
- 用可解释的标准判断一个问题是否需要 Agent,以及是否值得拆成多 Agent;
- 设计 Tool Contract、状态机、协作协议、Context Pack 与安全执行边界;
- 建立覆盖部署、可观测性、恢复、安全、评测和线上运营的生产保证;
- 使用 ADR、Golden Dataset、Evidence Package 与 Release Gate 支撑架构决策;
- 在干净环境中构建、验收并验证一个多 Agent 系统的发布来源。
原理优先,框架解耦
LangGraph、AutoGen、CrewAI 等框架会持续变化。本书优先讨论更稳定的架构责任、工程合同和验证方法,使这些判断在更换模型、协议实现或编排框架后仍然成立。