单Agent循环跑得再顺一旦任务拆成研究、写作、审核三块立刻就会撞上协调墙。谁先动、谁等谁、失败了回哪一步、共享信息怎么不污染——这些都不是Prompt能解决的问题。2026年7月OpenClaw创始人Peter Steinberger随口问了一句“我们还在谈Loop还是已经切到Graph了”几小时后Hamel Husain直接写了《Loop Engineering Is Dead. Enter Graph Engineering》。半开玩笑的改名潮背后真正落地的是工程师早就熟悉的图结构节点、边、共享状态。我起初以为这只是又一次术语换皮LangGraph早在2024年1月就把节点-边-状态模型推出来了AutoGen有GraphFlowGoogle ADK 2.0也是同一套。深入看完实际生产踩坑后才发现名字可以过气但“什么时候一个Loop不够用必须用图来管多个Loop”这个问题会一直挂在每个多Agent系统的门口。图到底由什么组成节点是工作单元一个Agent、一次模型调用、一段确定性代码、一个工具甚至是人工审批。边决定下一步走哪顺序、并行或根据上一个节点输出做条件跳转。状态是沿边流动的共享对象每个节点从中读取也向它写入。最常见的入门图就三节点研究员收集材料写作者出草稿审核员打分。通过就结束不通过就沿边把草稿送回写作者。三个节点、四条边其中一条就是循环。关键一点单个Agent循环其实只是“只有一个节点、边指向自己”的退化图。Graph并没有取代Loop它只是把多个Loop连起来并管理它们的边界。可以把整张图想象成城市路网。节点是路口边是道路状态是路上跑的车流信息。路口多了不规划车流就会互相堵死规划过度又变成空荡荡的立交桥烧油。一个节点什么时候才配活下来最常见的翻车是把“总结这份PDF”硬拆成五个节点抓取、切块、总结、审核、格式化。真正值得独立成节点的必须对应真实专长——不同模型、不同工具集或者明确的只读审核角色。能直接内联进现有循环的步骤就不是节点。实用过滤标准很简单如果画在餐巾纸上已经画不下复杂度就超了如果把两个节点合并后什么都没丢它们本来就不该分开。共享状态怎么防止慢慢腐烂在单Loop里失败模式叫上下文腐烂。到了图里同样的病菌搬进了共享状态对象。节点二随手写进去的脏数据到了节点五就变成自信满满的输入错误一路传播到半个系统才被发现。解决办法一点都不性感但有效给状态上类型Schema明确哪些节点可以写哪些字段节点之间做Checkpoint方便回放定位。回放时要注意带外部副作用的节点发邮件、写数据库必须做成幂等否则重跑就会重复执行。路由该交给谁边就是决策。如果把决策全交给模型你得到的是灵活性和不稳定性的套装——同一状态不同跑次可能走不同路径调试直接崩溃。Google ADK 2.0给出的干净原则是可预测的路由用确定性代码控制模型只负责真正需要判断的步骤。条件能用代码检查的就别浪费模型调用。让Agent之间真正互相制衡Loop工程最硬的规矩是“永远别让Agent自己批改自己的作业”。图把这个规矩放大了。二十个基于同一基座模型、读同一份有缺陷上下文的Agent会愉快地互相附和。模型天生更偏爱自己的输出结果就是“工业级有组织的胡说”——结构完美答案全错。有效做法是给审核节点装上牙齿换一个不同的模型给它全新上下文而不是完整对话历史并把裁决锚定到图无法伪造的外部证据真正跑过的测试、真正编译通过的代码。Cognition在Devin上跑了一年后也落在同一个点多个Agent可以并行读和发表意见但只有一个Agent被允许真正改动任何东西。读是安全的并行写才是损伤发生的地方。什么时候图是过度设计诚实答案是大多数时候。Anthropic公开的数据很具体单Agent大约消耗聊天交互的4倍Token多Agent系统直接到15倍。每加一个节点都在乘法放大成本。真正适合上图的场景是工作天然拆成不同专长、需要并行扇出再汇合、每步需要不同模型或者必须做失败隔离和可审计路由。否则老老实实待在Loop里更划算。LangGraph自己也说如果你的Agent只是带工具的直接循环用LangGraph就是杀鸡用牛刀。维度单Loop更合适Graph更合适任务形态单一目标、顺序执行多专长并行、条件分支Token成本可控约4x聊天易失控约15x调试难度线性回放即可必须依赖Checkpoint与状态Schema失败隔离弱强节点级适用上限工具调用循环研究型扇出、多模型协作落地前先做这几件事先把单个Loop练到有刹车、有真正完成检查、有独立批评者。一堆弱Loop组成的图只是分布式失败。先在纸上画图逼每一个节点证明自己存在的必要。提前定义状态Schema和写权限状态漂移是图腐烂的主因。审核节点必须换模型、换新鲜上下文并锚定外部证据。给每个节点设预算上限。图是多个Loop在并行烧Token弱验证器会同时烧钱。Graph Engineering不是取代Loop Engineering的新学科它只是给“一个Loop不够用之后协调本身成为工程问题”起了个暂时的名字。名字可能撑不过今年设计问题会一直在。你现在手上的多Agent系统最复杂的那张图里有多少节点其实可以合并回一个Loop欢迎直接拍出来讨论。我是紫微AI在做一个「人格操作系统ZPF」。后面会持续分享AI Agent和系统实验。感兴趣可以关注我们下期见。