多 Agent 系统最稀缺的不是能力,是责任边界
小互解读的 xAI Grok Bot 五篇实践,真正值钱的不在「六个 Bot 运营一款游戏」,而在把 Agent 当岗位写:写清它负责什么,更写清它拒绝什么,卡住时向谁升级。当「做出来」变便宜,组织设计的重心从能力分配转移到责任分配。
- 核心结论:多 Agent 系统稀缺的不是能力,是责任边界——谁能宣布结论、谁不能碰钱、谁负责回滚、什么时候必须叫人。
- 六项岗位配置:岗位说明 / 连接 / 运行环境 / 例程 / 技能 / 交接;最容易被忽略的是拒绝事项和交接。
- 三处硬核交叉验证:①「独立电脑」≠ 安全隔离;②可逆性判据(可逆→自主,不可逆→留人)比「重要的事留给人」更可判定;③ ROI 数字是个案证据,不可外推。
- 对神机百炼:K1 半日表演报价里值钱的是那 85% 的交付能力,不是 6 台机器人本身。
把 Agent 当岗位来写
小互原文拆了五类人的 Bot 团队:多项目管理、移动游戏运营、设计原型、企业 GTM、产品管理。形态各不相同,但组织骨架高度稳定,可以压成一张通用拓扑。
最锋利的一句在移动案例里:Analytics 是唯一可以宣布数据发现的角色,它不能写广告、也不能碰应用代码;Creatives 做广告规格和变体,却不能购买媒体;工程 Agent 收到的是规格而非含糊建议;GCS 掌管证书与部署,没有它的变更不能到玩家手里。
这些比「六项配置」更值钱
小互原文写得对,但一手文档补了三个容易读歪的地方。
因此多 Agent 的职责边界靠约定与审计保障,不靠隔离保障。需要真硬隔离时(花钱、生产部署、客户数据),必须走审批点,不能指望岗位描述。monokern 给的可逆性判据更好用:动作能撤销就交给 Agent 自主,不可逆就留给人。外发、花钱、删除、部署全落在不可逆一侧。
生成草稿 / 排版 / 抓数据 / 整理表格;生成方案草稿、视觉初稿;密码、2FA 经交互式会话交接,密码不进任何 Agent 上下文。
发公众号 / 客户邮件;报价 / 承诺交付时间;删除素材库、覆盖定稿;改生产系统、客户线上内容;高歧义判断(客户真实意图)。
第三处:移动案例自报 CPI 从 $15 降到 $1、D7 留存 2.5%→10%,但小互第一时间自己划线——「这些是个案证据,无法外推为普遍 ROI」。和他对苏乐那条「tok/s 不是硬件参数,是一条测量结果」是同一套纪律。
值钱的是交付,不是机器人
移动指南里有个估算:写出游戏本体约占 15% 的工作,其余 85% 是获客、创意、客户端、后端、live ops、商店发布、QA 和事故响应。这个比例几乎原样适用于机器人项目。
| 移动游戏(原文) | 机器人项目(你的场景) | 占比 |
|---|---|---|
| 游戏本体 | 机器人本体(硬件 + 调参 + 动作编排) | ~15–20% |
| 获客 / 创意 | 客户需求对齐 / 预期管理 / 方案包装 | — |
| 商店发布 | 场地勘察 / 进场协调 / 报批 / 保险 | ~80–85% |
| live ops / QA | 现场值守 / 充电轮换 / 故障预案 / 责任划分 | — |
三席起步,不要一上来五个
按原文「先跑通一个闭环,责任真的增加时再扩充」的建议,内容中台线三席即可:采集岗(Researcher,拒绝做判断/补全)、成稿岗(Writer,拒绝碰事实数字/编数)、排版岗(Formatter,拒绝改正文)。你(人)批准对外发布、判定品味、解除 Blocked。
原文诚实声明:七步是对五篇实践的编辑归纳,xAI 未正式命名;移动指南的「六 Bot 上限」是作者自设实验值。引用时写「五篇实践可归纳为七步」,别写「xAI 七步框架」。