e5f537c807
首轮委派 task 由 Supervisor 自由撰写,实测它每次都把提问条件写成一个高门槛: 「若确有缺少且会实质改变结果的用户事实……否则直接创建并提交完整 GDD」。本机 13 个生产 project 里 8 个是 0 轮直出,CLI 同参基线 8 个 run 也有 3 个 0 轮、 均值 0.75 轮、无一顶满 3 轮预算。 病根是提问门槛这件事同时写在两个地方而且口径相反:plan/common.md 告诉 Supervisor「专业 Agent 若缺少会实质改变结果的用户事实才提问」,Supervisor 照抄 进 task;而子 Agent 的 role brief 只写了 3 轮上限,没写默认姿态、没有判断该不该 问的程序、也没有它自己两次引用的那份「默认建议」清单到底是什么。 按原型的做法收口——两边各一份闭集白名单,不给「可以无视 task」的授权: - roles/project-planning.md:出稿触发器收成四个(任务正文出现「直接出稿」四个字 / 已完成第 3 轮 / 剩余空白能被默认建议覆盖且不影响首个可玩闭环 / Runtime 超时 提示),任务正文能改变流程的只有第一条。Supervisor 写的门槛不在其中,自然不是 触发器,不需要授权无视。补上字段差距检测(逐项对照 plan-submit-gdd-input.v1 的 game 字段三分类,提问名额只花在空白项)和那份缺席的默认建议清单。 - plan/supervisor-playbook.md:本轮指令三选一(继续澄清 / 直接出稿 / 按意见修订), 不得自撰提问条件。独立成段,因为 both_playbooks_carry_the_same_anti_pre_deciding_contract 要求共享段在两条 lane 逐字相同,并进去就得改做游戏 lane。plan/common.md 那句病根改不动(planCommon 受逐字子集断言约束,且通用 common.md 的口径对其它专业 Agent 是对的),只能覆盖。 默认建议按本仓库的 GDD schema 重排,没有照抄原型:原型的「缺成长 / 缺探索 / 缺构建」三条落到 plan-submit-gdd-input.v1 上全在 pillars 与 coreLoop,而那两个字段 就是首个可玩闭环本身,给它们配默认值等于把最该花提问预算的两项默认掉,和 「提问顺序:核心行为与本局目标 → 重玩动力」的前两顺位直接打架。故清单只覆盖 genre.fusion / artStyle / targetUsers / outOfScope,并明写 pillars 与 coreLoop 没有默认建议。 实测(8 vs 8,同一句开场白、同一条 --swarm-chat --plan、同一个模型、决策卡一律 选 A):轮数均值 0.75 → 2.62,0 轮 3/8 → 0/8,顶满 3 轮 0/8 → 6/8;Supervisor 在 首轮 task 里写提问门槛 8/8 → 0/8。这会让用户明显感到问得多了,是有意的产品取舍。 补一条断言:这份 role brief 此前两次要求「按默认建议填写」却从未写出清单,就是 因为没有任何测试看着它。新断言钉住清单在场、按 schema 字段名写、pillars 与 coreLoop 被排除、出稿触发器是闭集。 Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>