diff --git a/apps/ai-game-creator-shell/src/App.tsx b/apps/ai-game-creator-shell/src/App.tsx index 846a9edfa..cd4899e9f 100644 --- a/apps/ai-game-creator-shell/src/App.tsx +++ b/apps/ai-game-creator-shell/src/App.tsx @@ -1872,6 +1872,7 @@ const chatCommandHelp = [ '/criteria:查看当前任务验收标准', '/groups:查看专业组进度', '/budget:查看最近 run 预算', + '/qa:查看质量检查清单', '/review:查看 Evaluator 评审和返工焦点', '/context:查看生成上下文来源', '/timeline:查看项目活动时间线', @@ -2817,6 +2818,104 @@ function summarizeProjectPlaytestState( }; } +function summarizeProjectQualityCheck( + nextManifest: GameCreationAppManifest, + trace: GameCreationAgentRunTrace | null, +) { + const tasks = taskRowsFromManifest(nextManifest); + const completedCount = tasks.filter( + (task) => task.status === 'completed', + ).length; + const failedTasks = tasks.filter((task) => task.status === 'failed'); + const readyCount = selectGameCreationAppReadyTasks({ tasks }).length; + const commandRuns = nextManifest.commandRuns ?? []; + const latestCommandRun = commandRuns[commandRuns.length - 1] ?? null; + const preview = nextManifest.preview; + const previewRunning = preview?.status === 'running' && preview.url; + const tracePassed = isAgentRunTracePassed(trace); + const blockedTrace = + trace?.lifecycleStatus === 'killed' || + trace?.status === 'failed' || + trace?.status === 'needs-revision' || + trace?.stopReason === 'max-passes-exhausted'; + const staticSmokePassed = + commandRuns.some( + (commandRun) => + commandRun.commandId === 'game.static_smoke' && + commandRun.status === 'completed', + ) || + Boolean( + trace?.steps.some((step) => + step.toolCalls.some( + (toolCall) => + toolCall.toolId === 'game.static_smoke' && toolCall.status === 'ok', + ), + ), + ); + const latestReviewStep = + trace?.steps.filter(isAgentReviewStep).slice(-1)[0] ?? null; + const latestPlaytestStep = + trace?.steps.filter(isPlaytestTraceStep).slice(-1)[0] ?? null; + const evaluatorSummary = !trace + ? '暂无' + : tracePassed + ? '通过' + : blockedTrace + ? '需返工' + : '未通过'; + const playtestSummary = previewRunning + ? `预览运行中 ${preview.url}` + : tracePassed + ? '待启动预览' + : '等待原型通过'; + + let draftCommand = '/publish'; + let draftCommandLabel = '查看发布准备'; + if (!trace) { + draftCommand = '/next'; + draftCommandLabel = '查看下一步'; + } else if (blockedTrace) { + draftCommand = '/review'; + draftCommandLabel = '查看评审'; + } else if (failedTasks.length > 0) { + draftCommand = '/tasks'; + draftCommandLabel = '查看任务'; + } else if (!tracePassed) { + draftCommand = '/trace'; + draftCommandLabel = '查看 trace'; + } else if (!staticSmokePassed || !previewRunning) { + draftCommand = '/playtest'; + draftCommandLabel = '查看试玩状态'; + } + + return { + text: [ + '质量检查:', + trace ? `- Run:${trace.runId} · ${formatAgentRunStatus(trace)}` : null, + `- Evaluator:${evaluatorSummary}${ + latestReviewStep ? ` · ${latestReviewStep.summary}` : '' + }`, + `- 任务:完成 ${completedCount}/${tasks.length} · ready ${readyCount} · 失败 ${failedTasks.length}`, + `- 静态自检:${staticSmokePassed ? '通过' : '未运行'}`, + `- 试玩:${playtestSummary}`, + `- 最近试玩步骤:${ + latestPlaytestStep + ? `${latestPlaytestStep.agent} #${latestPlaytestStep.pass} · ${latestPlaytestStep.status} · ${latestPlaytestStep.summary}` + : '暂无' + }`, + `- 产物:${trace ? `${trace.artifacts.length} 个` : '暂无'}`, + latestCommandRun?.status === 'failed' + ? `- 阻塞:最近命令 ${latestCommandRun.commandId} 失败 · /logs` + : null, + `- 建议:${draftCommand}`, + ] + .filter(Boolean) + .join('\n'), + draftCommand, + draftCommandLabel, + }; +} + function summarizeNextProjectActions( nextManifest: GameCreationAppManifest, trace: GameCreationAgentRunTrace | null, @@ -2867,6 +2966,7 @@ function summarizeNextProjectActions( addSuggestion('查看当前任务验收标准', '/criteria'); addSuggestion('查看专业组进度', '/groups'); } + addSuggestion('查看质量检查清单', '/qa'); if (nextManifest.assets.length > 0) { addSuggestion(`查看 ${nextManifest.assets.length} 个本地资产`, '/assets'); @@ -6538,6 +6638,23 @@ export function App() { return; } + if (prompt === '/qa') { + if (!requireChatProjectForUserAction()) { + return; + } + const summary = summarizeProjectQualityCheck(manifest, agentRunTrace); + setMessages((current) => [ + ...current, + { + role: 'assistant', + text: summary.text, + draftCommand: summary.draftCommand, + draftCommandLabel: summary.draftCommandLabel, + }, + ]); + return; + } + if (prompt === '/review') { if (!requireChatProjectForUserAction()) { return; diff --git a/apps/ai-game-creator-shell/tests/appSurface.test.ts b/apps/ai-game-creator-shell/tests/appSurface.test.ts index 9285975e3..87516eb0b 100644 --- a/apps/ai-game-creator-shell/tests/appSurface.test.ts +++ b/apps/ai-game-creator-shell/tests/appSurface.test.ts @@ -2371,6 +2371,70 @@ describe('AI 游戏创作 App 界面边界', () => { ), ).toHaveLength(runLocalCountBeforeBudget); + const fileReadCountBeforeQa = invoke.mock.calls.filter( + ([command]) => command === 'read_local_project_file', + ).length; + const manifestReadCountBeforeQa = invoke.mock.calls.filter( + ([command]) => command === 'get_local_game_manifest', + ).length; + const runLocalCountBeforeQa = invoke.mock.calls.filter( + ([command]) => command === 'run_limited_local_command', + ).length; + const startPreviewCountBeforeQa = invoke.mock.calls.filter( + ([command]) => command === 'start_local_game_preview', + ).length; + const openPreviewCountBeforeQa = invoke.mock.calls.filter( + ([command]) => command === 'open_local_game_preview', + ).length; + submitChat('/qa'); + expect(await screen.findByText(/质量检查:/)).not.toBeNull(); + const qaMessages = screen.getAllByText(/质量检查:/); + const qaMessage = qaMessages[qaMessages.length - 1]; + expect(qaMessage.textContent).toContain( + 'Run:run-main-shortcut-trace · passed / done · 1/3 轮 · evaluator-passed', + ); + expect(qaMessage.textContent).toContain('Evaluator:通过 · 质量评审通过'); + expect(qaMessage.textContent).toContain( + '任务:完成 0/16 · ready 1 · 失败 0', + ); + expect(qaMessage.textContent).toContain('静态自检:通过'); + expect(qaMessage.textContent).toContain('试玩:待启动预览'); + expect(qaMessage.textContent).toContain('产物:3 个'); + expect(qaMessage.textContent).toContain('建议:/playtest'); + const qaDraftButtons = screen.getAllByRole('button', { + name: '查看试玩状态', + }); + fireEvent.click(qaDraftButtons[qaDraftButtons.length - 1]); + expect(screen.getByLabelText('创作想法')).toHaveProperty( + 'value', + '/playtest', + ); + expect( + invoke.mock.calls.filter( + ([command]) => command === 'read_local_project_file', + ), + ).toHaveLength(fileReadCountBeforeQa); + expect( + invoke.mock.calls.filter( + ([command]) => command === 'get_local_game_manifest', + ), + ).toHaveLength(manifestReadCountBeforeQa); + expect( + invoke.mock.calls.filter( + ([command]) => command === 'run_limited_local_command', + ), + ).toHaveLength(runLocalCountBeforeQa); + expect( + invoke.mock.calls.filter( + ([command]) => command === 'start_local_game_preview', + ), + ).toHaveLength(startPreviewCountBeforeQa); + expect( + invoke.mock.calls.filter( + ([command]) => command === 'open_local_game_preview', + ), + ).toHaveLength(openPreviewCountBeforeQa); + const fileReadCountBeforeReview = invoke.mock.calls.filter( ([command]) => command === 'read_local_project_file', ).length; @@ -2388,13 +2452,13 @@ describe('AI 游戏创作 App 界面边界', () => { ).length; submitChat('/review'); expect(await screen.findByText(/评审状态:/)).not.toBeNull(); - expect(screen.getByText(/Evaluator:通过/)).not.toBeNull(); - expect(screen.getByText(/返工焦点:暂无/)).not.toBeNull(); - expect( - screen.getByText(/评审记录:\/read \.agent\/findings\.md/), - ).not.toBeNull(); const reviewMessages = screen.getAllByText(/评审状态:/); const reviewMessage = reviewMessages[reviewMessages.length - 1]; + expect(reviewMessage.textContent).toContain('Evaluator:通过'); + expect(reviewMessage.textContent).toContain('返工焦点:暂无'); + expect(reviewMessage.textContent).toContain( + '评审记录:/read .agent/findings.md', + ); expect(reviewMessage.textContent).toContain( 'Evaluator #1 · passed · 质量评审通过', ); @@ -2643,6 +2707,7 @@ describe('AI 游戏创作 App 界面边界', () => { expect(screen.getByText(/查看 .* 个 ready 任务:\/tasks/)).not.toBeNull(); expect(screen.getByText(/查看当前任务验收标准:\/criteria/)).not.toBeNull(); expect(screen.getByText(/查看专业组进度:\/groups/)).not.toBeNull(); + expect(screen.getByText(/查看质量检查清单:\/qa/)).not.toBeNull(); expect(screen.getByText(/查看美术素材:\/art/)).not.toBeNull(); expect(screen.getByText(/查看发布准备清单:\/publish/)).not.toBeNull(); expect(screen.getByText(/查看试玩状态:\/playtest/)).not.toBeNull(); @@ -8544,6 +8609,7 @@ describe('AI 游戏创作 App 界面边界', () => { expect(screen.getByText(/\/criteria:查看当前任务验收标准/)).not.toBeNull(); expect(screen.getByText(/\/groups:查看专业组进度/)).not.toBeNull(); expect(screen.getByText(/\/budget:查看最近 run 预算/)).not.toBeNull(); + expect(screen.getByText(/\/qa:查看质量检查清单/)).not.toBeNull(); expect( screen.getByText(/\/review:查看 Evaluator 评审和返工焦点/), ).not.toBeNull(); diff --git a/docs/project-memory/shared-memory/decision-log.md b/docs/project-memory/shared-memory/decision-log.md index 27c69d0ce..535cb7e2d 100644 --- a/docs/project-memory/shared-memory/decision-log.md +++ b/docs/project-memory/shared-memory/decision-log.md @@ -3870,6 +3870,7 @@ - 2026-07-03 调整:普通用户通过聊天输入 `/criteria` 查看当前任务验收标准,只基于当前 manifest.tasks 和最近 run trace.taskGraph 汇总 active、carry、ready、失败或待处理任务的验收条件和产物,并提供 `/tasks` 草稿;该入口不得触发 Tauri 读写、不得读取任务文件或 trace 文件,也不得新增普通用户验收面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/groups` 查看专业组进度,只基于当前 manifest.tasks 和最近 run trace.taskGraph / passPlans 汇总六个专业组的完成、active、carry、ready、失败数量和下一步任务,并提供 `/tasks` 草稿;该入口不得触发 Tauri 读写、不得读取任务文件或 trace 文件,也不得新增普通用户专业组面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/budget` 查看最近 run 预算,只基于当前最近 run trace 汇总轮次、工具调用、stopReason 和下一步建议,并提供 `/review`、`/publish`、`/trace` 或 `/next` 草稿;该入口不得触发 Tauri 读写、不得读取 trace 文件,也不得新增普通用户预算面板。 +- 2026-07-03 调整:普通用户通过聊天输入 `/qa` 查看质量检查清单,只基于当前 manifest、最近 run trace、最近命令和 preview 状态汇总 Evaluator、任务、静态自检、试玩和产物状态,并提供 `/review`、`/tasks`、`/trace`、`/playtest`、`/publish` 或 `/next` 草稿;该入口不得触发 Tauri 读写、不得读取 trace 或日志文件、不得启动或打开预览,也不得新增普通用户 QA 面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/review` 查看 Evaluator 评审状态,只基于主窗口当前已加载的最近 run trace 派生通过 / 需返工状态、返工焦点、返工路线和最近评审步骤,并提供 `/read .agent/findings.md` 或 `/agent-resume ` 草稿;该入口不得直接读取评审文件、不得触发 Tauri 读写,也不得新增普通用户评审面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/context` 查看生成上下文来源,只基于当前 manifest 和最近 run trace 列出项目对话、短期记忆、长期记忆、项目黑板、Agent 对话、Agent 私有记忆、manifest、最近 trace 和最近 LLM 输入路径,并提供 `/read` 或 `/memory blackboard` 草稿;该入口不得触发 Tauri 读写、不得读取上下文文件,也不得新增普通用户上下文面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/timeline` 查看项目活动时间线,只基于当前 manifest.commandRuns 和最近 run trace 汇总最近命令、日志读取草稿和最近 Agent 步骤,并提供 `/read`、`/trace` 或 `/history` 草稿;该入口不得触发 Tauri 读写、不得读取日志或 trace 文件,也不得新增普通用户时间线面板。 @@ -3883,7 +3884,7 @@ - 2026-07-03 调整:普通用户通过聊天输入 `/art` 查看美术素材,只基于当前 manifest 盘点图片、视频和序列帧素材的数量、来源、画板接入状态和路径,并提供 `/generate-art 首版核心美术素材` 或 `/read assets/manifest.art.json` 草稿;该入口不得触发 Tauri 读写、平台生成、画板同步或新增普通用户美术面板。 - 2026-07-03 调整:主窗口新增音效登记和画板音频导入快捷入口,只填入 `/asset-register assets/audio/sfx.wav audio audio/wav` 或 `/import-canvas-asset assets/audio/sfx.wav ` 草稿;聊天输入 `/audio` 只基于当前 manifest 盘点音频素材、来源和路径,并给出登记音效或读取 `assets/manifest.audio.json` 的草稿。音乐组仍复用现有资产登记 / 画板回流链路,不新增独立音频生成系统。 - 2026-07-03 调整:主窗口新增常用生成产物读取入口,只把入口 HTML、设计、数值、美术清单、音频清单和发布说明对应的 `/read` 草稿填入聊天输入框;聊天命令 `/artifacts` 只列出同一组固定读取命令并提供首个读取草稿,`/run-artifacts` 只列出最近 trace 里的产物读取命令并提供首个 `/read` 草稿,`/logs` 只列出固定日志读取命令;实际读取仍走聊天侧 `file.read` 权限流,不直接读本地文件。 -- 2026-07-03 调整:普通用户通过聊天输入 `/next` 触发下一步建议入口,只基于主窗口当前已加载的 manifest、最近 run trace 和最近命令摘要生成聊天建议,列出 `/tasks`、`/criteria`、`/groups`、`/budget`、`/trace`、`/review`、`/context`、`/timeline`、`/playtest`、`/run`、`/open-preview`、`/assets`、`/art`、`/audio`、`/publish`、`/artifacts`、`/run-artifacts`、`/passes`、`/run-files`、`/internals`、`/logs`、`/agent-resume ` 等安全命令草稿方向,并提供一个首选草稿;该命令不得直接执行 Tauri 读写、启动或打开预览、读取本地文件,也不得绕过原有命令确认和 `file.read` 权限流。 +- 2026-07-03 调整:普通用户通过聊天输入 `/next` 触发下一步建议入口,只基于主窗口当前已加载的 manifest、最近 run trace 和最近命令摘要生成聊天建议,列出 `/tasks`、`/criteria`、`/groups`、`/budget`、`/qa`、`/trace`、`/review`、`/context`、`/timeline`、`/playtest`、`/run`、`/open-preview`、`/assets`、`/art`、`/audio`、`/publish`、`/artifacts`、`/run-artifacts`、`/passes`、`/run-files`、`/internals`、`/logs`、`/agent-resume ` 等安全命令草稿方向,并提供一个首选草稿;该命令不得直接执行 Tauri 读写、启动或打开预览、读取本地文件,也不得绕过原有命令确认和 `file.read` 权限流。 - 2026-07-03 调整:普通用户通过聊天输入 `/publish` 生成发布准备清单,只基于主窗口当前已加载的 manifest、最近 run trace、预览状态、资产来源和最近命令摘要列出原型通过、预览、任务、资产、音频、包装说明和试玩包状态,并提供 `/run`、`/trace`、`/agent-resume ` 或 `/export` 草稿;该入口不得触发 Tauri 读写、不得启动或打开预览、不得读取文件,也不得新增普通用户发布面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/internals` 只列出 `.agent/manifest.json`、`.agent/run.latest.json`、`.agent/spec.md`、`.agent/findings.md`、`.agent/policy.json`、`.agent/project.index.json`、`.agent/agent.db` 和 `.agent/conversations/project.jsonl` 的 `/read` 草稿,并提供首个读取草稿;该入口不得直接读取内部文件、不得触发 Tauri 读写,也不得新增普通用户内部文件面板。 - 2026-07-03 调整:普通用户通过聊天输入 `/passes` 只从当前已加载的最近 run trace artifacts 中筛选 `.agent/passes/` 轮次产物,列出 `/read` 草稿并提供首个读取草稿;该入口不得直接读取轮次文件、不得触发 Tauri 读写,也不得新增普通用户轮次面板。 diff --git a/docs/technical/【技术方案】AI游戏创作智能体App实施计划-2026-06-24.md b/docs/technical/【技术方案】AI游戏创作智能体App实施计划-2026-06-24.md index f0e2f39b1..5435f7ab0 100644 --- a/docs/technical/【技术方案】AI游戏创作智能体App实施计划-2026-06-24.md +++ b/docs/technical/【技术方案】AI游戏创作智能体App实施计划-2026-06-24.md @@ -104,6 +104,7 @@ game-project/ - 聊天输入 `/criteria` 可在普通聊天消息里查看当前任务验收标准和预期产物,不读取任务文件或 trace 文件,也不新增普通用户验收面板。 - 聊天输入 `/groups` 可在普通聊天消息里查看六个专业组进度和下一步任务,不读取任务文件或 trace 文件,也不新增普通用户专业组面板。 - 聊天输入 `/budget` 可在普通聊天消息里查看最近 run 轮次和工具调用预算,不读取 trace 文件,也不新增普通用户预算面板。 +- 聊天输入 `/qa` 可在普通聊天消息里查看质量检查清单,不读取 trace 或日志文件、不启动或打开预览,也不新增普通用户 QA 面板。 - 聊天输入 `/passes` 可在普通聊天消息里列出最近 run trace 中 `.agent/passes/` 轮次产物读取命令,不直接读取轮次文件,也不新增普通用户轮次面板。 - 生成代码和资产进入用户本地项目目录。 - 本地 HTTP 预览能启动,并在外部浏览器展示可玩原型。 @@ -115,11 +116,12 @@ game-project/ ## v1 验收证据矩阵 -- `npm run ai-game-creator-shell:check`:覆盖壳 typecheck、聊天命令单测、用户 / 开发窗口 UI 边界 smoke、主窗口命令按钮复用 `/help` 命令列表、主窗口项目摘要从 manifest / trace 派生任务完成数、ready 数、资产来源分布和最近命令且未选项目时不显示、灵感草稿只填充输入框不提交、能力按钮复用 `/capabilities`、LLM状态按钮复用 `/llm-status` 且结果回填 Agent 状态列表、聊天侧 `/agents` 汇总和单 Agent 对话的 provider / 模型 / 流式 / API Key 读取状态、开发日志面板只读读取 `.agent/logs/command.log` / `preview.log` / `agent.log`、项目状态按钮复用 `/status`、权限按钮复用 `/policy` 且策略草稿按钮只填入 `/policy-confirm project.index` / `/policy-confirm asset.register` / `/policy-confirm memory.write` / `/policy-confirm preview.start` / `/policy-confirm preview.open` / `/policy-confirm preview.stop` / `/policy-confirm agent.run_status` / `/policy-confirm conversation.read` / `/policy-confirm conversation.write`、审计按钮复用 `/audit`、资产按钮复用 `/assets` 且资产结果可一键复用 `/read`、任务按钮复用 `/tasks`、聊天侧 `/agents` 汇总每个 Agent 的当前状态、聊天侧 `/agent-conversations` 列出 Agent 对话读取命令、聊天侧 `/agent-memories` 列出 Agent 私有记忆读取命令、Trace 按钮复用 `/trace`、文件按钮复用 `/files` 且文件结果可一键复用 `/read`、索引按钮复用 `/index`、记忆 / 短期记忆 / 黑板按钮复用 `/memory long|short|blackboard`、快照按钮复用 `/checkpoint`、快照列表按钮复用 `/checkpoints` 且 checkpoint 结果可一键复用 `/diff` / `/restore`、历史按钮复用 `/history`、受限命令白名单按钮复用 `/commands` 且无需项目初始化、静态自检快捷按钮复用 `/smoke`、预览状态快捷按钮复用 `/preview-status`、主窗口运行时配置面板读写 Tauri 配置目录中的 `game-creator.config.json`、支持全局与每个 agent 单独选择 LLM Provider 且不把 API Key 写入聊天、单 Agent 对话面板可手动追加私有记忆且走 `memory.write` 策略、主窗口提供音效登记、画板音频导入和常用生成产物读取草稿入口,聊天侧 `/art` 可盘点美术素材且不直接触发平台生成或画板同步,聊天侧 `/context` 可盘点生成上下文来源且不直接读取上下文文件,聊天侧 `/timeline` 可汇总项目活动时间线且不直接读取日志或 trace 文件,聊天侧 `/artifacts` 可列出常用生成产物读取命令,聊天侧 `/run-artifacts` 可列出最近 run 产物读取命令,聊天侧 `/run-files` 可列出 Agent 运行辅助文件读取命令,聊天侧 `/logs` 可列出固定日志读取命令且不直接读取日志,聊天侧 `/brief` 只基于当前已加载的 manifest / 最近 run trace / 预览状态 / 资产数量 / 最近命令生成项目简报,提供 `/next` 后续草稿且不直接触发 Tauri 读写、文件读取、预览启动或新增面板,聊天侧 `/next` 基于当前已加载的 manifest / 最近 run trace 输出下一步建议和 `/tasks` / `/trace` / `/run` / `/open-preview` / `/assets` / `/art` / `/context` / `/timeline` / `/artifacts` / `/run-artifacts` / `/run-files` / `/logs` / `/agent-resume ` 等安全命令草稿方向,提供一个首选草稿且不直接触发 Tauri 读写、预览启动或文件读取,聊天侧 `/capabilities` 展示标准 Agent 能力清单且不打开开发面板、聊天侧 `/audit` 从 manifest / 本地文件 / `.agent/run.latest.json` 分别汇总用户面、6 组任务配置、6 组协作证据、任务编排、loop、记忆、本地产物、HTTP 预览、画板回流和权限日志证据且不打开开发面板;未生成 `.agent/run.latest.json` 前,`/audit` 只能标记任务配置通过,不能把 6 组协作证据误判为通过;trace 已存在但状态为 `failed`、`needs-revision`、`running`、`max-passes-exhausted` 或缺少 `Evaluator passed` 步骤时,`/audit` 不能把 loop 误判为通过。聊天侧 `/llm-status` 只显示 base_url / model / API Key 已读取状态且不泄露密钥本体、聊天侧长期记忆查看 / 追加 / 覆盖 / 删除的授权本地项目路径、上传资产写入后的 manifest 刷新和 `/assets` 聊天可见性、`/smoke` 聊天侧确认后只通过授权本地项目路径执行白名单 `game.static_smoke`、`/run` 聊天侧确认后通过授权本地项目路径执行 `game.static_smoke`、启动 `127.0.0.1` 本地预览并交给外部浏览器、`/preview` 聊天侧确认后通过授权本地项目路径启动 `127.0.0.1` 本地预览并交给外部浏览器、`/status` 聊天侧项目 / 任务 / 资产 / 预览 / 最近命令汇总、`/files` 聊天侧本地项目文件列表、`/read` 聊天侧文件读取的授权本地项目路径、`/tasks` 聊天侧任务拆分与下一步专业组展示的授权本地项目路径、聊天确认生成后实时展示 Planner / Orchestrator / 角色 brief / Generator / Evaluator / 写盘 / 自检进度,并自动读取 `.agent/run.latest.json` 在普通聊天消息里展示 Run、LLM 对话、loop 轮次、工具调用、active / carry-over 任务、返工焦点、编排轮次、最近步骤、画板同步建议命令和本地产物快照、`/trace` 聊天侧读取 `.agent/run.latest.json` 并展示 loop 轮次 / active 任务 / 返工路线 / dependency waves 的授权本地项目路径、`platform-agent` 编排测试、共享契约测试、Tauri 本地能力测试和无密钥本地 provider 端到端 smoke;用于证明独立 App、真实 LLM-compatible loop、本地落盘、自检和 HTTP 预览闭环,并覆盖 loop 跑满 3 轮失败时不会写入最终游戏产物。 +- `npm run ai-game-creator-shell:check`:覆盖壳 typecheck、聊天命令单测、用户 / 开发窗口 UI 边界 smoke、主窗口命令按钮复用 `/help` 命令列表、主窗口项目摘要从 manifest / trace 派生任务完成数、ready 数、资产来源分布和最近命令且未选项目时不显示、灵感草稿只填充输入框不提交、能力按钮复用 `/capabilities`、LLM状态按钮复用 `/llm-status` 且结果回填 Agent 状态列表、聊天侧 `/agents` 汇总和单 Agent 对话的 provider / 模型 / 流式 / API Key 读取状态、开发日志面板只读读取 `.agent/logs/command.log` / `preview.log` / `agent.log`、项目状态按钮复用 `/status`、权限按钮复用 `/policy` 且策略草稿按钮只填入 `/policy-confirm project.index` / `/policy-confirm asset.register` / `/policy-confirm memory.write` / `/policy-confirm preview.start` / `/policy-confirm preview.open` / `/policy-confirm preview.stop` / `/policy-confirm agent.run_status` / `/policy-confirm conversation.read` / `/policy-confirm conversation.write`、审计按钮复用 `/audit`、资产按钮复用 `/assets` 且资产结果可一键复用 `/read`、任务按钮复用 `/tasks`、聊天侧 `/agents` 汇总每个 Agent 的当前状态、聊天侧 `/agent-conversations` 列出 Agent 对话读取命令、聊天侧 `/agent-memories` 列出 Agent 私有记忆读取命令、Trace 按钮复用 `/trace`、文件按钮复用 `/files` 且文件结果可一键复用 `/read`、索引按钮复用 `/index`、记忆 / 短期记忆 / 黑板按钮复用 `/memory long|short|blackboard`、快照按钮复用 `/checkpoint`、快照列表按钮复用 `/checkpoints` 且 checkpoint 结果可一键复用 `/diff` / `/restore`、历史按钮复用 `/history`、受限命令白名单按钮复用 `/commands` 且无需项目初始化、静态自检快捷按钮复用 `/smoke`、预览状态快捷按钮复用 `/preview-status`、主窗口运行时配置面板读写 Tauri 配置目录中的 `game-creator.config.json`、支持全局与每个 agent 单独选择 LLM Provider 且不把 API Key 写入聊天、单 Agent 对话面板可手动追加私有记忆且走 `memory.write` 策略、主窗口提供音效登记、画板音频导入和常用生成产物读取草稿入口,聊天侧 `/art` 可盘点美术素材且不直接触发平台生成或画板同步,聊天侧 `/context` 可盘点生成上下文来源且不直接读取上下文文件,聊天侧 `/timeline` 可汇总项目活动时间线且不直接读取日志或 trace 文件,聊天侧 `/artifacts` 可列出常用生成产物读取命令,聊天侧 `/run-artifacts` 可列出最近 run 产物读取命令,聊天侧 `/run-files` 可列出 Agent 运行辅助文件读取命令,聊天侧 `/logs` 可列出固定日志读取命令且不直接读取日志,聊天侧 `/brief` 只基于当前已加载的 manifest / 最近 run trace / 预览状态 / 资产数量 / 最近命令生成项目简报,提供 `/next` 后续草稿且不直接触发 Tauri 读写、文件读取、预览启动或新增面板,聊天侧 `/next` 基于当前已加载的 manifest / 最近 run trace 输出下一步建议和 `/tasks` / `/criteria` / `/groups` / `/budget` / `/qa` / `/trace` / `/run` / `/open-preview` / `/assets` / `/art` / `/context` / `/timeline` / `/artifacts` / `/run-artifacts` / `/run-files` / `/logs` / `/agent-resume ` 等安全命令草稿方向,提供一个首选草稿且不直接触发 Tauri 读写、预览启动或文件读取,聊天侧 `/capabilities` 展示标准 Agent 能力清单且不打开开发面板、聊天侧 `/audit` 从 manifest / 本地文件 / `.agent/run.latest.json` 分别汇总用户面、6 组任务配置、6 组协作证据、任务编排、loop、记忆、本地产物、HTTP 预览、画板回流和权限日志证据且不打开开发面板;未生成 `.agent/run.latest.json` 前,`/audit` 只能标记任务配置通过,不能把 6 组协作证据误判为通过;trace 已存在但状态为 `failed`、`needs-revision`、`running`、`max-passes-exhausted` 或缺少 `Evaluator passed` 步骤时,`/audit` 不能把 loop 误判为通过。聊天侧 `/llm-status` 只显示 base_url / model / API Key 已读取状态且不泄露密钥本体、聊天侧长期记忆查看 / 追加 / 覆盖 / 删除的授权本地项目路径、上传资产写入后的 manifest 刷新和 `/assets` 聊天可见性、`/smoke` 聊天侧确认后只通过授权本地项目路径执行白名单 `game.static_smoke`、`/run` 聊天侧确认后通过授权本地项目路径执行 `game.static_smoke`、启动 `127.0.0.1` 本地预览并交给外部浏览器、`/preview` 聊天侧确认后通过授权本地项目路径启动 `127.0.0.1` 本地预览并交给外部浏览器、`/status` 聊天侧项目 / 任务 / 资产 / 预览 / 最近命令汇总、`/files` 聊天侧本地项目文件列表、`/read` 聊天侧文件读取的授权本地项目路径、`/tasks` 聊天侧任务拆分与下一步专业组展示的授权本地项目路径、聊天确认生成后实时展示 Planner / Orchestrator / 角色 brief / Generator / Evaluator / 写盘 / 自检进度,并自动读取 `.agent/run.latest.json` 在普通聊天消息里展示 Run、LLM 对话、loop 轮次、工具调用、active / carry-over 任务、返工焦点、编排轮次、最近步骤、画板同步建议命令和本地产物快照、`/trace` 聊天侧读取 `.agent/run.latest.json` 并展示 loop 轮次 / active 任务 / 返工路线 / dependency waves 的授权本地项目路径、`platform-agent` 编排测试、共享契约测试、Tauri 本地能力测试和无密钥本地 provider 端到端 smoke;用于证明独立 App、真实 LLM-compatible loop、本地落盘、自检和 HTTP 预览闭环,并覆盖 loop 跑满 3 轮失败时不会写入最终游戏产物。 - `/risks` 聊天入口由 `appSurface.test.ts` 的主窗口 smoke 覆盖:只基于当前已加载的 manifest / trace / 预览 / 任务 / 资产 / 最近命令生成风险摘要,提供首个风险处理草稿,不触发 Tauri 读写、文件读取、预览启动或新增普通用户面板。 - `/criteria` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 manifest.tasks 和最近 run trace.taskGraph 汇总 active、carry、ready、失败或待处理任务的验收条件和产物,提供 `/tasks` 草稿,不触发 Tauri 读写、不读取任务文件或 trace 文件、不新增普通用户验收面板。 - `/groups` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 manifest.tasks 和最近 run trace.taskGraph / passPlans 汇总六个专业组的完成、active、carry、ready、失败数量和下一步任务,提供 `/tasks` 草稿,不触发 Tauri 读写、不读取任务文件或 trace 文件、不新增普通用户专业组面板。 - `/budget` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载最近 run trace 汇总轮次、工具调用、stopReason 和下一步建议,提供 `/review`、`/publish`、`/trace` 或 `/next` 草稿,不触发 Tauri 读写、不读取 trace 文件或新增普通用户预算面板。 +- `/qa` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 manifest、最近 run trace、最近命令和 preview 状态汇总 Evaluator、任务、静态自检、试玩和产物状态,提供 `/review`、`/tasks`、`/trace`、`/playtest`、`/publish` 或 `/next` 草稿,不触发 Tauri 读写、不读取 trace 或日志文件、不启动或打开预览、不新增普通用户 QA 面板。 - `/review` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 run trace 汇总 Evaluator 状态、返工焦点、返工路线和最近评审步骤,提供 `/read .agent/findings.md` 或 `/agent-resume ` 草稿,不直接读取评审文件、不触发 Tauri 读写或新增普通用户面板。 - `/context` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 manifest 和最近 run trace 列出项目对话、短期 / 长期记忆、黑板、Agent 对话、Agent 私有记忆、manifest、最近 trace 和最近 LLM 输入路径,提供 `/read` 或 `/memory blackboard` 草稿,不触发 Tauri 读写、不读取上下文文件或新增普通用户面板。 - `/timeline` 聊天入口由 `appSurface.test.ts` 主窗口 smoke 覆盖:只基于当前已加载 manifest.commandRuns 和最近 run trace 汇总最近命令、日志读取草稿和最近 Agent 步骤,提供 `/read`、`/trace` 或 `/history` 草稿,不触发 Tauri 读写、不读取日志或 trace 文件、不新增普通用户时间线面板。 @@ -202,9 +204,10 @@ game-project/ - 聊天输入 `/criteria` 只使用主窗口当前已加载的 manifest.tasks 和最近 run trace.taskGraph,在聊天里列出 active、carry、ready、失败或待处理任务的验收条件和预期产物,并提供 `/tasks` 草稿;该命令不调用 Tauri 读写、不读取任务文件或 trace 文件、不新增普通用户验收面板,真正查看完整任务仍由用户发送 `/tasks` 并走原读取流。 - 聊天输入 `/groups` 只使用主窗口当前已加载的 manifest.tasks 和最近 run trace.taskGraph / passPlans,在聊天里列出六个专业组的完成、active、carry、ready、失败数量和下一步任务,并提供 `/tasks` 草稿;该命令不调用 Tauri 读写、不读取任务文件或 trace 文件、不新增普通用户专业组面板,真正查看完整任务仍由用户发送 `/tasks` 并走原读取流。 - 聊天输入 `/budget` 只使用主窗口当前已加载的最近 run trace,在聊天里列出轮次、工具调用、stopReason 和下一步建议,并提供 `/review`、`/publish`、`/trace` 或 `/next` 草稿;该命令不调用 Tauri 读写、不读取 trace 文件、不新增普通用户预算面板,真正查看完整 trace 仍由用户发送 `/trace` 并走原读取流。 +- 聊天输入 `/qa` 只使用主窗口当前已加载的 manifest、最近 run trace、最近命令和 preview 状态,在聊天里列出 Evaluator、任务、静态自检、试玩、最近试玩步骤和产物数量,并提供 `/review`、`/tasks`、`/trace`、`/playtest`、`/publish` 或 `/next` 草稿;该命令不调用 Tauri 读写、不读取 trace 或日志文件、不启动或打开预览、不新增普通用户 QA 面板,真正运行自检或打开预览仍由用户发送对应草稿并走原确认流。 - 聊天输入 `/handoff` 只使用主窗口当前已加载的 manifest、最近 run trace、Agent 状态和已载入历史 run 批次,在聊天里生成项目交接摘要,并提供 `/next` 作为后续草稿;该命令不调用 Tauri 读写、不读取文件、不启动或打开预览、不新增普通用户面板,用户必须再发送草稿并按原命令权限流继续。 - 聊天输入 `/runs` 只使用主窗口当前已加载的 latest trace 和已载入历史 run 批次,在聊天里列出 `/trace` 和 `/read .agent/runs/...` 读取草稿;该命令不调用 Tauri 读写、不滚动加载更多历史、不启动或打开预览、不新增普通用户面板,用户必须再发送草稿并按原命令权限流继续。 -- 聊天输入 `/next` 只使用主窗口当前已加载的 manifest、最近 run trace 和最近命令摘要,在聊天里给出下一步建议,列出 `/tasks`、`/criteria`、`/groups`、`/budget`、`/trace`、`/review`、`/context`、`/timeline`、`/playtest`、`/run`、`/export`、`/exports`、`/open-preview`、`/assets`、`/art`、`/audio`、`/publish`、`/artifacts`、`/run-artifacts`、`/passes`、`/run-files`、`/internals`、`/logs`、`/agent-resume ` 等安全命令草稿方向,并提供一个首选草稿;该命令不调用 Tauri 读写、不启动或打开预览、不读取文件,用户必须再发送草稿并按原命令权限流继续。 +- 聊天输入 `/next` 只使用主窗口当前已加载的 manifest、最近 run trace 和最近命令摘要,在聊天里给出下一步建议,列出 `/tasks`、`/criteria`、`/groups`、`/budget`、`/qa`、`/trace`、`/review`、`/context`、`/timeline`、`/playtest`、`/run`、`/export`、`/exports`、`/open-preview`、`/assets`、`/art`、`/audio`、`/publish`、`/artifacts`、`/run-artifacts`、`/passes`、`/run-files`、`/internals`、`/logs`、`/agent-resume ` 等安全命令草稿方向,并提供一个首选草稿;该命令不调用 Tauri 读写、不启动或打开预览、不读取文件,用户必须再发送草稿并按原命令权限流继续。 - 聊天输入 `/review` 只使用主窗口当前已加载的最近 run trace,在聊天里列出 Evaluator 通过 / 需返工状态、返工焦点、返工路线、下一步和最近评审步骤;该命令不调用 Tauri 读写、不读取 `.agent/findings.md`、不新增普通用户评审面板,真正读取评审记录仍由用户发送 `/read .agent/findings.md` 并走 `file.read` 权限流,需要返工时只填入 `/agent-resume ` 草稿。 - 聊天输入 `/context` 只使用主窗口当前已加载的 manifest 和最近 run trace,在聊天里列出项目对话、短期记忆、长期记忆、项目黑板、Agent 对话、Agent 私有记忆、manifest、最近 trace 和最近 LLM 输入路径;该命令不调用 Tauri 读写、不读取上下文文件、不新增普通用户上下文面板,真正查看上下文仍由用户发送 `/read` 或 `/memory blackboard` 并走原权限流。 - 聊天输入 `/timeline` 只使用主窗口当前已加载的 manifest.commandRuns 和最近 run trace,在聊天里列出最近命令、日志读取草稿、最近 Run 状态和最近 Agent 步骤;该命令不调用 Tauri 读写、不读取日志或 trace 文件、不新增普通用户时间线面板,真正查看日志、trace 或历史仍由用户发送对应草稿并走原权限流。