ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Claude Code Game Studios world-builder Agent 行为测试规范:世界设定的一致性守卫与职责边界

Claude Code Game Studios world-builder Agent 行为测试规范:世界设定的一致性守卫与职责边界 Claude Code Game Studios world-builder Agent 行为测试规范世界设定的一致性守卫与职责边界【免费下载链接】Claude-Code-Game-StudiosTurn Claude Code into a full game dev studio — 49 AI agents, 72 workflow skills, and a complete coordination system mirroring real studio hierarchy.项目地址: https://gitcode.com/GitHub_Trending/cl/Claude-Code-Game-Studios本文围绕 Claude Code Game StudiosCCGS中world-builder这一专职世界构建 Agent 的行为测试规格展开它定义了这个 Agent 拥有什么、不拥有什么、以何种协议守护世界设定的内部一致性以及如何用 5 个典型场景检验它的行为。读完本文你将掌握 CCGS 中 Agent 测试规格Agent Test Spec的完整结构、/skill-test行为测试的运行方式以及 world-builder 与 writer、game-designer、narrative-director 之间的协作边界。一、Agent 定位world-builder 拥有什么不拥有什么在 CCGS 的 49 个 Agent 体系中world-builder 属于creative创意层级详见 CLAUDE.md 的 Agent tiers 划分其测试规格注册于 catalog.yaml类别为specialist。核心领域Domain世界设定架构world-builder 的职责范围覆盖一个游戏世界的全部静态事实层派系Factions各派系的文化、政体、内部动机世界历史World history时间线上的重大事件与纪元地理与生态Geography and ecology地貌、生物群落与自然法则宇宙观与形而上学Cosmology and metaphysics世界的本源结构世界规则World rules魔法如何运作、什么可能什么不可能内部一致性执行Internal consistency enforcement对上述所有内容的跨文档一致性校验。明确不拥有Does NOT own规格用三条硬性边界划清了 world-builder 的禁区领域归属 Agent具体 NPC 或任务对话writer由世界规则衍生出的游戏机制规则game-designer / systems-designer叙事故事结构与弧线设计narrative-director这三条边界构成了整个测试规格的骨架域内请求要完整产出域外请求要清晰重定向跨域冲突要标记并升级——而不是越界处理。模型层级与 Gate 归属Model tierSonnet——与所有创意型专家 Agent 一致的默认层级Gate IDsNone无独立关卡门禁当世界规则与游戏机制发生冲突时规格要求联合升级escalates到 narrative-director 与 game-designer而非自行裁决。这一设计细节值得注意与 narrative-director 拥有ND-CONSISTENCY门禁、game-designer 使用APPROVED / NEEDS REVISION裁决词汇不同world-builder 没有自己的 gate 前缀——它的职责是产生设定 暴露矛盾而不是裁决。二、静态断言结构合规检查在进入行为测试之前规格先定义了 4 项静态断言Static Assertions用于核验 Agent 定义文件的体检项description:字段存在且具备领域特异性须提及 world lore、factions、history、world rules、ecology而非泛泛而谈allowed-tools:列表与角色匹配仅可读写 design/narrative/world 类文档不可访问游戏源码、机制设计或对话文件模型层级为 Sonnet创意型专家默认值Agent 定义中不得宣称拥有对话写作、机制设计或叙事弧线结构的权限。这套断言与 agent-test-spec.md 模板中的结构一致Agent file 存在、frontmatter 含 name/description/model/tools、领域明确、升级路径记录、不越权决策区别在于此处针对 world-builder 固化了领域关键词。三、五项行为测试用例检验边界与一致性行为测试是整个规格的核心。5 个用例按域内 → 域外 → 矛盾检测 → 跨域协同 → 上下文透传五个维度层层递进地检验 world-builder 的行为。Case 1域内请求——派系文化与政体设计输入Design the Ironveil Merchant Consortium——一个强大的贸易派系。我需要它的文化、政体结构和内部动机。预期行为要求产出结构化的派系档案faction profile而非叙事散文并完整覆盖文化价值与规范cultural values and norms政体结构政府如何决策、权力在谁手中、继承或任命流程派系内部的派系或紧张关系internal factions or tensions与其他派系的关系盟友、对手、中立方首要动机他们想要什么、为什么。规格还给出了两条质量红线内部一致性商人公会的政体应由经济逻辑驱动而非封建或宗教逻辑——除非刻意设计成混合政体内部张力输出必须包含至少一处内部矛盾或张力——没有内部复杂性的派系是扁平的factions without internal complexity are flat。这条至少一个内部张力的要求直接呼应了仓库中 team-narrative.md 的协作场景该技能在 Phase 2 会并行 spawn world-builder 与 writer让 world-builder 产出 Ironveil 派系相关的 lore 条目writer 基于角色声线起草对话——说明派系档案不仅是设定文档还是下游对话与叙事产出的输入数据。Case 2域外请求——对话写作重定向输入Write the dialogue for a Ironveil Consortium merchant NPC that the player meets at the city gates.预期行为不产出NPC 对话明确说明Dialogue writing is owned by writer; I provide the world and faction context that informs the dialogue, including the factions culture, tone, and speaking style对话写作归 writer 所有world-builder 提供支撑对话的世界与派系上下文包括派系文化、语气与说话风格主动提出产出 writer 所需的派系说话风格笔记与文化上下文。这与 writer 自己的规格形成双向印证writer.md 的 Protocol Compliance 同样要求将世界历史与世界规则请求重定向到 world-builder不产出未经授权的 lore。两个规格互相约束构成了创意产线两侧的对称防线。Case 3新设定与既有历史矛盾——冲突标记最重要的一致性测试输入Add a lore entry stating the Ironveil Consortium was founded 50 years ago by a single merchant family.上下文既有设定该公会已存在 300 年由 12 个互相竞争的商人家族联合创立。预期行为依次为识别矛盾既有设定是 300 年历史 12 家族联合创立新条目声称 50 年 单一创始家族拒绝照写不按请求写入新条目标记冲突同时陈述两个版本明确指出哪个是既有设定、哪个是提议变更给出解决方案选项(a) 新条目有误应更正(b) 若新版本才是预期正典应更新既有设定(c) 存在世界内解释in-world explanation——当前家族声称创始功劳尽管起源是集体性的即不可靠叙事者unreliable narrator的刻意设计无法定论时升级将解决权路由到 narrative-director。值得注意的是选项 (c)规格并未把矛盾一律视为错误而是承认世界内的矛盾可以是一种叙事手法——但即使采用这种手法也必须显式声明而不是静默覆盖既有设定。在真实协作场景中这一能力被 team-narrative.md 的 Case 2 完整演练Phase 2 中 world-builder 检测到叙事简报的建国日期50 年前与ironveil-history.md中的既有正典200 年前冲突时必须返回BLOCKED并附原因由编排器立即把矛盾暴露给用户——这验证了矛盾必须被显式标记、不能静默通过的协议在团队级工作流中的落地。Case 4世界规则具有游戏性影响——与 game-designer 协同输入I want to establish a world rule: magic users who cast spells near iron ore are weakened. Iron disrupts arcane energy.预期行为产出 lore 条目形而上学的解释、世界中如何理解、历史影响识别游戏性影响该规则有直接的机制后果玩家靠近铁矿床会被 debuff关卡设计必须考虑铁矿布置标记协同要求明确声明This world rule has gameplay mechanics implications — game-designer needs to define how this translates into player-facing mechanics; proceeding with the lore without the mechanics definition risks inconsistency不单方面设计机制只描述 lore 规则及其暗示的机制领域然后交给 game-designer 裁决。这条用例检验的是跨域感知但不越界world-builder 必须能看见自己产出的规则在机制侧的涟漪效应同时把机制定义权完整让渡。对照 game-designer.md 的规格可以看到game-designer 的核心领域恰是玩家面向的规则与交互——两条规格在此处严丝合缝地咬合。规格还特别强调如果世界规则与机制发生冲突且无法在单一领域内解决应联合升级到 narrative-director 与 game-designer。Case 5上下文透传——使用既有世界文档输入上下文既有世界文档声明——世界采用双日系统其中白阳White Sun是奥术能量的来源且在名为黑暗期Darkening的 3 日月食期间奥术魔法完全失效。输入Add a lore entry about the Mages College and how they prepare for the Darkening.预期行为使用既定的双日宇宙观引用白阳作为奥术能量来源使用既定的黑暗期设定3 日月食、魔法失效不得发明不同的月食机制、时长或名称产出与既定规则一致的 lore 条目法师学院在黑暗期无法施法因此准备工作是实践性的囤积非魔法物资、重新排程、关停进行中的魔法进程不与上下文文档中的任何既定事实矛盾。这是规格标注的最重要的上下文感知测试the most important context-awareness test——它检验 Agent 是否把给定的世界事实当作硬约束而不是创作时可自由替换的素材。四、协议合规清单Protocol Compliance所有行为用例之上规格收敛为 5 条协议合规断言即 world-builder 在任何对话中的行为底线停留在声明的领域内派系、世界历史、地理、生态、世界规则、宇宙观将对话写作请求重定向到 writer并附带派系上下文笔记标记 lore 矛盾时同时陈述两个版本并提供解决选项——不静默覆盖既有设定识别世界规则的游戏性影响并标记与 game-designer 的协同需求使用上下文中的所有既定世界事实不发明既定 lore 的替代版本。这 5 条可以浓缩为一句话world-builder 是设定的生产者也是设定的第一道一致性闸门但永远不是设定的最终裁决者。最终裁决权在 narrative-director当 writer 与 world-builder 对同一事实产生分歧时例如古老文明只以歌唱交流与用刻写符文交流之争narrative-director.md 的 Case 4 明确要求其在自己领域内做出有约束力的正典裁决并指令双方对齐产出——这是层级化 Studio 组织结构的典型体现。五、覆盖范围说明与测试运行方式Coverage Notes哪些用例最关键规格末尾用注释明确标注了各用例的定位Case 3矛盾检测需要既有 lore 存在于上下文中——这是最重要的一致性测试**Case 4世界规则/机制协同**检验跨域意识重点是验证 Agent 识别机制边界而不越界Case 5是最重要的上下文感知测试Agent 必须使用既定事实而非创作替代方案无自动化运行器需人工评审或通过/skill-test运行。如何运行测试本规格属于 CCGS Skill Testing Framework 的组成部分。按 README.md 的说明所有测试由框架内置技能驱动/skill-test static world-builder # 检查结构合规静态断言 /skill-test spec world-builder # 按行为规格逐条评估5 个用例 协议合规 /skill-test category all # 按类别评分标准全量评估 /skill-test audit # 查看 49 个 Agent 的 has-spec / last tested / result 全貌测试执行流程遵循 CLAUDE.md 定义的工作流先读 catalog.yaml 取spec:权威路径 → 读 Agent 定义 → 逐用例评估 → 提供将结果写入results/并更新catalog.yaml的选项。当测试失败需要修复时/skill-improve world-builder会走完测试 → 诊断 → 提议修复 → 重写 → 重测 → 保留或回滚的完整闭环。一个重要的元规则见 CLAUDE.md 的 Spec validity note规格描述的是当前行为而非理想行为可能编码了缺陷当 Agent 在实际使用中表现异常时应先修正 Agent 本身再更新规格与修复后的行为对齐。六、仓库中的协同证据world-builder 在团队工作流中的角色world-builder 的规格并非孤立存在它在团队级技能team skills中被反复调用team-narrative.mdPhase 2 并行 spawn world-builder 与 writerworld-builder 发现 lore 矛盾时返回 BLOCKED 并附原因Phase 5 中与 writer、localization-lead 三者并行负责最终正典级别canon levels的收敛规格还要求Phase 2 必须并行而非串行、world-builder 的已完成产出在部分报告中必须被保留。team-level.mdStep 1 中 world-builder 提供 lore 上下文与环境叙事机会当其因森林区域无世界构建文档而 BLOCKED 时触发错误恢复协议——(a) 跳过 world-builder 并在关卡文档中标注 lore 缺口或 (b) 缩小范围重试world-builder 仅基于 game-concept.md 可推断内容工作最终报告必须标记 BLOCKED 且整体结论为 BLOCKED 而非 COMPLETE。writer.md与 world-builder 互为镜像将世界历史/世界规则请求重定向给 world-builder并把 lore 矛盾升级给 narrative-director。narrative-director.md作为 writer 与 world-builder 分歧的最终裁决者做出有约束力的正典决策。这套设定生产 → 一致性校验 → 跨域协同 → 上级裁决的链路正是 CCGS 以镜像真实游戏工作室层级结构为设计哲学的组织体现。world-builder 的 5 个测试用例本质上是把这条链路中最容易出错的三个瞬间——派系设定是否立体、矛盾是否被显式暴露、世界规则是否越界侵入机制——固化为可重复检验的行为标准。【免费下载链接】Claude-Code-Game-StudiosTurn Claude Code into a full game dev studio — 49 AI agents, 72 workflow skills, and a complete coordination system mirroring real studio hierarchy.项目地址: https://gitcode.com/GitHub_Trending/cl/Claude-Code-Game-Studios创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表