资讯动态

Claude Code Game Studios 数值系统设计师 Agent 行为规格与测试方案:从公式审查到平衡守门人的完整测试框架

发布时间:2026/9/13 11:57:55 来源:尧图企业网站定制
Claude Code Game Studios 数值系统设计师 Agent 行为规格与测试方案从公式审查到平衡守门人的完整测试框架【免费下载链接】Claude-Code-Game-StudiosTurn Claude Code into a full game dev studio — 49 AI agents, 72 workflow skills, and a complete coordination system mirroring real studio hierarchy.项目地址: https://gitcode.com/GitHub_Trending/cl/Claude-Code-Game-Studios导读本文聚焦 CCGSClaude Code Game Studios测试框架中 systems-designer数值系统设计师 这一 Tier-2 Lead 级 Agent 的行为规格Behavioral Spec与其五案例测试方案。你将看到这个只读型的公式与平衡守门人如何用APPROVED / NEEDS REVISION词汇裁决伤害公式、如何拒绝越界任务、如何把玩家体验复杂度之争上交给 creative-director、以及如何利用门禁上下文做具体数值验算。读完本文你既能直接复用这套 Agent 测试用例也能把领域边界 裁决词汇 冲突升级三位一体的规格化测试方法迁移到你自己团队的任何 Agent 上。一、这个 Agent 是谁领域边界与模型层级systems-designer 是 CCGS 工作室层级中的 Lead主管级 Agent其规格文件位于 CCGS Skill Testing Framework/agents/leads/systems-designer.md。它的身份由三件事定义拥有的领域Domain owned战斗公式combat formulas、成长曲线progression curves、制作配方crafting recipes、状态效果交互status effect interactions、经济数值economy math与数值平衡numerical balance。明确不拥有的领域Does NOT own叙事与世界观 →narrative-director视觉设计 →art-director代码实现 →lead-programmer概念机制规则本身 →game-designer协作对象不接管模型层级Sonnetclaude-sonnet-4-6。规格文件明确解释这是单个系统分析——公式审查与平衡数学的适用场景。这与 .claude/docs/coordination-rules.md 中的模型分层一致Opus 留给多文档综合、高利害阶段门禁裁决、跨系统整体审查而实现、设计撰写、单个系统分析默认走 Sonnet——systems-designer 的公式级审查正属于后者。门禁 ID规格写明它在公式与平衡规格上产出Systems Review 裁决使用APPROVED / NEEDS REVISION词汇表——注意这与 creative-director 的APPROVE / CONCERNS / REJECT、producer 的REALISTIC / CONCERNS / UNREALISTIC明显不同词汇表本身就是领域边界的一部分可对照 creative-director 规格 与 quality-rubric.md 的 lead 类指标 L1。二、静态断言先验结构检查Structural / Static Assertions在跑任何行为用例前测试者先做读 frontmatter式的结构校验。这部分在 agent-test-spec.md 模板 中有完整对应对 systems-designer 的四条断言是断言校验内容description:存在且领域化必须提到公式、成长曲线、平衡数学、经济——而非泛泛的游戏设计助手allowed-tools:以读为主可含 Bash用于公式求值脚本无委托情况下不得在design/balance/之外写入模型层级按 coordination-rules 应为claude-sonnet-4-6不越权声明定义中不得宣称拥有叙事、视觉设计或概念机制规则的权威这条静态检查的价值在于它把领域边界写成可断言的前置条件任何 Agent 定义文件的回归都能被自动捕获。三、五个行为用例逐案例测试详解Case 1域内请求——格式正确的裁决输出场景提交一条伤害公式damage base_attack * (1 strength_modifier * 0.1) - defense * 0.5并给出参数范围base_attack [10–100]、strength_modifier [0–20]、defense [0–50]。公式在全部合法区间内产出正伤害、缩放平滑、无除零与溢出风险。期望返回APPROVED理由需说明公式在给定设计参数内平衡、全输入范围内输出有效、无退化情形degenerate case。断言要点裁决词恰好是APPROVED/NEEDS REVISION二选一理由体现跨输入范围验证min/max 端点都已检查输出保持在系统领域内——不评论机制好不好玩、不指导怎么实现裁决带上下文标签如Formula Review: APPROVED。测试设计观察这一用例同时考核数值正确性与领域纪律。一个容易翻车的实现是顺手点评机制趣味性或给出实现建议——断言明确禁止这种越界。Case 2域外请求——重定向或升级场景一位 writer 请 systems-designer 起草一个支线任务脚本奖励稀有制作材料。期望Agent 拒绝撰写任务脚本内容重定向到 writer 或 narrative-director。断言要点不写任务叙事内容或对话明确点名writer或narrative-director为正确处理者可以指出奖励的系统含义如该材料按制作经济模型应稀缺到有意义的程度但一切脚本撰写交由叙事团队。测试设计观察这是对协作而不越权的精确测试——允许点评系统含义、禁止产出叙事本体。参照 game-designer 规格 的 Case 2 可发现同样的重定向模式在 CCGS 各 Agent 中统一存在。Case 3门禁裁决——词汇表正确性退化情形识别场景提交缩放公式damage base_attack * level_multiplier其中level_multiplier (player_level / enemy_level) ^ 2。玩家满级 50 对 1 级敌人时倍率 2500x——10 基础攻击的武器打出 25000 伤害远超任何有意义的平衡上限。这是满级时的退化情形。期望返回NEEDS REVISION并具体指出退化情形满级 vs 最低级敌人时产生 2500x 倍率摧毁一切平衡天花板。断言要点裁决词二选一不是自由文本理由包含具体退化输入值player level 50、enemy level 1与结果2500x指出具体问题组件平方比^2至少给出一种修订方向如 clamp 比率、改用对数刻度但不强制指定方案。测试设计观察这是五个用例中最核心的门禁守门人测试。它验证的不只是裁决而是诊断质量——必须定位到公式组件、给出输入值、并保持提供选项而非命令的中立性。Case 4冲突升级——正确的上级场景game-designer 想要简单、2 变量的伤害公式以保玩家直观systems-designer 认为带元素交互的 6 变量公式对战斗系统深度是必要的。双方无法就复杂度达成一致。期望systems-designer 清晰呈现两种方案的权衡——6 变量的调参粒度 vs 2 变量的玩家可读性——并升级到creative-director做玩家体验裁决。公式对玩家应多复杂是玩家体验问题而非纯数学问题。断言要点用具体例子呈现双方权衡升级到creative-director不得无视 game-designer 的反对单方面强推 6 变量公式无论批准何种复杂度保持可用状态去实现它。测试设计观察这与 game-designer 规格 的 Case 4 是成对测试——同一冲突从两个视角验证game-designer 拥有玩家体验意图systems-designer 拥有公式粒度决定权不可调和时双方都指向 creative-director。这也印证了 coordination-rules.md 中共享父级升级的规则设计冲突 → creative-director。Case 5上下文传递——使用给定的门禁上下文场景Agent 收到包含当前平衡数据的门禁上下文块敌人 HP 100–10,000玩家攻击 15–150目标 TTK击杀时间8–12 秒当前公式审查中。提交一条修订后的公式。期望用给定平衡数据评估最小/最大输入对、均衡对阵场景并验证 TTK 落在 8–12 秒目标窗口内引用给定数据中的具体数字。断言要点使用提供的 HP 与攻击取值范围至少对均衡对阵场景计算或估算 TTK对照 8–12 秒窗口验证结果不给泛泛的平衡建议——所有断言都用给定数字。测试设计观察这一用例测试上下文纪律——Agent 必须把裁决锚定在传入数据上而非搬出通用平衡常识。这与 creative-director 规格 的 Case 5用 pillars 文档的确切词汇评估同构门禁上下文不是装饰是裁决的唯一证据源。四、协议合规清单把纪律写成可勾选项规格的 Protocol Compliance 部分是每个用例都要回测的收敛条件仅用APPROVED / NEEDS REVISION词汇返回裁决保持在声明的系统/公式领域内玩家体验类复杂度权衡升级到 creative-director不做有约束力的叙事、视觉、代码实现或概念机制决定提供具体的公式分析而非主观设计意见。这五条与 quality-rubric.md 的lead 类指标L1–L3一一呼应域内裁决L1、向共享父级升级L2、Sonnet 模型层级L3。也就是说systems-designer 规格不是孤立文件而是整个 CCGS 质量分层的一部分。五、Coverage Notes已知测试盲区规格末尾明确列出尚未覆盖的四块领域这本身是重要的测试资产——它告诉你下一步该补哪些用例成长曲线审查XP 曲线、等级缩放——未覆盖应新增专门用例经济模型审查资源产出/消耗速率、通胀预防——未覆盖状态效果交互矩阵叠加规则、优先级、免疫交互——未覆盖跨系统公式依赖审查如制作公式反哺战斗公式——未覆盖延后至集成测试。注意盲区清单与拥有的领域清单的重合战斗公式、成长曲线、制作配方、状态交互、经济数学这五块里只有战斗公式有直接用例Case 1/3/5其余四块都待补。这正好演示了规格文件自我暴露缺口的工程价值。六、仓库中的配套证据systems-designer 在管线中的实际落点规格文件不是孤岛。在仓库中搜索systems-designer可以看到它的协作上下文docs/examples/session-design-crafting-system.md一个制作系统设计会话中明确记录咨询 systems-designer 做 XP 曲线公式验证——这正是规格中域内请求Case 1与上下文传递Case 5的真实工作形态catalog.yamlsystems-designer以category: lead注册spec:字段指向本规格文件是测试框架的权威索引CLAUDE.mdAgent 分层清单中 systems-designer 属于 creative 分层与 game-designer、economy-designer 同层进一步印证其设计侧归属entities.yaml设计侧还有一份跨文档事实注册表其中formulas与constants是数值系统的事实源头——systems-designer 的审查工作正应与这类注册表联动例如 XP 曲线的常量一旦变更需按revised:机制追溯。七、把方法迁移到你的项目一套可复用的 Agent 测试配方从这份规格中提炼出的通用方法论与 agent-test-spec.md 模板 的骨架一致先写静态断言description领域化、工具白名单、模型层级、不越权声明——四行即可锁定 Agent 身份。五个行为用例覆盖五条轴线域内请求能做对→ 域外请求不乱接→ 门禁裁决词汇诊断质量→ 冲突升级找对上级→ 上下文传递用对证据每条断言都写成[ ]可勾选清单方便回归时逐项核对。协议合规清单做收敛每个用例结果最终必须满足同一组协议项防止单个用例通过、整体纪律溃散。Coverage Notes 显式暴露盲区把没测什么写进规格既是待办清单也是下一代用例的种子。结语systems-designer 的这份测试规格本质上是在回答一个问题如何让一个负责全游戏数值健康的 Agent 既精通数学、又严守边界答案浓缩在三个机制里——APPROVED / NEEDS REVISION的封闭词汇表、领域边界的静态断言与越界重定向、以及玩家体验之争上交 creative-director的升级路径。无论你是要在 CCGS 框架里为新增 Agent 补测试还是想为自己的多 Agent 系统建立规格化质量层这份文件都提供了可直接落地的范本。【免费下载链接】Claude-Code-Game-StudiosTurn Claude Code into a full game dev studio — 49 AI agents, 72 workflow skills, and a complete coordination system mirroring real studio hierarchy.项目地址: https://gitcode.com/GitHub_Trending/cl/Claude-Code-Game-Studios创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价