Harness七阶段工作流完全解析从领域分析到Harness进化【免费下载链接】harnessA meta-skill that designs domain-specific agent teams, defines specialized agents, and generates the skills they use.项目地址: https://gitcode.com/GitHub_Trending/harness/harness还在让AI一个一个写提示词吗Harness是专为 Claude Code 打造的「元技能」meta-skill一句为这个项目搭建 harness它就能自动设计领域专属的AI Agent 团队并生成团队成员使用的技能文件。本文将完整解析 Harness 七阶段工作流的内在逻辑从领域分析、团队架构设计到最终的 Harness 持续进化帮你零基础看懂并快速构建自己的 AI 智能体自动化体系。一、Harness 是什么一个会设计团队的工厂 普通 AI 工具帮你完成任务而 Harness 帮你组建团队完成任务。它处于 Claude Code 生态的L3 元工厂层——不是某个固定用途的 harness而是生成 harness 的 harness 工厂你的输入Harness 的输出一句领域描述如搭建一个金融科技风险评估团队.claude/agents/目录下 3~5 个专家 Agent 定义文件同一句领域描述.claude/skills/目录下配套技能文件 1 个编排器Orchestrator技能它的核心价值在于把谁来干Agent和怎么干Skill彻底分离再用六种经典架构模式流水线、扇出/扇入、专家池、生产-审核、监督者、层级委派把团队编排起来。完整模式定义见 skills/harness/references/agent-design-patterns.md。二、快速上手3 步得到你的 Agent 团队 跟着 docs/quickstart.md 的官方快速开始指南5 分钟内可以跑通添加插件市场约 60 秒在 Claude Code 中执行/plugin marketplace add revfactory/harness安装插件并开启实验开关约 40 秒执行/plugin install harnessharness-marketplace并在 shell 中设置export CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS1开启 Agent Teams 能力原因详见 docs/experimental-dependency.md一句话生成团队约 2 分钟输入build a harness for a fintech risk-assessment teamHarness 会自动写入 3~5 个 Agent 文件和配套技能 韩国/日本用户也有原生触发词하네스 구성해줘 / ハーネスを構成して底层技能完全一致。三、七阶段工作流总览先审计再七步走完整流程定义在 skills/harness/SKILL.md 的워크플로우工作流章节。触发技能后Harness 会先执行Phase 0 现状审计再进入七个核心阶段阶段名称做什么关键产出0现状审计检查已有 Agent/技能判断是新建、扩展还是运维审计结论 执行计划1领域分析识别核心任务类型、探索代码库、感知用户熟练度领域画像2团队架构设计选执行模式 选架构模式 定 Agent 拆分标准团队蓝图3Agent 定义生成为每个成员写定义文件.claude/agents/{name}.md4技能生成为每个 Agent 写 SKILL.md.claude/skills/{name}/5集成与编排写编排器串联数据流与错误处理编排器技能 CLAUDE.md 指针6验证与测试结构校验、A/B 对比测试、触发词验证测试报告7Harness 进化收集反馈、定向修改、记录变更历史更强大的新 HarnessPhase 0 审计是容易被忽略但最关键的一步它会读取已有的agents/、skills/和CLAUDE.md检测漂移定义文件与文档记录不一致然后分流到三种执行路径——全新搭建、存量扩展只跑需要的阶段、运维维护走 Phase 7-5 工作流。这保证了 Harness 是越用越懂你项目的而不是每次从零覆盖。阶段 1领域分析——先听懂你要做什么对应 SKILL.md 第 37-42 行。这个阶段 Harness 做四件事识别领域与任务类型你的需求属于生成、验证、编辑、分析中的哪几类冲突与重复分析基于 Phase 0 审计结果检查新需求是否会和已有 Agent/技能撞车探索代码库摸清技术栈、数据模型、主要模块用户熟练度感知通过对话用词判断你的技术水平对新手自动解释断言JSON schema这类术语这个细节非常贴心——同一个 harness对资深工程师和小白用户会采用不同的沟通语气。阶段 2团队架构设计——选模式、拆角色这是整个工作流的设计图阶段SKILL.md 第 44-76 行需要回答三个问题① 执行模式怎么选模式适用场景特点Agent 团队默认首选2 个以上 Agent 协作、需要实时交换反馈成员间直接发消息、共享任务列表、自主协调子 Agent备选单点任务、只要结果不要沟通直接调用结果返回主流程开销小混合不同阶段特性差异大如并行收集(子Agent) → 共识整合(团队)② 架构模式选哪种六种经典模式各有适用场景模式一句话理解典型例子流水线上一步输出 下一步输入小说创作世界观→角色→大纲→写作→编辑扇出/扇入并行调查后汇总深度研究4 个渠道同时查 → 综合报告专家池按情况点名专家代码审查安全/性能/架构按需调用生产-审核生产者质检员配对内容创作写完必审最多重试 2~3 次监督者中央调度动态派活大规模迁移监督者看进度实时分配层级委派层层分派子任务全栈开发总负责→前端组长→UI/逻辑/测试③ Agent 怎么拆用专业性、并行性、上下文负担、可复用性四个维度判断领域不同就拆开强依赖就合并。阶段 3Agent 定义生成——把人设写成文件SKILL.md 第 78-105 行 规定每个 Agent 必须生成独立的定义文件.claude/agents/{name}.md哪怕使用的是内置类型。因为文件化才能跨会话复用。每个定义文件包含五大必备板块核心角色你是某领域的什么专家工作原则必须遵守的行为准则输入/输出协议从哪读、往哪写、什么格式团队通信协议收谁的消息、发给谁、能请求什么类型的任务错误处理失败、超时时怎么办⚠️ 一个反直觉的规定Harness 明确禁止只在调用时临时塞 prompt 定义角色——那等于团队解散后人员全失忆。阶段 4技能生成——给 Agent 写操作手册 技能生成阶段SKILL.md 第 107-179 行产出每个 Agent 的操作手册核心技巧有三条技巧 1激进的 description。description 是技能唯一的触发器要写得理直气壮。❌ 差例处理 PDF 的技能✅ 好例读取、提取、合并、拆分、加密 PDF 的一切操作只要提到 .pdf 文件就必须使用本技能。技巧 2讲 Why 而不是只讲 Rule。与其写永远用 A 工具不如写因为 B 工具会破坏表格行列结构所以表格提取用 A 工具——理解了原因Agent 在边缘情况下也能正确决策。技巧 3渐进式披露Progressive Disclosure。这是控制上下文成本的核心机制层级加载时机体积目标元数据名称描述常驻上下文约 100 词SKILL.md 正文技能触发时500 行以内references/ 参考文档真正需要时才读不设上限详细写法可参考 skills/harness/references/skill-writing-guide.mdQA 角色的团队还能参考 skills/harness/references/qa-agent-guide.md 中基于真实项目 7 个 bug 总结的验证方法论。阶段 5集成与编排——让团队转起来编排器Orchestrator是整个 Harness 的总指挥它回答的不是每个 Agent 干什么而是谁、在什么时候、按什么顺序协作。这一阶段SKILL.md 第 181-300 行包含四个关键设计数据传递协议轻量状态用消息、进度追踪用任务列表、大体积成果用文件统一存到_workspace/并保留用于审计子 Agent 场景则靠返回值收集团队规模指南小任务 2~3 人、中任务 3~5 人、大任务 5~7 人——3 个专注的队友胜过 5 个涣散的队友CLAUDE.md 指针注册只在项目根文件记录触发规则 变更历史两行关键信息新会话即可自动唤醒编排器不堆砌冗余信息后续任务支持description 中预埋重新运行、更新、只重做某部分等关键词否则首次运行后 Harness 就成了死代码完整模板含团队/子Agent/混合三套见 skills/harness/references/orchestrator-template.md。阶段 6验证与测试——不测试的团队不上岗验证阶段SKILL.md 第 302-360 行是质量关卡最有含金量的做法是With-skill vs Without-skill 对比测试为每个技能写 2~3 个像真人会输入的测试提示词同时派出两个子 Agent一个带着技能干活一个裸跑做基线用断言客观可验证项 用户评审主观项双轨打分发现问题就泛化修复禁止只针对单个例子的打补丁再测循环到满意另有触发验证为每个技能准备 8~10 条应该触发和 8~10 条近似但不该触发的查询专挑边界模糊的用例比如把这个 Excel 图表导出成 PNG到底该找表格技能还是图片技能。方法论细节见 skills/harness/references/skill-testing-guide.md。阶段 7Harness 进化——越用越聪明的闭环这是最体现元技能思想的一环SKILL.md 第 361-428 行Harness 不是交付物而是活系统。每次执行后主动邀请你反馈然后按类型精准修改反馈类型修改对象例子成果质量不达标对应 Agent 的技能分析太浅 → 技能里加深度标准角色覆盖不全Agent 定义文件还需要安全审查 → 新增 Agent流程顺序别扭编排器技能应该先验证 → 调整阶段顺序触发失灵技能 description这么说它不启动 → 扩展触发词每次修改都会写入 CLAUDE.md 的变更历史表日期/内容/对象/原因既方便追溯演进方向也防止改着改着退化。当同类反馈出现 2 次以上、或你开始绕过编排器手动干活时Harness 会主动提出进化建议。四、参考文件清单 文件用途skills/harness/SKILL.md主技能定义完整工作流 交付物检查清单skills/harness/references/agent-design-patterns.md六种架构模式 执行模式决策树skills/harness/references/orchestrator-template.md编排器三套模板团队/子Agent/混合skills/harness/references/team-examples.md5 个真实团队配置范例研究队、小说创作队等skills/harness/references/skill-writing-guide.md技能编写模式与数据 schema 标准skills/harness/references/skill-testing-guide.md测试评估与迭代改进方法论skills/harness/references/qa-agent-guide.mdQA Agent 集成与边界缺陷验证指南docs/quickstart.md5 分钟安装上手指南docs/experimental-dependency.md实验开关依赖说明与迁移承诺五、总结七阶段一个闭环 回顾整条链路审计现状 → 懂你的领域 → 画团队蓝图 → 写人设 → 写手册 → 装总指挥 → 考试上岗 → 持续进化。Harness 的七阶段工作流本质是把组建 AI 团队这件事工程化了前四个阶段解决队伍怎么建第五六阶段解决队伍怎么跑、跑得对不对第七阶段解决队伍怎么变强。官方 A/B 实验数据也印证了这套结构化预配置的价值15 个软件工程任务上平均质量分从 49.5 提升到 79.360%且任务越复杂提升越明显详见 README.md。现在打开 Claude Code对你自己的项目说出那句咒语吧build a harness for this project。【免费下载链接】harnessA meta-skill that designs domain-specific agent teams, defines specialized agents, and generates the skills they use.项目地址: https://gitcode.com/GitHub_Trending/harness/harness创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考