1 🤖 AI 编程智能体框架对比与工作流深度解析
本笔记整理了 Matt Pocock Skills 与 superpowers-zh 两个目前最热门的 AI 编程 Skills 框架的项目目录结构、核心设计理念、智能体分类以及标准开发工作流。
1.1 目录
1.2 框架概览与设计哲学对比
| 维度 | Matt Pocock Skills | superpowers-zh (AI编程超能力·中文版) |
|---|---|---|
| 定位 | 软件工程极简实践框架 (Real Engineering, not vibe coding) | 系统化 AI 编程通用方法论框架 |
| 起源/上游 | Matt Pocock (Total TypeScript 作者) 独立开源 | obra/superpowers (250k+ ⭐) + 中文本地化及本土技能 |
| 工具兼容性 | 遵循 Agent-Skills 标准,支持 Claude Code, Codex 等 | 适配 20 款 AI 工具(Claude Code, Cursor, Trae, Antigravity, Gemini CLI 等) |
| 核心机制 | 强调 “人-Agent” 深度对齐、领域模型 (DDD) 与 Seam (缝隙) 测试 | 强调 “思考->计划->验证->子Agent隔离” 的严密的 SOP (标准作业程序) |
| 适合场景 | 复杂业务逻辑、团队领域语言密集、架构演进项目 | 从头头脑风暴、大型多任务重构、需要严格审查和并行 agent 的项目 |
1.3 Matt Pocock Skills 深度解析
1.3.1 目录结构与分类
Matt Pocock Skills/
├── skills/
│ ├── engineering/ # 工程开发技能(代码编写、架构优化、TDD、审查等)
│ ├── productivity/ # 通用生产力技能(面试追问、上下文交接、技能编写)
│ ├── personal/ # 个人工具
│ ├── misc/ # 杂项与辅助脚本
│ └── in-progress/ # 孵化中的试验技能
└── docs_and_config/ # 配置与说明文档 (CONTEXT.md, README.md 等)
1.3.1.1 智能体分类:
- User-invoked (用户显式触发):由用户在 Chat 中使用命令(如
/grill-with-docs、/to-spec、/implement)触发,充当流程编排者(Orchestrators)。 - Model-invoked (模型自主调用):可被 Agent 自动调用(如
/tdd、/domain-modeling、/code-review),代表工程学科纪律 (Disciplines)。
1.3.2 核心设计理念
- 拒绝 Vibe Coding(感觉编码):解决“Agent 没听懂”的问题。通过主动追问边界(Grilling)拉齐认知。
- Domain-Driven Design (DDD / 领域建模):在开发过程中不断完善
CONTEXT.md(统一术语表)和 ADR(架构决策记录),减少 Agent 误解和 Token 消耗。 - 测试缝隙 (Seam Testing):仅在预先协商好的 Seam(公共边界)写测试,拒绝针对私有细节的无效测试。
- 代码防腐与熵减:提供
/improve-codebase-architecture定期重构大泥球(Ball of Mud)。
1.3.3 标准工程工作流
flowchart TD Step1["1. /setup-matt-pocock-skills<br/>(配置 Tracker 与标贴)"] --> Step2["2. /grill-with-docs<br/>(深度追问对齐 + 建立 CONTEXT.md)"] Step2 --> Step3["3. /to-spec<br/>(合成 PRD/Spec 规格书)"] Step3 --> Step4["4. /to-tickets<br/>(拆解为 Tracer-bullet 垂直切片)"] Step4 --> Step5["5. /implement<br/>(领任务实施)"] Step5 --> Step6["6. /tdd<br/>(红-绿测试驱动开发循环)"] Step6 --> Step7["7. /code-review<br/>(双轴审查: Standards + Spec)"]
1.4 superpowers-zh 深度解析
1.4.1 目录结构与分类
superpowers-zh/
├── skills/
│ ├── brainstorming/ # 头脑风暴(需求 -> 设计规格)
│ ├── writing-plans/ # 编写计划(规格 -> 步骤)
│ ├── executing-plans/ # 执行计划(按计划推演+验证)
│ ├── test-driven-development/ # 严格 TDD 流程
│ ├── systematic-debugging/ # 系统化调试(定位->假设->修复)
│ ├── requesting-code-review/ # 派遣审查 Agent
│ ├── receiving-code-review/ # 处理审查反馈
│ ├── verification-before-completion/ # 完成前证据验证
│ ├── dispatching-parallel-agents/ # 多 Agent 并发
│ ├── subagent-driven-development/ # 子 Agent 驱动开发
│ ├── chinese-code-review/ # 🇨🇳 中文代码审查规范(手动)
│ ├── chinese-git-workflow/ # 🇨🇳 中国 Git 平台适配(手动)
│ ├── chinese-documentation/ # 🇨🇳 中文文档排版规范(手动)
│ ├── chinese-commit-conventions/ # 🇨🇳 中文提交规范(手动)
│ ├── mcp-builder/ # 🇨🇳 MCP 服务器构建
│ └── workflow-runner/ # 🇨🇳 YAML 多角色工作流执行器
├── hooks/ # SessionStart 自动触发钩子
└── docs/ # 20 款工具的详细配置说明
1.4.1.1 智能体分类:
- 通用流 (Automatic Workflow Skills):全流程自动触发(如
brainstorming->writing-plans->executing-plans)。 - 子 Agent 调度 (Subagent & Parallel Skills):主 Agent 仅做调度,派生隔离的 Subagent 去执行和自我审查。
- 中国特色 Skill (Chinese Specific):带有
chinese-*前缀,专门适配 Gitee/Coding/CNB 平台、中文排版、中文提交规范及团队沟通文化。
1.4.2 核心设计理念
- 思考先行,验证至上 (Evidence-First):在未生成规格书之前绝不写代码;在未通过命令行命令拿出跑通证据前绝不出声“已完成”。
- 严格子 Agent 隔离 (Context Isolation):大任务拆解后,每个任务启动独立 Subagent 编写,避免单一上下文污染或超长 Token 溢出。
- 彻底自动化拦截 (Hooks-Driven):利用工具的 Hook 机制,在 Session 启动时自动注入技能规约,AI 会主动问“是否需要先头脑风暴”。
1.4.3 标准工程工作流
flowchart TD S1["1. 头脑风暴 (brainstorming)<br/>分析需求 -> 探究方案 -> 生成设计规格书"] --> S2["2. 编写计划 (writing-plans)<br/>把设计规格拆解为粒度极小的步骤清单"] S2 --> S3["3. 子Agent驱动 / 执行计划<br/>(subagent-driven-development / executing-plans)<br/>为每个 Task 派生独立子 Agent"] S3 --> S4["4. 测试驱动开发 (TDD)<br/>先写红测试 -> 补绿代码"] S4 --> S5["5. 证据先行验证 (verification-before-completion)<br/>必须跑通真实 Build/Test 并抓取 Log 证明"] S5 --> S6["6. 请求与接收审查 (code-review)<br/>独立 Agent 双向代码审查"] S6 --> S7["7. 开发完成 (finishing-a-development-branch)<br/>合并 Worktree / PR"]
1.5 两大框架对比总结与选择建议
1.5.1 🔍 总结对比
-
在“需求澄清”阶段:
- Matt Pocock 采用 Relentless Interview (不间断追问),重点在于建立团队的统一术语 (Ubiquitous Language)。
- superpowers-zh 采用 Brainstorming (头脑风暴),重点在于推演 2-3 个技术架构方案并让用户做选择题。
-
在“任务执行”阶段:
- Matt Pocock 强调 Tracer Bullet (追踪弹/垂直切片),保证每个 ticket 都能端到端演示。
- superpowers-zh 强调 Subagent Sub-tasking (子 Agent 隔离),保证每个子任务都在干净的新上下文窗口中运行。
-
在“质量把控”阶段:
- 两者都将 TDD (红绿循环) 和 Code Review (代码审查) 作为强制要求。
1.5.2 💡 搭配使用建议
- 如果您在进行团队复杂业务系统开发:优先使用 Matt Pocock Skills 的
/grill-with-docs理念建立团队词汇表CONTEXT.md。 - 如果您在使用国产 IDE / 国内 Git 平台(如 Gitee, CNB, CodeArts, Trae):建议安装 superpowers-zh,享受一键环境适配和中文工程规范。
- 终极实践:两者可混合使用!用 Matt Pocock 的理念做领域建模与需求追问,用 superpowers-zh 的子 Agent 隔离执行与完成验证。