mattpocock/skills 深度评测:254k Star 的「反 GSD」技能库,37 个小工具拒绝流程绑架

mattpocock/skills 深度评测:254k Star 的「反 GSD」技能库,37 个小工具拒绝流程绑架

给 AI 装了一堆「流程大师」技能包后,你有没有一种失控感:Spec-Kit 让你写规格、GSD 让你跑仪式、BMAD 让你建矩阵——活还没干,先被流程绑架了?

TypeScript 圈顶流 Matt Pocock 看不下去,9 月初把自己天天在用的 .agents 目录直接开源:mattpocock/skills 两天内刷到 24 万 Star,如今 254k★、全球 GitHub 排名第 15。它不教 Agent 走流程,而是塞给你 37 把「小工具」——你挑着用,改着用,用完还能扔。

这套被中文圈称为「反 GSD」的技能库,凭什么成为 2026 年 9 月最炸的开源项目?我把它 clone 下来逐个拆了一遍。

它是什么:一个拒绝「拥有你」的技能军械库

一句话定位:给 Claude Code / Codex 等编码 Agent 用的 37 个工程技能,全部来自 Matt Pocock 日常真实工作流——「real engineering, not vibe coding」。

作者是谁?Matt Pocock 是 TypeScript 教育头牌 Total TypeScript 的创始人,newsletter 订阅 6 万人,在编码圈属于「老师傅」级别。他把 Agent 时代自己踩过的坑,沉淀成一套可组合的斜杠命令。

核心理念在 README 第一段就开炮:

GSD、BMAD、Spec-Kit 这些方案试图「拥有」流程(owning the process),但代价是夺走你的控制权,让流程里的 bug 难以修复。我的 skills 设计成**小而精、易改写、可组合**,适配任何模型。

37 个技能分四桶,按「谁可以触发」双轨制管理:

桶 数量 定位 代表技能
engineering 18 代码日常 /grill-with-docs /tdd /code-review /diagnosing-bugs
productivity 8 通用工作流 /grill-me /teach /to-questionnaire
misc 4 环境工具 git-guardrails scaffold-exercises
in-progress 7 实验区 retro loop-me 写作类×3(未进正式版)

用户触发(/grill-me)负责编排,模型触发(grilling)负责纪律——前者只有你主动敲才运行,后者 Agent 觉得合适可自动调用,互不越权。

最出圈的三个技能,拆开看

1. `/grill-me` — 动手前先被「拷问」

这是 Matt 最受欢迎的技能。核心逻辑反直觉:写代码前,先让 AI 连环追问你,把需求里每个分支问到死。

「没人确切知道自己想要什么」(《程序员修炼之道》),AI 时代的最大失败模式是「你以为说清了,Agent 根本没懂」。grill-me 就是把这段对齐期强制拉长:答不上来的问题不许瞎编,必须停下来问人。第三方实测最常引用的效果是——它把「我以为我说了」变成「我真的说清了」。

注意:Matt 自己提醒,grill-me 别直接拿去 coding,代码场景用升级版 `/grill-with-docs`(拷问同时帮你建 CONTEXT.md 领域词典 + ADR,详见下文)。

2. `/tdd` — 收缩成「参考型」的纪律

v1.2.0 大更新里,tdd 被刻意收缩为参考型 skill:核心只留 Red → Green 循环 + 测试 seam(接缝),重构职责被移去 code-review——「实现阶段别同时背太多目标」。

最狠的规则叫「只在预先商定的 seam 上测试」:写测试前先列出要测的公共接口边界,跟用户确认。不许测私有方法、不许 mock 内部协作者、不许水平切分(先写完所有测试再写实现=在验证想象中的行为)。

3. `/wizard` — 让 AI 生成「引导人类」的脚本

很妙的一个:当有步骤只有人类能做(配 CI secrets、登第三方后台、跑一次性迁移),wizard 会生成一个交互式 bash 向导——每步打开对应 URL、精确说要点哪里复制什么、隐藏输入密钥、幂等写 .env、显示还剩几步。把「教 AI 做事」反转成「AI 教你点按钮」。

实测验证:文档工程做到什么程度

我把仓库 clone 下来跑了硬核检查:

  • 37/37 个 skill 全部带双 harness 元数据:每个 SKILL.md 旁都有 agents/openai.yaml(Codex 专用 UI 元数据),Claude Code 用 frontmatter、Codex 用 yaml,一套源码两处跑,无生成副本——v1.2.0 起刻意这么设计
  • 结构极干净:37 SKILL.md 共 2465 行正文 + 37 个 yaml + 零冗余。单个 skill 最短 7 行(grill-me 本体是薄壳,逻辑在 grilling 里),最长 140 行(teach)——没有一个是「大礼包式」的巨型 prompt
  • 严谨到变态的治理:.out-of-scope/ 目录公开拒绝了三类需求并写清理由——「不给 grilling 加提问数量上限」(#44 有人抱怨 Codex 问了 200 个问题,Matt 说:那是计划真没定清楚)、「不接小众 issue tracker」(#99 要求接 dex,3 个月 300 star 的工具不接)、「不加 verify 模式」。拒绝清单本身就是设计哲学
  • CONTEXT.md 领域词典:把「issue tracker / issue / decision ticket」等术语精确定义并标注已消歧义的历史(backlog 曾同时指工具和积压工作,现已废除)

版本节奏:v1.2.3(8/6)→ 9/4 还在提交(#1025 合并),changesets 规范化发版。contributors 4 人,mattpocock 本人 422 次提交占绝对主导——这是一个活人在维护的真实工作流,不是营销仓。

同类对比:GSD/BMAD/Spec-Kit 与它的路线之争

方案 路线 规模 哲学
GSD(73k★) 上下文工程系统 大而全 流程拥有你,按仪式走
BMAD 全流程矩阵 大而全 每步都要产出物
Spec-Kit spec 驱动 中 先规格后实现
mattpocock/skills(254k★) 个人工作流开源 37 个小工具 你拥有流程,随手改写

站内 8/30 评测过 GSD——那套「上下文工程系统」确实能把事做完,但 Matt 指出的代价真实存在:流程越重,出错越难排查,Agent 越像在表演流程而不是写代码。

他的替代路线是「薄壳 + 引用」:编排型技能(grill-me)只有 7 行,真正纪律放在模型可自动调用的 grilling/tdd 里,实现与重构职责分离。适合谁:有工程判断力、不想被框架绑架、愿意花 10 分钟改 skill 的中高级开发者。不适合谁:想要「一键全自动」的新手——这套东西要求你理解每个技能在干嘛,且 setup 时得选 issue tracker(GitHub/Linear/本地文件)。

安装两条路(二选一,别都装否则技能翻倍):Claude Code 官方 marketplace 直接 /plugin install mattpocock-skills(只读托管、自动更新);想自己改就 npx skills@latest add mattpocock/skills(文件落入仓库,随你 hack)。装完跑一次 /setup-matt-pocock-skills 选 tracker 和标签即用。

我的判断

值得一试,且建议只挑 3-5 个装(什么值得买 15 小时前的热帖也是这结论)。254k★ 的含金量不在「多」,而在 Matt 把 20 年工程直觉压缩进了可组合的小单元——这是目前中文圈最缺的「反过程派」样本。先试 /grill-me 感受拷问式对齐,再加 /tdd 和 /code-review 形成闭环,你会回来删掉那些大而全的流程包。

想先看同路线的对照组?本站拆过 GSD 的上下文工程系统(73k★ 真能把事做完),也实测过 darwin.skill 这种「教 Agent 自我进化」的思路。关注 AI商业快讯,每天一篇 AI 热点深度解读。

277k Star的AI编程方法论Superpowers深度评测:不是让AI更聪明,而是让AI更有纪律

277k Star的AI编程方法论Superpowers深度评测:不是让AI更聪明,而是让AI更有纪律

2025 年 10 月,Perl 社区传奇人物 Jesse Vincent 发布了 Superpowers——一套为 AI 编程代理设计的完整软件开发方法论框架。不到一年,这个项目在 GitHub 上拿下了 277,000+ Star,成为 AI 编程工具生态中增速最快的项目之一。据 GitHub 数据显示,该项目已有 24,800+ Fork、681 次提交、100+ 贡献者,支持 Claude Code、Codex、Cursor、Devin、Gemini CLI 等 12+ 个主流编程平台。

Superpowers 的核心理念只有一句话:让 AI 先停下来想清楚,再动手。它不是新模型,不是 MCP 服务器,而是由 15+ 个可组合 Skills 组成的工程化开发方法论,自动注入到每次 AI 编程会话中,强制执行”需求澄清→计划→TDD→Code Review”的完整流程。据 Datawhale Easy-Vibe 教程评价,Superpowers 把 Claude Code 从”聪明的实习生”升级为”有纪律的开发团队”。

为什么 AI 编程需要”方法论”?

用过 Claude Code 的人都遇到过这个痛点:你说”帮我做个登录功能”,AI 立刻开始写代码,不问你用什么认证方式、要不要记住密码、密码重置走邮件还是短信。结果写出来的东西一半不是你要的,返工成本比从头来还高。

据 Hacker News 社区讨论,资深工程师 d–b 评论道:”我个人不太喜欢 Superpowers。我的老板喜欢。我觉得用 Superpowers 时 Claude 犯的错反而更多。但也许是我的问题。”另一位用户 tao_oat 则表示:”brainstorming skill 确实很棒,它帮助把模糊的早期想法具体化。我特别喜欢它用子代理对抗性审查自己的 spec/plan,这确实捕获了几个我本会遗漏的问题。”

这种分歧恰好说明了 Superpowers 的定位:它不是让 AI 更聪明,而是让 AI 更有纪律。对于已经有成熟工程管理经验的资深开发者,Superpowers 的流程可能显得多余;但对于需要长期维护的生产级项目、团队协作场景、或者缺少流程纪律的开发者,它几乎是必装的。

15+ Skills 如何工作?

Superpowers 包含 15+ 个可组合的 Skills,覆盖软件开发生命周期的每个阶段。其核心工作流分为 7 步:

步骤 Skill 功能
1 brainstorming 苏格拉底式需求澄清,通过提问厘清模糊需求
2 using-git-worktrees 创建隔离工作区,验证测试基线
3 writing-plans 将大任务拆成 2-5 分钟的小任务,含文件路径和验证步骤
4 subagent-driven-development 每任务派独立子代理,两阶段审查(spec 合规→代码质量)
5 test-driven-development 强制 RED-GREEN-REFACTOR TDD 循环
6 requesting-code-review 按严重级别报告问题,Critical 问题阻断进度
7 finishing-a-development-branch 验证测试、选择 merge/PR/保留/丢弃

据 Reddit r/ClaudeCode 社区 2026 年 2 月的反馈:”用了 Superpowers 之后,每个阶段都得到了应有的关注。没有跳过步骤,没有跳过验证。输出结果终于和我规划的一致了。”而 2026 年 6 月的另一条反馈则指出:”它让我慢了很多,消耗了更多 token,比普通计划更快达到限额。”

安装与使用建议

Superpowers 的安装极其简单,一条命令即可完成:

# Claude Code 官方市场

/plugin install superpowers@claude-plugins-official

# 或 Superpowers 自有市场

/plugin marketplace add obra/superpowers-marketplace

/plugin install superpowers@superpowers-marketplace

其他平台也有对应的安装方式:Codex 用 /plugins 搜索安装,Cursor 用 /add-plugin superpowers,Gemini CLI 用 gemini extensions install,Devin 用 devin plugins install。完整安装指南见 GitHub 仓库。

最佳使用场景:

  • 生产级项目开发:需要长期维护的代码,流程纪律能减少技术债
  • 团队协作:brainstorming → plan → review 的文档链路天然适合交接
  • 非资深工程师:缺少流程纪律的人,Superpowers 相当于”强制 best practices”

不建议使用的场景:

  • 快速原型/一次性脚本:流程开销大于收益
  • Token 预算敏感:全流程 token 消耗是裸 Claude Code 的 3-5 倍
  • 资深工程师的个人项目:你可能已经自然地做了 Superpowers 强制的事

写在最后

Superpowers 是目前 AI 编程领域最成熟的工程化方法论框架,277k Star 实至名归。它的价值不在于让 AI 更聪明,而在于让 AI 更有纪律。如果你在写需要长期维护的生产级代码,它几乎是必装的;如果你只是快速原型或简单脚本,它的流程开销反而会拖慢你。

值得关注的是,Superpowers 与 ECC(242k Star,Agent Harness 操作系统)、Caveman(100k Star,Token 压缩 65%)三者互补而非互斥:Superpowers 提供方法论,ECC 提供功能平台,Caveman 提供效率优化。对于预算敏感的开发者,”Superpowers + Caveman”的组合可能是性价比最高的选择。

关注 AI商业快讯,每天一篇 AI 热点深度解读。

相关阅读: