21.2 万星的工程技能包 · 把 Claude Code 从「会写代码」补成「能做工程」
⭐ MIT 开源免费
mattpocock/skills 是 TypeScript 圈知名开发者 Matt Pocock 把自己每天在用的
.agents 目录直接开源出来的一套 Agent 技能包,副标题叫「Skills For Real Engineers」——
强调它服务的是真正的工程开发,不是随手糊一个 demo。仓库 2026 年 2 月上线,目前已有
21.2 万 Star、1.8 万 Fork,采用 MIT 协议,可免费商用。
它的技术形态非常轻:整个仓库就是一堆 Markdown 文件,每个技能是一个 SKILL.md,
没有运行时、不装依赖、不联网调接口,因此与模型无关——换 Claude、GPT、Gemini 都能用。
README 里正式收录 25 个技能,按「谁能触发」分成两类:user-invoked(只有你打命令才会跑,负责编排流程)和
model-invoked(你能调,Agent 判断合适时也会自己调,负责承载可复用的纪律)。
仓库里另有 in-progress、misc 两个目录共 10 个实验性技能,加起来 35 个 SKILL.md。
作者写这套东西的出发点,是修 Claude Code、Codex 这类编程 Agent 的四个典型毛病: ①「做的不是我想要的」(需求没对齐)、②「废话太多」(项目里没有统一的行话)、 ③「代码跑不通」(缺反馈闭环)、④「写成了一团泥球」(Agent 提速的同时也在加速架构腐化)。 README 里明确说它区别于 GSD、BMAD、Spec-Kit 这类框架:那些方案接管整个流程,出问题你很难插手; 这套技能刻意做得小、可改、可组合,鼓励你 fork 成自己的。
/grill-me 会连环追问,把需求问到没有歧义才开工,是作者自称最受欢迎的技能CONTEXT.md 沉淀领域术语,Agent 少说废话、命名一致、思考更省 token/tdd 先写失败测试再写实现,一次只推进一个纵向切片/improve-codebase-architecture 扫出可深化的模块,产出可视化网页报告| 项目 | 说明 |
|---|---|
| 输入 | 你在 Agent 会话里打的斜杠命令(如 /grill-me)+ 你的代码仓库、issue、当前对话上下文 |
| 适用类型 | 真实业务项目的工程流程:需求澄清、写规格、拆票、实现、调试、评审、架构治理、交接 |
| 输出 | 规格与 ticket、CONTEXT.md 领域词表、docs/adr/ 决策记录、测试与实现代码、架构体检 HTML 报告、交接文档、bash 引导向导 |
| 语言 / 兼容 | 技能正文为英文 Markdown(对话用中文照样能跑);与模型无关,Claude Code / Codex / 其他支持 Skill 机制的 Agent 均可 |
| 规格 / 容量 | README 正式收录 25 个技能(engineering 18 + productivity 7),仓库共 35 个 SKILL.md;纯文本,无运行时开销 |
| 阶段 | 代表技能 | 解决的问题 |
|---|---|---|
| ① 动手前:对齐 | /grill-me、/grill-with-docs、/ask-matt、/to-spec、/to-tickets、/wayfinder、/triage |
把「你以为它懂了」变成写下来的规格和 ticket;超大工程用 /wayfinder 摊成决策地图逐个拍 |
| ② 动手时:闭环 | /implement、/tdd、/diagnosing-bugs、/prototype、/research |
红绿重构、按阶段闸口排查疑难 bug、用一次性原型回答设计问题 |
| ③ 动手后:守住 | /code-review、/improve-codebase-architecture、/codebase-design、/domain-modeling、/resolving-merge-conflicts |
双轴评审(编码规范 + 是否忠实实现规格)、架构体检、领域模型保鲜、逐块化解合并冲突 |
| ④ 通用效率 | /handoff、/teach、/wait-what、/to-questionnaire、/writing-for-agents |
会话交接、多轮教学、听不懂时让它换人话重讲、写给 Agent 看的文档 |
| 环境 | 建议配置 |
|---|---|
| 操作系统 | Windows / macOS / Linux 均可(技能本身是纯文本,不挑系统) |
| 运行环境 | 走插件方式:装好 Claude Code 即可;走通用方式:需要 Node.js(用 npx 拉安装器),建议 18 以上 |
| 硬件 | 无特殊要求,不需要显卡。算力消耗全在你自己的 Agent / 模型那边 |
| 低配 / 无卡方案 | 本身零开销。只想读不想装的话,仓库里每个 SKILL.md 都能直接在网页上看 |
| 关键依赖 | 一个支持 Skill 机制的编程 Agent;用 /triage 要顺带准备 issue 渠道(GitHub、Linear 或本地文件) |
/setup-matt-pocock-skills → 之后每次改动前先打 /grill-me。
先想清楚你要「订阅作者的更新」还是「拿来改成自己的」,这决定第 1 步走哪条路。
这套技能已经上了 Claude Code 官方插件市场,不用先加市场源,直接装即可。 它以只读包的形式接入,作者一发新版你就自动拿到——相当于「订阅」,代价是你不能直接改它。
claude plugins install mattpocock-skills
已经在会话里的话,也可以直接打命令装:
/plugin install mattpocock-skills
这条路会把技能当成普通文件写进你的仓库,你拥有它、可以随便改,没人会在背后偷偷更新你。 Claude Code 也能走这条路。安装器是交互式的,会让你勾选要哪些技能、装到哪些 Agent 上。
npx skills@latest add mattpocock/skills
setup-matt-pocock-skills 勾上,否则第 3 步的初始化命令你会找不到。想同步作者后来的改动时,手动拉一次即可(不会自动更新):
npx skills update
两种装法怎么选:
| 对比项 | 装法 A:插件 | 装法 B:安装器 |
|---|---|---|
| 技能文件 | 只读包,不落进你的仓库 | 普通文件,写进你的仓库 |
| 更新方式 | 自动,作者一发就到 | 手动 npx skills update |
| 能否改 | 不能 | 能,随便改 |
| 支持的 Agent | Claude Code | Claude Code、Codex 及其他 |
| 适合谁 | 想省事、跟着作者走 | 想按自己团队规矩改造 |
在你的项目里打开 Agent,执行下面这条命令。每个仓库只需要跑一次,它会问你三件事:
/setup-matt-pocock-skills
| 它会问什么 | 你要准备的答案 |
|---|---|
| 用哪个 issue 渠道 | GitHub、Linear,或者就用本地文件 |
| 分诊时打什么标签 | 你团队实际在用的 label(/triage 靠它工作) |
| 文档放哪儿 | 规格、CONTEXT.md、ADR 的存放位置 |
作者的建议是:每次想做改动,都先跑一次审问。非代码的事用 /grill-me;
代码相关的用 /grill-with-docs——它在审问的同时还会顺手把项目的领域词表和 ADR 一起更新掉。
/grill-with-docs 我想给课程后台加一个批量导入学员的功能
它会反过来连环追问,直到设计树上每个分支都有答案,然后再往下走:
# 把刚才聊清楚的东西变成规格,发到 issue 渠道
/to-spec
# 再拆成一组带阻塞关系的 ticket
/to-tickets
# 按规格开工,过程中自动驱动 TDD,提交前自动过一遍评审
/implement
最常用的几条命令:
| 命令 | 作用 |
|---|---|
/ask-matt | 不知道该用哪个技能时问它,它帮你选流程 |
/grill-me | 被连环追问到把方案想透(非代码场景) |
/grill-with-docs | 同上,外加建领域词表、写 ADR |
/tdd | 红绿重构,一个纵向切片一个切片地推 |
/diagnosing-bugs | 疑难 bug / 性能回退的分阶段排查闸口 |
/code-review | 规范 + 规格双轴评审,两个子 Agent 并行互不干扰 |
/handoff | 会话要满了,压缩成交接文档给下一个 Agent 接着干 |
/wait-what | 它说的话你没看懂,让它用你项目的行话重讲一遍 |
作者建议每隔几天跑一次架构体检。它会先看最近的提交历史找出热点区域, 再派子 Agent 走一遍代码,然后在系统临时目录写出一个自包含的 HTML 报告并帮你打开。
/improve-codebase-architecture
报告里每个候选项都长这样,看完你就知道先动哪儿:
| 报告字段 | 内容 |
|---|---|
| Files | 涉及哪几个文件 / 模块,等宽字体列出来 |
| Problem / Solution | 各一句话:现在哪儿别扭、改完变成什么 |
| Before / After 图 | 并排画出「浅模块」和「深化后」的差别 |
| Wins | 收益短句,用 locality、leverage 这些术语说清 |
| 推荐强度 | Strong / Worth exploring / Speculative 三档徽章 |
| Top recommendation | 末尾一张大卡,直接告诉你先做哪一个、为什么 |
用 Codex 的话走上面的装法 B:npx skills@latest add mattpocock/skills,
在交互界面里把目标 Agent 勾成 Codex,技能就会写成 Codex 能读到的文件。
之后同样在项目里跑一次 /setup-matt-pocock-skills,命令用法和 Claude Code 完全一致。
原生 Codex 插件目前还在路线图上(仓库 .agents/adr/ 里的 0002 号决策记录写了这件事),
所以现阶段 Codex 用户就用安装器这条路。好处是文件在你自己仓库里,可以按团队规矩改。
/grill-me 追问一轮,把「我以为你懂了」变成写下来的规格/wayfinder 把它摊成一张决策 ticket 地图,一个一个拍板/diagnosing-bugs 按闸口走:先复现成红灯,再最小化、验证假设、补回归测试/resolving-merge-conflicts 逐块按两边意图化解,绝不 --abort 了事/handoff 压成交接文档,下一个 Agent 直接接着干,不用重讲一遍背景这类技能包没有跑分可比,能对比的是「设计取向」。下面几项都出自仓库 README 的自述定位:
| 维度 | mattpocock/skills | GSD / BMAD / Spec-Kit 这类框架 |
|---|---|---|
| 对流程的态度 | 只提供小而可组合的技能,流程仍由你掌握 | 接管整个流程 |
| 出问题时 | 技能是纯 Markdown,哪句不对改哪句 | 流程内部出 bug 较难定位和干预 |
| 模型绑定 | 与模型无关,换任何模型都能跑 | 常与特定流程 / 工具链耦合 |
| 改造成本 | 鼓励 fork 成自己的(装法 B 直接落进你仓库) | 按框架约定走,自定义空间有限 |
| 仓库热度 | 21.2 万 Star、1.8 万 Fork,2026 年 2 月上线,仍在持续更新 | — |
提示词合集给你一段话,用完就散了。它给的是带阶段闸口的流程:审问没结束不许动手、测试没变红不许写实现、评审没过不许提交,而且过程中会往仓库里落规格、词表、ADR 这些可回查的文档。
都行。Claude Code 可以走官方插件市场一条命令装;Codex 和其他 Agent 走 npx skills@latest add mattpocock/skills 安装器。技能本身是纯 Markdown,不绑定任何一家产品。原生 Codex 插件还在路线图上。
不要。作者明确提醒装两遍会让每个技能出现两份。想跟着作者自动更新就选插件,想自己改就选安装器。
先确认三件事:① 走安装器时有没有把 setup-matt-pocock-skills 勾上,漏勾就没有初始化命令;② 有没有在当前这个仓库里跑过一次 /setup-matt-pocock-skills,它是按仓库生效的;③ 是不是把 user-invoked 技能当成 Agent 会自动调的——那类必须你亲手打命令才会跑。
技能本身零开销,纯文本,不需要显卡。真正的消耗在你自己的 Agent 和模型上。要注意的是审问、双轴评审这些流程会来回多轮对话,token 用量比直接让它写代码高,换来的是少走弯路。
从 /grill-with-docs 开始,它是作者自称最受欢迎的一类,投入产出最高。接着加 /tdd 管质量、/improve-codebase-architecture 每隔几天体检一次。拿不定主意时直接打 /ask-matt,它会帮你挑。
CONTEXT.md 到底有什么用,值得建吗?它是项目的行话词表。README 举了作者自己的例子:同一件事,之前要说「课程某个章节里的课时被变成真实的、在文件系统里占了位置时会出问题」,有了词表之后一句「物化级联出问题了」就说完了。好处不只是少说废话——命名会变一致、代码更好导航、Agent 思考也更省 token。
不会。它只做调查,产出一份 HTML 报告放在系统临时目录(不会脏你的仓库),列出候选项和推荐强度,然后问你想深入看哪一个。作者强调它是体检不是抢救,老项目上能找出真问题,但不会替你把架构捋顺。
可以。仓库采用 MIT 协议,免费商用,改完自己用也没问题。