mattpocock/skills 使用教程

21.2 万星的工程技能包 · 把 Claude Code 从「会写代码」补成「能做工程」

⭐ MIT 开源免费

📖 项目简介

mattpocock/skills 是 TypeScript 圈知名开发者 Matt Pocock 把自己每天在用的 .agents 目录直接开源出来的一套 Agent 技能包,副标题叫「Skills For Real Engineers」—— 强调它服务的是真正的工程开发,不是随手糊一个 demo。仓库 2026 年 2 月上线,目前已有 21.2 万 Star、1.8 万 Fork,采用 MIT 协议,可免费商用。

它的技术形态非常轻:整个仓库就是一堆 Markdown 文件,每个技能是一个 SKILL.md, 没有运行时、不装依赖、不联网调接口,因此与模型无关——换 Claude、GPT、Gemini 都能用。 README 里正式收录 25 个技能,按「谁能触发」分成两类:user-invoked(只有你打命令才会跑,负责编排流程)和 model-invoked(你能调,Agent 判断合适时也会自己调,负责承载可复用的纪律)。 仓库里另有 in-progress、misc 两个目录共 10 个实验性技能,加起来 35 个 SKILL.md

作者写这套东西的出发点,是修 Claude Code、Codex 这类编程 Agent 的四个典型毛病: ①「做的不是我想要的」(需求没对齐)、②「废话太多」(项目里没有统一的行话)、 ③「代码跑不通」(缺反馈闭环)、④「写成了一团泥球」(Agent 提速的同时也在加速架构腐化)。 README 里明确说它区别于 GSD、BMAD、Spec-Kit 这类框架:那些方案接管整个流程,出问题你很难插手; 这套技能刻意做得小、可改、可组合,鼓励你 fork 成自己的。

核心亮点

🎤
动手前先反过来审你
/grill-me 会连环追问,把需求问到没有歧义才开工,是作者自称最受欢迎的技能
🗣️
给项目建一套行话
CONTEXT.md 沉淀领域术语,Agent 少说废话、命名一致、思考更省 token
🚦
红绿灯 TDD 闭环
/tdd 先写失败测试再写实现,一次只推进一个纵向切片
🩺
架构体检出 HTML 报告
/improve-codebase-architecture 扫出可深化的模块,产出可视化网页报告

🧩 它能做什么、输出什么

项目说明
输入你在 Agent 会话里打的斜杠命令(如 /grill-me)+ 你的代码仓库、issue、当前对话上下文
适用类型真实业务项目的工程流程:需求澄清、写规格、拆票、实现、调试、评审、架构治理、交接
输出规格与 ticket、CONTEXT.md 领域词表、docs/adr/ 决策记录、测试与实现代码、架构体检 HTML 报告、交接文档、bash 引导向导
语言 / 兼容技能正文为英文 Markdown(对话用中文照样能跑);与模型无关,Claude Code / Codex / 其他支持 Skill 机制的 Agent 均可
规格 / 容量README 正式收录 25 个技能(engineering 18 + productivity 7),仓库共 35 个 SKILL.md;纯文本,无运行时开销

25 个技能都在管什么

阶段代表技能解决的问题
① 动手前:对齐 /grill-me/grill-with-docs/ask-matt/to-spec/to-tickets/wayfinder/triage 把「你以为它懂了」变成写下来的规格和 ticket;超大工程用 /wayfinder 摊成决策地图逐个拍
② 动手时:闭环 /implement/tdd/diagnosing-bugs/prototype/research 红绿重构、按阶段闸口排查疑难 bug、用一次性原型回答设计问题
③ 动手后:守住 /code-review/improve-codebase-architecture/codebase-design/domain-modeling/resolving-merge-conflicts 双轴评审(编码规范 + 是否忠实实现规格)、架构体检、领域模型保鲜、逐块化解合并冲突
④ 通用效率 /handoff/teach/wait-what/to-questionnaire/writing-for-agents 会话交接、多轮教学、听不懂时让它换人话重讲、写给 Agent 看的文档

🖥️ 环境要求

环境建议配置
操作系统Windows / macOS / Linux 均可(技能本身是纯文本,不挑系统)
运行环境走插件方式:装好 Claude Code 即可;走通用方式:需要 Node.js(用 npx 拉安装器),建议 18 以上
硬件无特殊要求,不需要显卡。算力消耗全在你自己的 Agent / 模型那边
低配 / 无卡方案本身零开销。只想读不想装的话,仓库里每个 SKILL.md 都能直接在网页上看
关键依赖一个支持 Skill 机制的编程 Agent;用 /triage 要顺带准备 issue 渠道(GitHub、Linear 或本地文件)
⚠️
两种装法只能选一种。作者明确提醒:插件和 skills.sh 都装的话,每个技能会出现两份。

🚀 如何使用

💡
官方号称 30 秒装完,实际就三步:选一种装法 → 在你的项目里跑一次 /setup-matt-pocock-skills → 之后每次改动前先打 /grill-me。 先想清楚你要「订阅作者的更新」还是「拿来改成自己的」,这决定第 1 步走哪条路。
1

装法 A:Claude Code 插件(想跟着作者更新就选这个)

这套技能已经上了 Claude Code 官方插件市场,不用先加市场源,直接装即可。 它以只读包的形式接入,作者一发新版你就自动拿到——相当于「订阅」,代价是你不能直接改它。

bash claude plugins install mattpocock-skills

已经在会话里的话,也可以直接打命令装:

claude /plugin install mattpocock-skills
2

装法 B:skills.sh 安装器(Codex 等其他 Agent,或想自己改)

这条路会把技能当成普通文件写进你的仓库,你拥有它、可以随便改,没人会在背后偷偷更新你。 Claude Code 也能走这条路。安装器是交互式的,会让你勾选要哪些技能、装到哪些 Agent 上。

bash npx skills@latest add mattpocock/skills
⚠️
勾选技能时务必把 setup-matt-pocock-skills 勾上,否则第 3 步的初始化命令你会找不到。

想同步作者后来的改动时,手动拉一次即可(不会自动更新):

bash npx skills update

两种装法怎么选:

对比项装法 A:插件装法 B:安装器
技能文件只读包,不落进你的仓库普通文件,写进你的仓库
更新方式自动,作者一发就到手动 npx skills update
能否改不能能,随便改
支持的 AgentClaude CodeClaude Code、Codex 及其他
适合谁想省事、跟着作者走想按自己团队规矩改造
3

每个仓库跑一次初始化

在你的项目里打开 Agent,执行下面这条命令。每个仓库只需要跑一次,它会问你三件事:

claude / codex /setup-matt-pocock-skills
它会问什么你要准备的答案
用哪个 issue 渠道GitHub、Linear,或者就用本地文件
分诊时打什么标签你团队实际在用的 label(/triage 靠它工作)
文档放哪儿规格、CONTEXT.md、ADR 的存放位置
4

基础用法:从「审问」开始,别直接让它写

作者的建议是:每次想做改动,都先跑一次审问。非代码的事用 /grill-me; 代码相关的用 /grill-with-docs——它在审问的同时还会顺手把项目的领域词表和 ADR 一起更新掉。

claude / codex /grill-with-docs 我想给课程后台加一个批量导入学员的功能

它会反过来连环追问,直到设计树上每个分支都有答案,然后再往下走:

claude / codex # 把刚才聊清楚的东西变成规格,发到 issue 渠道 /to-spec # 再拆成一组带阻塞关系的 ticket /to-tickets # 按规格开工,过程中自动驱动 TDD,提交前自动过一遍评审 /implement

最常用的几条命令:

命令作用
/ask-matt不知道该用哪个技能时问它,它帮你选流程
/grill-me被连环追问到把方案想透(非代码场景)
/grill-with-docs同上,外加建领域词表、写 ADR
/tdd红绿重构,一个纵向切片一个切片地推
/diagnosing-bugs疑难 bug / 性能回退的分阶段排查闸口
/code-review规范 + 规格双轴评审,两个子 Agent 并行互不干扰
/handoff会话要满了,压缩成交接文档给下一个 Agent 接着干
/wait-what它说的话你没看懂,让它用你项目的行话重讲一遍
5

进阶:定期给代码库做一次架构体检

作者建议每隔几天跑一次架构体检。它会先看最近的提交历史找出热点区域, 再派子 Agent 走一遍代码,然后在系统临时目录写出一个自包含的 HTML 报告并帮你打开。

claude / codex /improve-codebase-architecture

报告里每个候选项都长这样,看完你就知道先动哪儿:

报告字段内容
Files涉及哪几个文件 / 模块,等宽字体列出来
Problem / Solution各一句话:现在哪儿别扭、改完变成什么
Before / After 图并排画出「浅模块」和「深化后」的差别
Wins收益短句,用 locality、leverage 这些术语说清
推荐强度Strong / Worth exploring / Speculative 三档徽章
Top recommendation末尾一张大卡,直接告诉你先做哪一个、为什么
⚠️
作者把它定位成体检,不是抢救:老项目上它能找出真问题,但不会替你把泥球捋顺。挑完候选项后它会拉你进一轮审问,把改造方案一起敲定。
6

结合 Codex 使用

用 Codex 的话走上面的装法 Bnpx skills@latest add mattpocock/skills, 在交互界面里把目标 Agent 勾成 Codex,技能就会写成 Codex 能读到的文件。 之后同样在项目里跑一次 /setup-matt-pocock-skills,命令用法和 Claude Code 完全一致。

原生 Codex 插件目前还在路线图上(仓库 .agents/adr/ 里的 0002 号决策记录写了这件事), 所以现阶段 Codex 用户就用安装器这条路。好处是文件在你自己仓库里,可以按团队规矩改。

装完以后,你对 Codex 的用法会从「帮我写个功能」变成「先审我 → 出规格 → 拆票 → TDD 实现 → 自动评审」,中间每一步都留下可回查的文档。

🎯 典型应用场景

🎤
需求老是做偏
开工前先被 /grill-me 追问一轮,把「我以为你懂了」变成写下来的规格
🗂️
大工程一个会话装不下
/wayfinder 把它摊成一张决策 ticket 地图,一个一个拍板
🐛
疑难 bug 反复改不好
/diagnosing-bugs 按闸口走:先复现成红灯,再最小化、验证假设、补回归测试
🩺
项目越写越乱
定期跑架构体检,拿到带前后对比图的 HTML 报告,按推荐强度排期
🔀
合并冲突不敢下手
/resolving-merge-conflicts 逐块按两边意图化解,绝不 --abort 了事
🤝
会话快满了要换人接
/handoff 压成交接文档,下一个 Agent 直接接着干,不用重讲一遍背景

📈 与同类方案对比

这类技能包没有跑分可比,能对比的是「设计取向」。下面几项都出自仓库 README 的自述定位:

维度mattpocock/skillsGSD / BMAD / Spec-Kit 这类框架
对流程的态度只提供小而可组合的技能,流程仍由你掌握接管整个流程
出问题时技能是纯 Markdown,哪句不对改哪句流程内部出 bug 较难定位和干预
模型绑定与模型无关,换任何模型都能跑常与特定流程 / 工具链耦合
改造成本鼓励 fork 成自己的(装法 B 直接落进你仓库)按框架约定走,自定义空间有限
仓库热度21.2 万 Star、1.8 万 Fork,2026 年 2 月上线,仍在持续更新
🧠
它之所以有效,不是因为提示词写得花,而是把软件工程里已被验证的纪律写成了 Agent 能读的文档: 对齐靠审问、质量靠红绿灯反馈闭环、复杂度靠「深模块」的设计标准。 技能正文大量引用《程序员修炼之道》《领域驱动设计》《软件设计的哲学》等经典结论,所以它能跨模型、跨项目复用。

常见问题

Q: 它和普通的提示词合集有什么区别?

提示词合集给你一段话,用完就散了。它给的是带阶段闸口的流程:审问没结束不许动手、测试没变红不许写实现、评审没过不许提交,而且过程中会往仓库里落规格、词表、ADR 这些可回查的文档。

Q: 只有 Claude Code 能用吗?Codex 行不行?

都行。Claude Code 可以走官方插件市场一条命令装;Codex 和其他 Agent 走 npx skills@latest add mattpocock/skills 安装器。技能本身是纯 Markdown,不绑定任何一家产品。原生 Codex 插件还在路线图上。

Q: 两种装法能不能都装?

不要。作者明确提醒装两遍会让每个技能出现两份。想跟着作者自动更新就选插件,想自己改就选安装器。

Q: 装完打命令没反应 / 找不到命令怎么办?

先确认三件事:① 走安装器时有没有把 setup-matt-pocock-skills 勾上,漏勾就没有初始化命令;② 有没有在当前这个仓库里跑过一次 /setup-matt-pocock-skills,它是按仓库生效的;③ 是不是把 user-invoked 技能当成 Agent 会自动调的——那类必须你亲手打命令才会跑。

Q: 需要什么硬件?会不会很吃配置?

技能本身零开销,纯文本,不需要显卡。真正的消耗在你自己的 Agent 和模型上。要注意的是审问、双轴评审这些流程会来回多轮对话,token 用量比直接让它写代码高,换来的是少走弯路。

Q: 25 个技能太多了,先用哪几个?

/grill-with-docs 开始,它是作者自称最受欢迎的一类,投入产出最高。接着加 /tdd 管质量、/improve-codebase-architecture 每隔几天体检一次。拿不定主意时直接打 /ask-matt,它会帮你挑。

Q: CONTEXT.md 到底有什么用,值得建吗?

它是项目的行话词表。README 举了作者自己的例子:同一件事,之前要说「课程某个章节里的课时被变成真实的、在文件系统里占了位置时会出问题」,有了词表之后一句「物化级联出问题了」就说完了。好处不只是少说废话——命名会变一致、代码更好导航、Agent 思考也更省 token。

Q: 架构体检会直接改我的代码吗?

不会。它只做调查,产出一份 HTML 报告放在系统临时目录(不会脏你的仓库),列出候选项和推荐强度,然后问你想深入看哪一个。作者强调它是体检不是抢救,老项目上能找出真问题,但不会替你把架构捋顺。

Q: 可以商用吗?

可以。仓库采用 MIT 协议,免费商用,改完自己用也没问题。