众力资讯网

把 AI 编码从一次 Prompt 碰运气变成可重复、可审查、可分解的流程

1. 核心认知:真正的瓶颈是上下文窗口大多数人的 AI 编码体验是:前 10 分钟很爽20 分钟后开始胡说八道30 分钟
1. 核心认知:真正的瓶颈是上下文窗口

大多数人的 AI 编码体验是:

前 10 分钟很爽20 分钟后开始胡说八道30 分钟不得不重启对话

这不是模型变蠢了,而是你超出了上下文窗口的「聪明区」。

Matt 的经验结论:

上下文窗口的「聪明区」大约在 140K token 左右超过这个阈值,模型注意力显著下降,幻觉明显增加

解决方案不是换更强的模型,而是把一个大任务拆成多个独立的上下文窗口,每个窗口只做一件事。

这套 Skills 的核心价值就在于:用标准化的流程 + 独立审查代理,强制你把任务拆成「一个窗口能吃完」的大小。

2. 前提条件已安装 Node.js(需要 npx)使用支持 Skills / Slash Command 的 Agent(Claude Code、Cursor、Codex 等均可)项目最好已经有 Git 仓库3. 安装(30 秒完成)

在终端执行:

npx skills@latest add mattpocock/skills

安装过程会列出所有技能(官方 + 实验性),用空格选中你需要的,回车确认。

强烈建议至少勾选:

setup-matt-pocock-skillsgrill-with-docsto-specto-ticketsimplementcode-review

设计亮点:所有技能描述加起来大约只有 660 token,几乎不占用启动上下文。

安装完成后,技能会复制到你的项目中(可本地修改)。

4. 项目初始化(每个仓库只做一次)

在 Agent 中运行:

/setup-matt-pocock-skills

它会依次询问:

问题跟踪系统 GitHub Issues Linear 本地 Markdown 文件(最简单,推荐先用这个)分诊标签(Triage Labels) 默认即可,后面 /triage 会用到。领域文档位置 通常会创建 CONTEXT.md 和 ADR 目录。上下文模式 99% 的项目选「单一上下文」即可。 大型单体仓库才考虑多上下文。

完成后,仓库根目录会出现 CONTEXT.md,里面记录了:

问题跟踪器地址分诊标签领域文档路径

这一步非常重要,后续所有技能都会读取这个配置。

5. 主工作流(四个步骤,一个循环)

默认推荐流程:

Grill with Docs →(可选)写 Spec & 拆 Tickets → Implement → 独立 Code Review

如果任务很小,可以直接:

Grill with Docs → Implement

跳过 Spec 和 Tickets。

步骤 1:Grill with Docs(需求访谈)

命令:

/grill-with-docs

输入一个模糊需求,例如:

我想重构一下登录流程,让它支持多租户

技能会:

探索整个代码库通过一系列问题(通常 15~25 个)帮你澄清需求把学到的内容写入 CONTEXT.md 和 ADR最终输出一份清晰、可辩护的计划

访谈是有状态的,它会持续积累项目领域知识。

目标:把「我想改 X」变成「删除 10 个命令文件、删除 3 个测试、重新连接共享模块」这种级别的具体计划。

步骤 2:编写规范与工单(大任务必做)

当任务明显超过一个上下文窗口时使用。

2.1 生成 Spec

/to-spec

(或 /write-spec,根据版本)

它会把刚才的访谈内容压缩成一份正式规范文档,包含:

问题陈述解决方案用户故事实施决策测试决策

并输出到你配置的问题跟踪系统(本地 Markdown 或 GitHub)。

2.2 拆解成 Tickets

/to-tickets

把 Spec 拆成多个小工单。 每个工单的大小应控制在一个上下文窗口能完成的程度。

示例:一个 Spec 可能拆成 8~15 个工单,每个工单只写「本次会话要构建什么」,并引用主 Spec 的验收标准。

步骤 3:Implement(实施)

在对应的工单上下文中运行:

/implement

技能会自动:

执行类型检查构建运行测试只显示实际编辑的提交完成后自动触发代码审查步骤 4:Code Review(必须用独立代理)

这是整套流程里最关键的设计之一。

主代理不擅长审查自己刚写的代码。

因此 /implement 结束后会自动启动一个独立的子代理进行审查,审查维度有两个:

Spec 合规性:完成的工作是否遗漏了规范中的要求编码标准:对照仓库中的编码规范(如果没有,则使用 Martin Fowler 等经典标准)

审查通过后,会自动提交到当前分支。

6. 其他高频实用技能

技能

用途

/ask-matt

路由器,不知道用哪个技能时先问它

/triage

用标签把工单在状态机中流转

/tdd

强制红-绿-重构循环

/diagnosing-bugs

系统化调试流程

/improve-codebase-architecture

扫描代码库并生成架构改进报告

/grill-me

更通用的决策访谈(不依赖文档)

/handoff

生成紧凑的交接文档,方便换会话继续

7. 使用建议与风险边界

推荐实践:

小任务:Grill → Implement中等任务:Grill → Spec → Tickets → 逐个 Implement大任务:先用 /wayfinder 规划调查工单始终保持 CONTEXT.md 更新尽量用项目级安装(而非全局),避免版本冲突

已知限制:

依赖 Node.js + npx多上下文模式仍在探索中如果仓库没有明确编码标准,审查会使用通用标准,可能导致风格不完全一致目前部分能力依赖 Vercel CLI,未来可能替换8. 一句话总结

这套 Skills 真正解决的是:当你开始认真用 AI 写生产代码时,最大的问题不是「模型不够聪明」,而是「你没有管理好上下文窗口」。

它把「写 Prompt」升级成了「管理上下文 + 独立审查 + 可分解任务」的工程流程。

仓库地址: https://github.com/mattpocock/skills

建议直接安装后,在一个真实小项目上完整跑一遍「Grill → Spec → Tickets → Implement」流程,体会会非常深。