十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

每日热门skill-别让 AI 再给你堆屎山了,255K Star 的 mattpocock/skills 把工程师纪律焊进了 Agent

每日热门skill-别让 AI 再给你堆屎山了,255K Star 的 mattpocock/skills 把工程师纪律焊进了 Agent 基金定投助手为什么你的基金定投总在追涨杀跌价值平均法定投引擎 综合估值模型动态再平衡仓位管理一个单文件 HTML 的免费定投工具-CSDN博客https://download.csdn.net/download/weitingfu/93339607?spm1011.2124.3001.6210一个 TypeScript 教育者把他每天真实使用的工程流程全部固化成了一套开源技能包。上线半年255K Star本周 GitHub Trending 第一。不是给 AI 加能力是给 AI 加纪律。写在前面先说一个扎心的场景。三个月前你兴冲冲给 AI 派了个活。它三分钟生成了一个 500 行的模块跑起来没报错你心里还美滋滋AI 生产力真香。三个月后你再回这个仓库。500 行变成 5000 行一个文件里塞了五个职责函数从 20 行膨胀到 200 行。你想加个按钮改了 A 炸了 B补了 B 崩了 C。你盯着屏幕上飘红的测试突然明白了什么叫「一周堆出屎山」——而 AI 堆屎山的速度是手写代码的十倍。这不是段子。TypeScript 圈最出名的教育者 Matt Pocock就是那个做了 Total TypeScript 课程平台的人自己天天重度用 Claude Code被这个问题逼到亲自动手解决。他的诊断很直接AI 不是蠢是缺少工程纪律。于是他把纪律写成了代码。开源项目 mattpocock/skills仓库自述一句话「agent skills that I use every day to do real engineering, not vibe coding」。上线不到半年255K Star21.2K Fork7.5M 下载本周 GitHub Trending 榜首。我愿称它为 2026 年 AI 工程生态里最值得抄的作业之一。一、先认识一下作者和他眼里的四个坑Matt Pocock前 Vercel、Stately 工程师Total TypeScript 创始人Newsletter 订阅者六万。TypeScript 圈没人不认识他。他干这事有个天然优势教了这么多年 TypeScript他最懂「人是怎么把工程做烂的」。他把 AI 写代码翻车的原因收敛成四个失败模式。第一需求没对齐。你以为 AI 懂了它理解偏了。你说加个登录它连用户是 Customer 还是 Admin 都没问就开写。返工率极高。第二没有共享语言。Agent 空降进项目不懂你的业务黑话只能每次用一大段大白话绕来解释。啰嗦烧 tokencontext window 直接撑爆。第三没有反馈循环。写完代码不看测试不看类型不跑浏览器。手写代码的人再菜也知道写完跑一遍AI 不知道你让它写它就写。代码上线等于炸弹上线。第四架构失控。Agent 加速一切包括熵增。人写一个模块要半天停下来想想架构来得及AI 三分钟一个模块你还没来得及想这个模块职责对不对代码已经躺进仓库了。AI 堆屎山比人快十倍这是物理定律。这四个坑每一个都对应一套技能。这就是这个仓库的骨架。二、技能拆解给 AI 焊上纪律的四种姿势先装个概念。这仓库里每个 skill 就是一个 Markdown 文件一段写在 SKILL.md 里的精确指令告诉 Agent 在什么场景下必须怎么干。不绑模型Claude Code、Codex、Cursor 通用本质是纯文本的工程实践标准。它把技能分成两类这个设计我很喜欢。一类叫 user-invoked你手动敲 /grill-with-docs 这种斜杠命令启动负责编排流程。一类叫 model-invoked比如 /tdd、/domain-modeling 这种纪律型技能模型在干活过程中觉得时机到了自己就调用。编排靠人纪律靠模型各管一摊不嵌套不打架。1. 开工前先让 Agent 拷问你/setup-matt-pocock-skills每个仓库必须先跑一次的初始化。它只问三个问题你用哪个 issue trackerGitHub、Linear 还是本地文件triage 打标签用什么词领域文档放哪单仓库还是 Monorepo。回答完项目根目录生成一份 CONTEXT.md。这份 CONTEXT.md 是整套技能的基石。你可以把它理解成给 AI 的「老员工入职手册」一份你和 AI 共享的项目术语词典。你们聊需求时确认过的每个黑话比如电商里的「物化」「履约单」「冻结库存」都会被写进去。以后 AI 命名、写注释、读代码都基于这套语言。这招直接解决第二个失败模式。Eric Evans 在《领域驱动设计》里管这叫 ubiquitous language通用语言。以前这概念服务人类团队Matt 把它平移给了 AI。效果立竿见影术语统一了AI 不用再拿 20 个词绕一个领域短词token 省了命名也一致了。配套的拷问技能有两个。/grill-me不带文档快速澄清适合方案讨论和技术选型。AI 会一次只问一个问题把计划里每个决策分支都逼到明处问完再让你开工。/grill-with-docs 是强化版同样是一轮高密度提问但每确认一个术语就实时更新 CONTEXT.md遇到够重要、难回滚、有取舍的决策当场写一份 ADR 架构决策记录丢进 docs/adr/。一次对话的理解不再困在当前聊天窗口里而是沉淀成项目资产。2. 干活时红绿重构伺候第三个失败模式没有反馈循环靠 /tdd 治。这个技能就是标准测试驱动开发的红绿重构循环。AI 每写一个功能必须先写一个会失败的测试红了再写刚好能让它通过的代码绿了然后才允许重构。一次只推一个垂直切片绝不一次性写完所有测试再补实现。它还有几条硬规矩。只测公开接口的可观察行为不测实现细节防止 AI 写出贴着一堆内部细节的脆弱测试。预期值必须来自独立来源禁止自问自答式的同义反复测试。用大白话说就是测试必须真正守得住门而不是 AI 自己考自己。配套的还有 /diagnose系统化调试。遇到难缠 bugAI 不能上来就猜。它得先造一个能自动跑的红绿信号复现、最小化、假设、插桩、修复、回归测试六步闭环。没有反馈循环之前不许碰代码。这招对 AI 特别重要。AI 最大的毛病就是能写出看起来合理、实际上没跑通的代码。有了 /tdd 和 /diagnose代码是不是真能跑不是 AI 嘴上说了算是测试说了算。3. 写完了两条轴并行评审/code-review 是另一个让我眼前一亮的技能。它派两个并行 sub-agent各查各的互不污染。一条轴查 Standards代码是否符合仓库文档化的编码标准对照的是 Fowler 的坏味道基线。一条轴查 Spec改动是否忠实于原始 issue 和 PRD 的要求。两边报告并排摆在你面前blocking 问题、非阻塞问题、缺的测试、规格偏差一目了然。为什么拆两条轴因为「写得好不好」和「写得对不对」是两件事。混在一起评AI 容易顾此失彼。分开审每个维度都干净。4. 架构腐化了定期体检/improve-codebase-architecture 这技能我强烈建议每个重度用 AI 写代码的人都跑一跑。它派 sub-agent 扫全库找「浅模块」就是接口跟实现差不多复杂、相当于没封装的那种然后产出一份 HTML 体检报告把加深接口的建议列给你挑。Matt 自己说这叫 survey, not rescue体检不是抢救决定权永远在你这。这套设计的理论底色是 John Ousterhout 在《软件设计的哲学》里的深模块思想好设计就是小接口后面藏着大实现。配合 /codebase-design 和 /zoom-out一个负责找加深机会一个负责在你改陌生代码前先画出模块调用地图避免改一个方法炸三个上游。三、还有一批「生产效率」技能很骚除了工程硬纪律仓库里还有些生产力向的宝贝单独拎几个出来说。/handoff把当前会话压缩成一份交接文档。你跟 Claude Code 干了一下午刚把 PRD 拆成 issue下班了跑一下 /handoff第二天新会话读一遍就知道你昨天干了啥、卡在哪、下一步干什么。长任务跨会话无缝续接这对 Agent 工作流是刚需。/to-prd 和 /to-issues 负责把聊清楚的需求一键转 PRD再把 PRD 拆成可独立交付的垂直切片 issue每个切片都标 AFKAgent 可独立干还是 HITL需要人拍板。垂直切片的意思是一个 issue 要贯穿前后端完整链路能独立 demo而不是只建个表或者只画个页面。/caveman电报体模式砍掉冠词寒暄填充词token 省 75%。context 快满的时候喊一声AI 立刻从「好的我来分析一下这个类的结构」变成「分析 PaymentService → 4 方法 → 提取 helper → 开始」。用过一次就回不去。还有 /git-guardrails给 Claude Code 装 git hook拦截 push、reset --hard、clean、branch -D 这类危险操作防止 AI 手滑毁掉你的仓库。以及 /write-a-skill引导你把团队自己的工程规范也固化成本地技能。四、30 秒上手和它跟别家有什么不一样上手快得离谱。终端敲一行npx skillslatest add mattpocock/skills安装时勾上要装到哪些 coding agent务必把 /setup-matt-pocock-skills 也选上然后跑一次初始化回答三个问题完事。全程三十秒。想用插件形态也行Claude Code 官方市场里直接 /plugin install mattpocock-skills只读自动更新但没法改。要能改要可裁剪走 npx 路线装进你的仓库变成你自己的文件想怎么 Hack 怎么 Hack。同类产品里它最大的对手是 GSD、BMAD、Spec-Kit 那类重型流程框架。Matt 的态度很鲜明那些工具拥有流程本身流程一旦出 bug 你根本发现不了还把控制权从你手里拿走了。这套技能反着来小而可组合每个技能独立可用、随意增删经典工程原则打底不靠 prompt 花活控制权始终在你手里。Kaggler 白皮书推荐的 progressive disclosure 渐进披露理念也是同一路数。有人拿它跟 anthropics/skills 官方技能库、addyosmani 的 agent-skills 比。官方库偏通用打样addyosmani 偏浏览器自动化那一挂Matt 这套则死死咬住「真实软件工程全流程」从需求拷问到架构体检闭环最完整。按需取用即可。五、说点实在的它到底改变了什么有团队做过实测。五支 TypeScript 工程队Monorepo 结构接入五个以上技能后代码评审返工时间每周省下 10 到 20 小时。原因不玄学Agent 生成的代码终于自带测试、自带术语、自带上下文评审从「重写」变成「抽查」。但我也得泼盆冷水。这套技能不是银弹。它强制的是流程不保证流程一定对。Grill 拷问得好不好取决于你回答得够不够诚实。TDD 的红绿循环遇到你自己都没想清楚的业务照样白搭。而且对单打独斗写小脚本的场景它确实有点重杀鸡不必用牛刀。它最值钱的场景是那些「AI 长期驻场、代码要活很久」的真仓库。Matt 在 README 里写的那句话我一直记得agent skills that I use every day to do real engineering。不是炫技是他每天真在用的东西从 .claude 目录里直接开源了出来。这事最打动我的点在这它回答了 2026 年 AI 编程最核心的一个问题。当 AI 写代码的速度超过人类 review 的速度决定项目生死的不再是谁写得快而是谁守得住纪律。而纪律恰好是可以被写成文件、焊进 Agent 的。六、给你的行动清单如果你也被 AI 堆过屎山我建议你这样起步。第一找一个小仓库敲下那行 npx 命令跑一遍 /setup-matt-pocock-skills先感受 CONTEXT.md 是怎么把你们聊的黑话变成项目资产的。第二下一个新需求别急着让 AI 写代码。先 /grill-with-docs 拷问一轮你会惊讶地发现原来你自己也没想清楚那么多边界。第三让它写功能时盯着它用 /tdd写完了跑 /code-review每天下班前 /handoff 留个交接文档。跑两周再回你三个月前的那个屎山仓库看看感受一下什么叫纪律。别让你的 Agent 当那个只会闷头写代码的实习生。把它训成会先问、会写测试、会留文档的老工程师。工具是现成的255K 的人已经替你验证过了。剩下的就看你愿不愿意在敲代码之前先敲下那个斜杠命令。关键词Agent Skills、mattpocock/skills、Claude Code、TDD、测试驱动开发、AI 工程纪律、vibe coding
返回列表