大家好,我是蓝戒。本篇我们来聊聊:“谷歌总监的Agent规约”。
在这场席卷开发圈的 Vibe Coding 狂欢里,很多人大概都体会过这种酣畅淋漓的快感:
靠在椅背上,随手向 Cursor 或 Claude Code 扔几句自然语言,AI 键盘翻飞,短短几秒钟就能生成一整套像模像样的模块,页面眨眼间就能跑起来。
初看之下,任谁都会忍不住感叹一声:这真是颠覆级的生产力奇迹。
但对于负责把关系统长久运行的资深工程师来说,真正的现实往往发生在你点开 Git diff 做代码审查(Code Review)的那一刻,各种隐患瞬间扑面而来:
- 你让它加个小功能,它洋洋洒洒改了几十行,却连一行能够自证清白的自动化单元测试都没写,全凭大模型那句虚无缥缈的“已为您完美实现”;
- 代码库里明明早有沉淀多年的通用请求封装与状态处理逻辑,它偏偏自作主张手搓了一套孤岛函数,代码风格支离破碎;
- 为了图一时省事,随手引入未经评估的沉重外部依赖包,原本轻盈流畅的前端首屏渲染,直接被拖累得迟钝臃肿。
这种“表面上能跑通、实则难以长期维护”的散装代码,正在演变成团队内部持续堆积的技术负债。
就在今天,全球前端工程界的大神级人物、Google 知名技术领袖 Addy Osmani 官方博客
正式开源了一套重磅工程项目——addyosmani/agent-skills。
仓库地址:https://github.com/addyosmani/agent-skills
他做了一件直击所有工程团队痛点的事:把 Google 和一线顶级大厂资深架构师刻进骨子里的工程素养,提炼成了一套标准化、一行命令即可全自动安装的 Agent 技能规约库!
今天蓝戒就带大家拆解一下,这位大厂技术总监是如何给随性发挥的 Coding Agent 戴上这道“专业紧箍咒”的。
代码质量危机:AI 写得越快,代码审查越头疼
我们可以打个特别形象的比方:
现在的 AI 编程助手,特别像一个智商极高、打字奇快、但毫无工程纪律的野生实习生。
你让他去库房取个工具,他不仅把工具拿来了,还顺手拆了半堵承重墙、改动了强电箱线路,最后还一脸邀功地问你:“老板,功能是不是已经跑起来了?”
在以往,实习生犯错尚有资深工程师在后面肉身兜底;
但现在 AI 产出代码的速度是人类的几十倍,如果任由它按照泛滥的概率逻辑在代码库里“自由挥洒”,不出几个迭代周期,整个项目的底层架构就会被稀释成难以理清的混乱泥潭。
Addy Osmani 在 agent-skills 官方文档站
中给出的洞察极其深刻:
很多人以为让 AI 写出好代码取决于更花哨的提示词(Prompt),但真正能让 AI 交付生产级软件的,是不可逾越的工程约束(Constraints)与自动化验证机制。
你不需要把它当成全知全能的玄学大师,而是必须像严格的 Tech Lead 一样,用大厂的标准纪律约束它的每一步决策。
拆解四大架构技能:把 Senior Engineer 的直觉注入 AI
在这套开源技能库中,Addy Osmani 将现代软件工程中最关键的四道防线,封装成了四个清晰的执行指令:
1. /test(Tests are proof):没有测试自证的代码,等于没写
很多 AI 最让人无可奈何的特点就是“过度自信”:改完代码立刻宣布胜利,实际上一跑线上用例就挂。
一旦挂载 /test 规约,Agent 的行为逻辑会被硬性重塑:
- 测试即证据:任何新增功能或缺陷修复,必须先编写出可稳定复现或精准覆盖的自动化测试用例;
- 红绿验证闭环:代码编写完成后,Agent 必须在沙箱终端亲手跑通测试套件,拿到明确的绿标结果,才被允许交卷。拿不出测试证据,直接判定为未完成交付。
2. /constraints:一次声明全局契约,终结风格碎片化
这是治愈项目代码“多重人格”的良药。
在大型团队中,AI 经常东一榔头西一棒槌,一会儿写函数式管道,一会儿又改写成嵌套类,异常处理逻辑毫无章法。
通过 /constraints,你在项目根目录定下一组不可妥协的硬约束:
- 错误处理严格遵循全局统一的规范;
- 严禁未经团队评估引入大型外部库;
- 一处声明,全局强行生效。AI 一旦尝试越界,系统在编码阶段就会立刻阻断。
3. /review:强制 Agent 在提交前做深度自检
写完代码直接开提 PR?在资深工程师眼里这是极其不专业的表现。
/review 指令会在编码完成后,强制唤醒 Agent 扮演一名极其苛刻的资深代码评审员,调转视线严格审视刚刚生成的 Git diff:
- 审查是否存在边界空指针异常、未释放的资源与安全漏洞;
- 审视变量命名与模块解耦是否符合长期的可读性要求;
- 主动自查 3 个潜在的坏味道并就地完成重构优化,把粗糙的瑕疵全部消化在本地。
4. /webperf:性能指标前置,严禁盲目负优化
作为长期主导 Chrome 开发者体验的技术专家,Addy Osmani 对网络性能的严谨性毋庸置疑。
很多 AI 为了追求酷炫功能,顺手打包数十个未经 Tree-shaking 摇树优化的依赖,导致核心网页体验指标(Core Web Vitals)瞬间恶化。
/webperf 强制要求 Agent 在改动代码前后,必须先量化首包体积(Bundle Size)、LCP 与页面交互延迟,用真实的数字指标作为评判标准,坚决杜绝任何性能倒退。
动手实战:一行命令,让你的终端 Agent 拥有“大厂灵魂”
最方便的是,这套规范完全遵循开放的 Agent Skills 标准,兼容 Claude Code、Cursor、Codex 等主流工具平台,安装只需要在终端执行单行命令:
Bash
# 全局自动安装 24 个生产级工程规约
npx skills add addyosmani/agent-skills
若你使用 Claude Code,也可以直接在插件市场中挂载:
Bash
/plugin marketplace add addyosmani/agent-skills
/plugin install agent-skills@addy-agent-skills
安装完成后,在日常开发中调用这套体系非常直观自然:
实战场景示范:
当你需要让 Agent 改造一个旧业务模块时,别再只丢一句模糊的“帮我重构一下这个接口”。
而是明确下达约束:
“请帮我重构 user-service 的认证逻辑。先执行
/test补齐各类异常边界测试,遵守/constraints里的无状态契约,最后运行/review生成自检报告后再交付。”
此时你会发现,AI 的行为模式发生了质的改变:
它不再急匆匆地乱翻现有代码,而是先严谨地列出测试断言,复用既有的公共工具类,主动跑通测试套件,并在最终交付时附上一份条理清晰的审查报告。
思考:Vibe Coding 之后,工程纪律才是真正的护城河
很多人以为,当大模型变得越来越聪明、生成速度越来越快时,程序员的专业门槛就彻底消失了。
但真实世界的工程规律恰恰相反:生成代码的阻力越小,劣质混乱代码蔓延的破坏力就越大。
当人人都拥有一台能瞬间敲出几百行代码的超级机枪时,真正拉开水平差距的,早已不是“谁开火更快”,而是“谁的弹道更稳、谁的工事更坚固、谁具备更严密的作战纪律”。
Addy Osmani 开源这套 agent-skills 之所以备受推崇,正是因为它给喧嚣的 AI 编程热潮注入了一剂清醒剂:无论底层模型多强大,尊重测试、恪守契约、克制设计的大厂工程素养,永远是软件工业立于不败之地的基石。
文章评论