#616.Matt Puckett:用一份检查清单,终结 AI Agent 的“技能地狱”

播客收听
问这期播客
会先在本集摘要、章节、转录和笔记里找答案。
TL;DR · AI 摘要
616.Matt Puckett:用一份检查清单,终结 AI Agent 的“技能地狱” - 跨国串门儿计划 小宇宙 - 听播客,上小宇宙 📝 本期播客简介 本期我们克隆了:知名播客《AI Engineer》 Building Great...
核心要点
- 主题聚焦:616.Matt Puckett:用一份检查清单,终结 AI Agent 的“技能地狱”
- 来源:跨国串门儿计划,建议结合原文判断细节。
- AI 分析暂不可用,本条为保底评分与摘要。
章节
本期克隆节目介绍
本期克隆节目介绍
演讲主题:《缺失的手册:如何写出好技能》
演讲主题:《缺失的手册:如何写出好技能》
从“教程地狱”到“框架地狱”,再到“技能地狱”
从“教程地狱”到“框架地狱”,再到“技能地狱”
技能地狱的典型症状:拼凑框架却拿不到承诺的效果
技能地狱的典型症状:拼凑框架却拿不到承诺的效果
走出技能地狱的关键:建立评判技能好坏的标准
走出技能地狱的关键:建立评判技能好坏的标准
技能检查清单的四大维度:触发、结构、引导、剪枝
技能检查清单的四大维度:触发、结构、引导、剪枝
配套技能 Writing Great Skills 已发布
配套技能 Writing Great Skills 已发布
触发是技能被调用的方式
触发是技能被调用的方式
用户调用 vs 模型调用技能的区别
用户调用 vs 模型调用技能的区别
模型调用技能的原理:上下文指针指向 skill.md
模型调用技能的原理:上下文指针指向 skill.md
第一条建议:决定技能是用户调用还是模型调用
第一条建议:决定技能是用户调用还是模型调用
模型调用技能的代价:上下文负载
模型调用技能的代价:上下文负载
转录
本期克隆节目介绍
演讲主题《缺失的手册:如何写出好技能》
从“教程地狱”到“框架地狱”,再到“技能地狱”
技能地狱的典型症状拼凑框架却拿不到承诺的效果
走出技能地狱的关键建立评判技能好坏的标准
技能检查清单的四大维度触发、结构、引导、剪枝
配套技能 Writing Great Skills 已发布
触发是技能被调用的方式
用户调用 vs 模型调用技能的区别
模型调用技能的原理上下文指针指向 skill.md
第一条建议决定技能是用户调用还是模型调用
模型调用技能的代价上下文负载
用户调用技能的代价用户认知负载
MatPat skills 与 superpowers 的对比:两种调用哲学
模型调用技能的不可预测性风险
Matt 偏好用户调用技能的原因消除不可预测性
技能内部的两个主要单元步骤和参考
案例2PRD 技能的步骤与参考材料
从零写技能的方法先定步骤,再定参考
第三条建议让主 skill.md 文件尽可能小
瘦身技巧识别技能的不同分支
案例domain modeling 技能的多分支结构
外部参考把分支资料藏在上下文指针后面
引导的核心技巧引导词
Agent 不按想法做的原因没用引导词
引导词的概念把大量含义压缩到小空间
案例用“垂直切片”引导 Agent 改变编码习惯
如何验证引导词生效观察推理轨迹
引导词不生效时的改进方法
增加基础工作量的技巧隐藏未来步骤
案例计划模式中“问澄清性问题”永远做不够
解决方案把技能拆成独立步骤,一次只让 Agent 看到一个
剪枝是一组快速过一遍的失败模式
失败模式一不要重复自己,保持单一事实来源
失败模式二冗余沉积,多人协作的经典问题
失败模式三无效操作,看起来有用但不影响行为的内容
精简技能的秘诀删除测试、压缩成引导词、清除无关内容
框架回顾触发、结构、引导、剪枝
上手最佳方式使用 Writing Great Skills 技能
后续内容AI 编码速成课程与 newsletter
节目笔记
#616.Matt Puckett:用一份检查清单,终结 AI Agent 的“技能地狱” - 跨国串门儿计划 | 小宇宙 - 听播客,上小宇宙
📝 本期播客简介
本期我们克隆了:知名播客《AI Engineer》 Building Great Agent Skills: The Missing Manual
原内容更新时间:2026-06-29
本期主讲人是 Matt Puckett,他是 AI 工程领域最流行的技能集之一 MatPat Skills 的作者。这期节目源于他原本要在 AI Engineer World's Fair 上做的一场演讲,因为无法到场,他选择将内容直接分享出来。他聚焦于一个被称作“技能地狱”的普遍困境:开发者手头有大量 Agent 技能,却缺乏一套评判标准,分不清好技能和坏技能,导致拼凑出来的效果远不如预期。
Matt 没有停留在抱怨,而是直接给出了一套系统性的技能构建框架。他从技能的触发、结构、引导和剪枝四个维度出发,提供了一份可操作的检查清单。无论你是正在为 Agent 编写技能的开发者,还是试图将组织流程转化为 Agent 可执行操作的技术负责人,这期节目都能帮你建立一套审视和改进技能的方法论。
👨⚕️ 本期嘉宾
Matt Puckett,MatPat Skills 的作者与维护者。MatPat Skills 是目前 AI 工程领域最流行的 Agent 技能集之一,被大量开发者用于构建和增强 AI Agent 的能力。Matt 本人长期深耕 Agent 技能的设计与优化,对如何写出高质量、可维护的技能有着丰富的一手经验和系统性思考。
⏱️ 时间戳
开场与“技能地狱”
00:00 本期克隆节目介绍
01:06 演讲主题:《缺失的手册:如何写出好技能》
01:27 从“教程地狱”到“框架地狱”,再到“技能地狱”
02:21 技能地狱的典型症状:拼凑框架却拿不到承诺的效果
02:41 走出技能地狱的关键:建立评判技能好坏的标准
技能检查清单总览
03:01 技能检查清单的四大维度:触发、结构、引导、剪枝
03:50 配套技能 Writing Great Skills 已发布
触发:技能如何被调用
04:05 触发是技能被调用的方式
04:25 用户调用 vs 模型调用技能的区别
05:10 模型调用技能的原理:上下文指针指向 skill.md
05:53 第一条建议:决定技能是用户调用还是模型调用
06:07 模型调用技能的代价:上下文负载
06:29 用户调用技能的代价:用户认知负载
06:39 MatPat skills 与 superpowers 的对比:两种调用哲学
07:09 模型调用技能的不可预测性风险
07:26 Matt 偏好用户调用技能的原因:消除不可预测性
结构:技能内部如何布局
07:55 技能内部的两个主要单元:步骤和参考
08:24 案例:2PRD 技能的步骤与参考材料
08:59 从零写技能的方法:先定步骤,再定参考
09:17 第三条建议:让主 skill.md 文件尽可能小
09:49 瘦身技巧:识别技能的不同分支
10:27 案例:domain modeling 技能的多分支结构
10:58 外部参考:把分支资料藏在上下文指针后面
引导:让 Agent 按你的想法做事
11:56 引导的核心技巧:引导词
12:17 Agent 不按想法做的原因:没用引导词
12:26 引导词的概念:把大量含义压缩到小空间
12:53 案例:用“垂直切片”引导 Agent 改变编码习惯
13:59 如何验证引导词生效:观察推理轨迹
14:32 引导词不生效时的改进方法
14:54 增加基础工作量的技巧:隐藏未来步骤
15:09 案例:计划模式中“问澄清性问题”永远做不够
15:35 解决方案:把技能拆成独立步骤,一次只让 Agent 看到一个
剪枝:给技能做减法
16:35 剪枝是一组快速过一遍的失败模式
16:51 失败模式一:不要重复自己,保持单一事实来源
17:19 失败模式二:冗余沉积,多人协作的经典问题
18:00 失败模式三:无效操作,看起来有用但不影响行为的内容
18:27 精简技能的秘诀:删除测试、压缩成引导词、清除无关内容
总结与上手
18:39 框架回顾:触发、结构、引导、剪枝
19:29 上手最佳方式:使用 Writing Great Skills 技能
19:42 后续内容:AI 编码速成课程与 newsletter
🌟 精彩内容
💡 技能地狱的本质是缺乏评判标准
Matt 指出,开发者陷入技能地狱的根本原因,不是技能太少,而是没有一个共享的评判标准来审视技能的好坏。这导致人们盲目拼凑,却搞不清楚为什么效果不佳。
“没有一个共享的评判标准,没有一个框架来审视技能并把它变得更好。”
💡 模型调用技能的隐藏代价是不可预测性
很多人觉得让模型自己调用技能更灵活,但 Matt 提醒,每次增加模型调用技能,都在增加上下文负载,更关键的是引入了不可预测性——模型可能就是不调用那个完美匹配的技能。
“每次你有一个模型调用技能,基本上你就要付出不可预测性的代价。”
💡 引导词是把大量含义压缩到小空间
Matt 提出的“引导词”技巧,是本期最核心的实操方法。通过在整个技能中反复使用一个高度浓缩的短语,可以让 Agent 在推理轨迹中自我强化,从而改变行为。
“引导词的概念,就是有些词能把一大堆意思压缩到很小的空间里。”
💡 隐藏未来步骤,增加当前步骤的基础工作量
当 Agent 总是急于跳到下一步、基础工作做不够时,Matt 的建议是把技能拆成独立步骤,让 Agent 一次只能看到一个目标。这能有效迫使它在当前阶段投入更多精力。
“通过隐藏未来的目标、隐藏未来的步骤,来增加当前步骤的基础工作量。”
💡 精简技能的秘诀是做删除测试
面对技能文件越来越臃肿的问题,Matt 的方法简单直接:删掉某段内容,看 Agent 的行为是否改变。如果没变,那段内容就是无效操作,可以砍掉。
“如果你把那段话直接删掉会怎样?Agent 大概率还是会写出一份像样的提交信息。”
💡 技能构建的四大支柱
Matt 将整个框架浓缩为四个可操作的维度,为技能设计和审查提供了清晰的路径。
“第一,检查触发;第二,结构方面要考虑分支;第三,引导方面要把文本浓缩成引导词;最后是剪枝。”
🌐 播客信息补充
本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的
使用 AI 进行翻译,因此可能会有一些地方不通顺;
如果有后续想要听中文版的其他外文播客,也欢迎联系微信:iEvenight