跳到主要内容

动手前想清楚 — 拆任务、做不做、分工与安全

这一章讲四件事: 怎么把一个任务拆开看;哪些任务值得做成技能; 拆开后每一步该交给模型还是脚本;以及动手前必须装好的安全闸。 读完你能回答:「这活儿该不该做成技能?」不再靠感觉,靠四道检查。

1. 锤子到手,别到处找钉子

作者自述刚学会做技能时的样子:「就像手里拿了把锤子,到处找钉子」——一口气建了十几个技能, 结果有些根本用不了几次,维护成本比省下的时间还高;有些越写越复杂,一个 SKILL.md 塞了几千字, 智能体执行起来忽好忽差1。踩完坑的结论只有一句:不是所有任务都适合固化成技能, 技能也不是越复杂越好2

所以动手之前先做四件事:拆任务 → 判断值不值 → 定分工 → 查安全。 本章主走查的任务贯穿全章:「每月根据公司销售数据出一份分析报告」——你手动做了好几遍,流程很熟, 正准备把它做成技能。

2. 三类操作:任何任务都是这三种的配比

书给的拆法极简:任何任务无非拆成三类操作,厨房里就能看明白3:

类型厨房里特征
执行规则「盐放 3 克」规矩定过一次,后面每次都一样
做判断看今天的鱼新不新鲜,决定清蒸还是红烧没有固定答案,得看情况来
调外援去菜市场买条鲈鱼智能体没有的工具,需要连外部

回到主走查:出数据分析报告,拆出来是这样4:

  • 执行规则:标题格式、图表配色、金额保留两位小数、结论段先写核心发现再写建议—— 标准一旦定下,每次都差不多;
  • 做判断:从数据里发现哪些趋势值得关注、结论怎么写、重点放哪——每次的数据不同,答案不同;
  • 调外援:原始数据在公司数据库里,得连上去,还得知道查哪张表、字段名是什么意思、用什么接口(约定的连接方式)拉回来。

拆完之后,怎么处理「自然就出来了」——书管这三类对应的落地方案叫「套路」 (软件工程里的说法是设计模式)。它同时提醒:不用给技能贴标签,重要的是拆解这个动作本身5

一个必须现在就说清的推论

书在拆解表里专门点了最后一行:对要求 100% 准确的「执行规则」类操作,只把要求写进 SKILL.md、 指望模型靠文字生成去「硬扛」是不靠谱的6。原因是:

模型是基于概率预测来工作的。让模型算「3.14 克盐」,就像让厨师用手掂量—— 准确性远不如直接用高精度(准到小数点后)电子秤7

这就引出了全章的核心问题:哪些活儿交给模型,哪些交给脚本(第 4 节)。

拆解还帮你躲开三个陷阱8:写「万能技能」(数据分析+配图+排版挤一个 SKILL.md); 不知道哪里该严哪里该松(「金额两位小数」必须死抠,「结论怎么措辞」不该写死); 出了问题不知道改哪(拆成独立环节后,逐项排查,范围小得多)。

3. 做不做:三问,再看四限

做成技能有成本:创建花时间、维护花精力,而且每次触发还要消耗一次工具调用、占用上下文(第 03 章的账)9。 书给的判断顺序:先问三个问题,再看四个限制。

三问(满足得越多,越值得做;一个都不满足,就别折腾)10:

  1. 这件事你会反复做吗? 只做一次的事,用提示词就够了;
  2. 你对结果的一致性有要求吗? 头脑风暴巴不得每次都不一样,不需要技能; 周报格式、术语一致性、代码审查清单这类「不能抽卡」的任务才需要;
  3. 流程基本稳定了吗? 自己还在摸索就别急着写——过早固化等于把错误流程锁进 SKILL.md, 之后每次调用都重复同样的错误。

三种不该硬做成技能的情形11:

情形例子该放哪
始终生效的规则「回复要简洁」「缩进用 4 空格」智能体的全局配置(Claude Code 用 CLAUDE.md)——「所有菜都少放盐」是贴墙上的家规,不进每份菜谱
工具一行命令搞定图片转 PNG、视频压到 10MB直接让智能体调 ImageMagick/ffmpeg——「拧开水龙头就有水」的事不写进菜谱
一次性任务偶尔一次的创意料理直接聊

三问过了,还要心里有四个限制12:

  1. 结果不完全确定——同样输入不一定同样输出。对策:需要确定性(每次结果一模一样)的环节拆出来交给脚本;
  2. 通用与可靠难两全——规则越严执行越稳,但适用范围越窄。 书里的例子:翻译技能规定「LLM、token、prompt 一律保留英文」,技术文章术语一致了, 拿去翻科普文反而满篇黑话。对策:该严的严(有对照表的环节写死),该松的松(只给方向);
  3. 触发不一定准——写得再好,没在正确时机被选中就白搭。对策:description 反复测试(第 03 章);
  4. 不同模型表现不同——强模型可能不需要那么多细节,弱模型可能要更碎的步骤。对策:复杂技能分别测。

最稳的起步方式还是第 01 章那条:先让智能体裸跑一遍真实任务,观察哪里不对,再针对短板写技能13

4. 分工:判断给模型,规则给脚本

答案一句话:需要做判断的交给模型,需要执行规则的交给脚本—— 「调味靠厨师的经验,计时和称重靠计时器和电子秤」14

为什么不能全给模型?书从模型的本性讲起:它的强项是理解和生成(发现异常、组织结论、创意发散), 短板恰恰是执行固定规则——数学计算、格式转换、固定文本替换这类要求 100% 无误差(零差错)的活,

它可能出幻觉(一本正经地编造)或微小偏差15。技能文件夹里的脚本,就是把这些死规则写成的固定代码片段, 触发即按规矩执行16。而且你不需要自己写脚本——智能体会帮你写,社区现成技能也常自带17

主走查继续:出数据分析报告的分工表18:

环节归谁为什么
标题格式、金额精度、结论顺序脚本/固定规则100% 确定,每次一样
发现值得关注的趋势、写结论模型没有固定答案,要看数据
连公司数据库拉数据外部工具智能体没有的能力,要连外部

书还点了一个细节:分工的粒度不是「按步骤」,而是「按性质」——同一步里可以既有脚本又有模型, 就像做一道菜,「调料配比」交给电子秤,「什么时候出锅」交给厨师19

把三种工具放到一张图上:提示词语义(意思)驱动(一次性、灵活的任务);脚本规则驱动(逻辑完全固定、 要 100% 确定性);技能混合驱动(反复做、多步骤、既有死规则又需判断)——三者不能互相替代, 技能的价值在于填补中间地带:比提示词更有约束力,比脚本更有适应性,比传统工作流平台更轻量20

5. 选工具:工具给能力,技能给经验

分工定了,干活还要选工具。选择顺序21:先看内置工具(读写文件、执行代码、搜索网页, 写周报、分析本地 Excel 用这些就够了);不够再按序找扩展——现成命令行工具(ImageMagick 处理图片、 ffmpeg 处理音视频)→现成代码库(Pandas 处理数据、Pillow 处理图像)→要连在线服务(飞书、Notion) 才轮到 MCP。脚本语言 Python 和 Node.js 是最佳搭配——智能体对它们最熟,生态库也最全22

这一节真正承重的是一个观念纠偏:

技能的核心并不是教智能体「如何使用工具」。 智能体知道全天下各种工具的基本用法—— 它能读 ffmpeg 的 --help。但它不知道你们团队的视频规范:输出 1080p、码率上限 5Mbps、 必须是 MP4、音频保留立体声。就像新厨师背熟了烤箱出厂说明书,却不知道 你家这台烤箱温度(实际炉温)要偏高 10 度。

也想不到要提前预热(先空烧到温)15 分钟——这些经验不在官方文档里23

所以分工是:工具提供通用能力,技能提供你独有的经验。实操上,技能要调特定工具时, 在 description 和 SKILL.md 里写完整的工具名(叫 bigquery_schema 就别含糊写成「查一下数据库结构」), 让智能体能精确找到24

6. 安全:三道闸,四个习惯

技能赋予了智能体真实的操作特权——本地智能体直接跑在你的电脑上,能访问文件、执行脚本和命令行 (云端智能体跑在平台的沙盒里,安全由平台管,但能力受限)25

要防两类风险26:「防坏人」——第三方恶意技能可能做出和描述完全不一样的事(滥用权限窃取信息、 破坏系统文件);「防自己」——自己刚写的技能可能有逻辑漏洞,一不小心删错文件。 第一条铁律是只用可信来源的技能;但信任不能代替安保——只要一个技能拥有在你电脑上执行代码的权限, 三道闸一个都不能少27:

  1. 最小权限(发门禁卡):只给完成任务所需的最小权限。只读就别给写;只碰一个文件夹就别给整块硬盘;
  2. 二次确认(按暂停键):删除文件、发送邮件、执行未知代码、访问敏感数据——这类一旦执行难撤销的操作, 必须停下等确认(好技能会在这些节点暂停,比如 Claude Code 的执行确认框);
  3. 可追溯(装摄像头):所有操作有记录;配合 Git 这类版本管理工具,出事能回退28

四个日常习惯(把上面的原则变成动作)29:

  1. 安装前先「安检」:让智能体帮你检查 SKILL.md 和 scripts/——重点看五项: 是否写清从哪读、写到哪、会不会联网;脚本里有没有隐藏的删除/覆盖/上传/外联; 生成文件会不会覆盖原文件;是否索要密码密钥;装的库名拼写对不对 (骗子会把热门库的名字拼错一个字母来伪装恶意包);
  2. 第一次跑,用假数据:自己建几个假数据文件先跑,确认生成的文件存对了地方、没破坏原稿,再上真数据;
  3. 日常干活,建个专属文件夹:永远别在桌面、系统根目录直接让它执行操作;
  4. 看清弹窗,绝不无脑点「是」

书还标了一个高危信号:从外部 URL 拉数据的技能风险特别高——即使技能本身可信, 它拉回来的外部内容也可能夹带恶意指令30

7. 作者的判断与证据,边界与局限

书里的判断(有作者的使用证据): 「不是所有任务都值得做成技能」——证据是他自己一口气建十几个 技能的踩坑史(维护成本高于省下的时间)31

书里的判断(行业共识引用): 「模型擅长理解生成、短板是执行固定规则」——这与第 03 章 「概率预测」的说法同源,书里当作公认事实使用;我们书架的《这就是 ChatGPT》拆解可以补上机制层解释 (模型本质是按概率续写,不是执行程序)。

书里的判断(断言,未给证据): 「技能的核心并不是教智能体如何使用工具」—— 这是个强的经验性断言,成立的边界是「知名通用工具」;对冷门内部系统,技能确实需要教用法。 书里没有讨论这个边界。

边界与局限:

  • 「三类操作」是实用分类,不是完备分类——书自己也说「不用给技能贴标签」;
  • 安全部分讲的是技能使用者的防线;技能作者怎么在文件里声明权限边界(allowed-tools 字段, 第 03 章见过的名片选填项),第 07 章发布环节的安全清单会回头接上;
  • 云端平台的「限制可安装的工具范围」书里一句带过,具体各平台差异没展开。

8. 可带走的

主走查一行复述:「出数据分析报告」拆三类——格式与精度(规则,给脚本/固定约束)、 趋势与结论(判断,给模型)、连数据库(外援,给外部工具);拆完,写法、严松、排查范围全都定了。

  1. 拿到任务先拆:执行规则 / 做判断 / 调外援,任务就是三者的配比;
  2. 100% 准确的规则靠模型「硬扛」不靠谱——电子秤优于手掂;
  3. 三问定做不做:反复做吗?要一致吗?流程稳了吗?
  4. 三种东西不该做成技能:全局规则进配置、工具一条命令的用工具、一次性的直接聊;
  5. 四个限制心里有数:不确定、通用与可靠难两全、触发不准、模型差异;
  6. 分工一句话:判断给模型,规则给脚本;粒度按性质不按步骤;
  7. 工具给能力,技能给经验——技能写「在你们这里怎么用好这个工具」;
  8. 调特定工具就写完整工具名;
  9. 安全三道闸:最小权限、二次确认、可追溯;四个习惯:安检、假数据、专属文件夹、看清弹窗;
  10. 外部 URL 拉数据的技能,风险等级自动上调。

9. 原文地图

主题原书章原文位置
锤子找钉子的教训第 3 章text/04-ch03.txt:9(搜「锤子」) · text/04-ch03.txt:14(搜「不是所有任务」)
三类操作第 3 章text/04-ch03.txt:27(搜「执行规则」) · text/04-ch03.txt:28(搜「做判断」) · text/04-ch03.txt:29(搜「调外援」)
数据分析报告拆解第 3 章text/04-ch03.txt:43(搜「两位小数」) · text/04-ch03.txt:51(搜「数据库」)
硬扛不靠谱、电子秤第 3 章text/04-ch03.txt:76(搜「概率预测」) · text/04-ch03.txt:77(搜「3.14 克盐」)
三个陷阱第 3 章text/04-ch03.txt:87(搜「万能技能」) · text/04-ch03.txt:91(搜「同一个尺度」) · text/04-ch03.txt:96(搜「无从下手」)
三问第 3 章text/04-ch03.txt:124(搜「反复做」) · text/04-ch03.txt:127(搜「一致性」) · text/04-ch03.txt:131(搜「基本稳定」)
三种不该做成技能第 3 章text/04-ch03.txt:153(搜「全局配置」) · text/04-ch03.txt:159(搜「PNG」) · text/04-ch03.txt:164(搜「一次性任务」)
四个限制第 3 章text/04-ch03.txt:174(搜「不完全确定」) · text/04-ch03.txt:184(搜「通用与可靠难两全」) · text/04-ch03.txt:193(搜「触发不一定准」) · text/04-ch03.txt:199(搜「不同的模型」)
分工答案第 3 章text/04-ch03.txt:218(搜「交给脚本」)
模型短板第 3 章text/04-ch03.txt:226(搜「概率预测」) · text/04-ch03.txt:232(搜「幻觉」)
粒度按性质第 3 章text/04-ch03.txt:253(搜「按性质」)
三种驱动、中间地带第 3 章text/04-ch03.txt:263(搜「语义驱动」) · text/04-ch03.txt:273(搜「中间地带」)
工具选择顺序第 3 章text/04-ch03.txt:284(搜「内置工具」) · text/04-ch03.txt:160(搜「ImageMagick」)
工具给能力技能给经验第 3 章text/04-ch03.txt:312(搜「工具给能力」) · text/04-ch03.txt:317(搜「ffmpeg」)
操作特权与两类风险第 3 章text/04-ch03.txt:339(搜「操作特权」) · text/04-ch03.txt:345(搜「防坏人」)
三道安全闸第 3 章text/04-ch03.txt:356(搜「最小权限」) · text/04-ch03.txt:360(搜「二次确认」) · text/04-ch03.txt:371(搜「可追溯」)
四个好习惯第 3 章text/04-ch03.txt:383(搜「安检」) · text/04-ch03.txt:398(搜「拼错」) · text/04-ch03.txt:403(搜「假数据」) · text/04-ch03.txt:407(搜「专属文件夹」) · text/04-ch03.txt:409(搜「无脑」)
外部 URL 高危第 3 章text/04-ch03.txt:401(搜「外部 URL」)

Footnotes

  1. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 9 段(text/04-ch03.txt:9,搜「锤子」)。

  2. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 14 段(text/04-ch03.txt:14,搜「不是所有任务」)。

  3. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 27-29 段(text/04-ch03.txt:27,搜「执行规则」)。

  4. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 43 段(text/04-ch03.txt:43,搜「两位小数」)与第 51 段(text/04-ch03.txt:51,搜「数据库」)。

  5. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 66 段(text/04-ch03.txt:66,搜「贴标签」)。

  6. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 74 段(text/04-ch03.txt:74,搜「100% 准确」)。

  7. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 77 段(text/04-ch03.txt:77,搜「3.14 克盐」)。

  8. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 87 段(text/04-ch03.txt:87,搜「万能技能」)。

  9. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 116 段(text/04-ch03.txt:116,搜「做成技能有成本」)。

  10. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 124 段(text/04-ch03.txt:124,搜「反复做」);一致性见第 127 段(text/04-ch03.txt:127,搜「一致性」);流程稳定见第 131 段(text/04-ch03.txt:131,搜「基本稳定」)。

  11. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 153 段(text/04-ch03.txt:153,搜「全局配置」)。

  12. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 174 段(text/04-ch03.txt:174,搜「不完全确定」);「通用与可靠难两全」见第 184 段(text/04-ch03.txt:184,搜「难两全」)。

  13. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 208 段(text/04-ch03.txt:208,搜「裸跑」)。原文是「先让智能体裸跑一遍真实任务,观察哪里不对,再针对短板写技能,边用边改」。

  14. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 218 段(text/04-ch03.txt:218,搜「交给脚本」)。

  15. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 231 段(text/04-ch03.txt:231,搜「短板」)。

  16. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 237 段(text/04-ch03.txt:237,搜「定死的」)。

  17. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 241 段(text/04-ch03.txt:241,搜「不需要自己写脚本」)。

  18. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 248 段(text/04-ch03.txt:248,搜「分工」)。

  19. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 253 段(text/04-ch03.txt:253,搜「按性质」)。

  20. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 273 段(text/04-ch03.txt:273,搜「中间地带」)。

  21. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 284 段(text/04-ch03.txt:284,搜「内置工具」)。

  22. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 304 段(text/04-ch03.txt:304,搜「Python」)。

  23. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 317 段(text/04-ch03.txt:317,搜「ffmpeg」)。

  24. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 328 段(text/04-ch03.txt:328,搜「bigquery_schema」)。

  25. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 339 段(text/04-ch03.txt:339,搜「操作特权」)。

  26. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 345 段(text/04-ch03.txt:345,搜「防坏人」)。

  27. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 350 段(text/04-ch03.txt:350,搜「信任不能代替安保」)。

  28. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 356 段(text/04-ch03.txt:356,搜「最小权限」);二次确认见第 360 段(text/04-ch03.txt:360,搜「二次确认」);可追溯见第 371 段(text/04-ch03.txt:371,搜「可追溯」)。

  29. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 383 段(text/04-ch03.txt:383,搜「安检」);库名拼写见第 398 段(text/04-ch03.txt:398,搜「拼错」);假数据见第 403 段(text/04-ch03.txt:403,搜「假数据」)。

  30. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 401 段(text/04-ch03.txt:401,搜「外部 URL」)。

  31. 出处:「第 3 章 捋清楚:从任务到技能五步走」第 10 段(text/04-ch03.txt:10,搜「用不了几次」)。