经济金融 AI 智能体设计 · 第 2 次课 0121
序 · 开场 中山大学岭南学院 · 张一帆
+ +
01序 · 开场
研究生专业学位选修课 · 第 2 次课 · W1 下午

理解技能
确定场景

先当使用者,不当开发者
张一帆
中山大学岭南学院 · 经济金融 AI 智能体设计
AI岭南学院
0回扣上午

上午那张表,现在补第二条

失败在接龙里长什么样做法补在哪
跑题开头那句没说清要往哪走先说清楚要什么再给材料今天:技能
污染中途插进一句订餐的事一个任务开一个新会话今天不动,这是习惯问题
遗忘前文太长,开头被压缩掉要它记住的写进文件上午的 AGENTS.md 解决了一半
技能解决的是跑题:把「这类活该怎么做」固定下来,你就不用每次从头交代一遍步骤。
0三块

接龙第三轮那三块,现在补中间那块

接龙第三轮那三块,今天补中间那块
背景 · 上午做完

AGENTS.md 写我是谁、口径和红线,每次会话它先读

规矩 · 今天下午

技能写这类活分几步、在哪停下来核、交出来长什么样

清单 · 下次课

数据接口,让它自己去台账和共享文档里取最新一版

0你在哪一层

今天还在第一层

今天还在第一层
第一层 · 用工具

会把活说清楚、会验收。今天工具从对话框换成技能库

第二层 · 造工具

第 3、4 次课造自己的技能,今天的每条判断那时都要用

第三层 · 造系统

第 5、6 次课给它记忆、给它一队人,让它常驻

0本次课目标

今天下午两件事

第二件比第一件重要。场景定不下来,后面三周全是虚的。
0本次课路线

今天下午,七个部分

I
PART I · 第一部分

技能
是什么

从一段复用的提示词,到一个带脚本和资料的文件夹
I先想一想

你对它说过多少遍同一句话?

你对它说过多少遍同一句话?
「数字要标来源」

每次都说,说明它是你的长期规矩,不是这一次的要求

「用三线表」

格式要求。换一个会话,它就忘了

「先出计划再动手」

做法要求。这一类最该固定下来

第三次还在重复交代,就该把交代固定下来了。
I差在哪

一句提示词 / 一个技能

一句提示词 / 一个技能
存在哪

提示词在你脑子里;技能是一个文件夹,存在电脑上

谁来想起

提示词要你每次说;技能它自己判断什么时候用

能不能给人

提示词带不走;技能拷给同事,他装上就能用

技能不只是把提示词存起来,差别在它自己会想起来用
I最简单的一种

最简单的技能,就是一段存下来的提示词

fix-chinese / SKILL.md 全文 25 行,这里删去英文原句只留意思
--- name: fix-chinese ← 名字 description: 写中文、改中文时自动用;用户说「修改中文」 「去翻译腔」「去AI味」时也用。去掉 AI 腔和翻译腔…… ← 描述:什么时候该用我 --- # Fix Chinese Writing ← 从这里往下是正文,就是一段提示词 - 见到就删:值得注意的是、总而言之、综上所述 - 少用「的」,被动句改主动句,长定语拆成短句 - 中文和英文、数字之间加半角空格 - 中文语境用全角标点,代码和英文里用半角
把你每次都要说的那段话,加上一个名字一句「什么时候用我」,存成 SKILL.md。这就是一个技能。
I复杂的怎么来

从一段提示词,一级一级往上加

一级SKILL.md

只有这一份文件:一段规矩加名字和描述。大部分技能停在这一级

fix-chinese · 1 个文件
二级+ 参考资料

规矩太长塞不下,拆成几份放进 references/,正文里写一句「要做 X 去读哪份」

pdf 的 forms.md
三级+ 脚本

有些步骤让程序跑比让它想更稳,比如拆 PDF、填表单、数页数

pdf · 8 个脚本
四级+ 模板与规范

整套格式规范、模板文件。一辈子可能只用到一次,但用到时必须对

docx · 61 个文件
I拆开看 · 二级和三级

pdf 加了参考资料和脚本

pdf/ 12 个文件,85 KB ├── SKILL.md 314 行 | description 437 字符 │ └── 正文里写着:"要填表单就去读 forms.md" ← 通往参考资料的入口 ├── reference.md 进阶用法,平时不读 ├── forms.md 填 PDF 表单专用,碰到才读 └── scripts/ 8 个能直接跑的程序 ├── convert_pdf_to_images.py ├── extract_form_structure.py ├── fill_fillable_fields.py └── check_bounding_boxes.py …
注意那一句 "要填表单就去读 forms.md"。正文不把什么都写进来,只告诉它要用时去哪拿
I拆开看 · 四级

docx 61 个文件,1.27 MB

docx/ 61 个文件,1272 KB ├── SKILL.md 590 行 | description 787 字符 └── scripts/ ├── accept_changes.py 接受修订 ├── comment.py 加批注 └── office/ ├── pack.py └── schemas/ 39 份 Office XML 规范,1065 KB ├── dml-chart.xsd ├── wml.xsd └── … 一辈子可能只用到一次
它大,是因为资料多,不是因为管的事多。它只管一件事:读写 Word。
I四种形态

技能长得不都一样

技能长得不都一样
一段规矩

fix-chinese,只有一份 SKILL.md

一套脚本

pdf,规矩加 8 个能直接跑的程序

一条流水线

marp-slides-creator,分析、起草、审阅、定稿

带资料的工具箱

docx,附 39 份 Office XML 规范

形态不同,入口都一样:一份 SKILL.md,开头两行是名字和描述。
I不用装的两个

系统自带的:/init 与 /compact

/init

替你起草说明书

让它把整个工作区扫一遍,自己起草一份项目说明文件。上午你手写的 AGENTS.md,它能先起个草,你再改

对应上午那条:要它记住的,写进文件
/compact

把前面压成摘要

对话太长时,把前文压成一段摘要,腾出位置。接龙里找个人把前面压成三句,就是它

/compact 保留所有数字和出处,其余可以压
严格说它们是内置命令,不是技能:不用装,敲 / 就能叫出来。压缩时漏掉的,后面再也回不来,所以要告诉它哪些必须留
Claude Code、Codex、CodeBuddy Code(腾讯命令行版)都有这两个命令,国内这一支就是 CodeBuddy。WorkBuddy 官方文档没列这两个名字,它有自动的上下文压缩和长期记忆;敲 / 看你这一版有哪些 · 2026-09 查
I别搞混

技能和 AGENTS.md 差在哪

AGENTS.md

  • 我是谁、我的口径
  • 永远在读,不用挑
  • 一个工作区一份

技能

  • 这类活怎么做
  • 被挑中才读
  • 装几十个都不挤
员工手册
一个是身份,一个是手艺。新员工进公司先发员工手册,再教他这个岗位怎么干活。
I判断

什么时候找技能,什么时候直接说

第四条最容易被忽略。技能是把你已经会的固定下来,不是替你想出你不会的。
第一部分 · 记住一句

技能,就是把
你说了三遍的规矩固化下来

上午你已经固化了一次:那份 AGENTS.md,固化的是「我是谁」。
II
PART II · 第二部分

渐进式
披露

一个技能被想起来的全过程。今天下午最要紧的一段
II渐进式披露

渐进式披露:像查一本书

你查一本书它用一个技能什么时候读多大
看目录名字 + 描述一直摆在眼前每个技能几百字符
翻到那一章SKILL.md 正文挑中这个技能才读几十到几百行
查附录、对照表参考资料、脚本、模板做到那一步才打开可以到几 MB
II为什么这么设计

不这么设计,你的材料就没地方放了

三十个技能全文几十万字,还在涨
它一次看得见的有限,且要留给你的材料
技能全文加起来它一次能看见的量
II全过程

一个技能被想起来的全过程

一个技能被想起来的全过程
第二步 · 看目录

只扫所有技能的名字和描述,也就是常驻的那一层

第四步 · 翻到那一章

挑中了,才去读这个技能的 SKILL.md 正文

第五步 · 查附录

做到某一步,才打开对应的参考资料或脚本

它挑的时候,只看得见名字和描述。正文写得再好,挑不中也没用。
II回头看那三个

三个技能,常驻的部分一样小

三个技能,常驻的部分一样小
水面上 · 常驻

fix-chinese / pdf / docx 分别 422 / 437 / 787 字符

水面下 · 正文

25 / 314 / 590 行,挑中了才读

最深处 · 资料

docx 共 1272 KB,常驻部分只占万分之六

几十个技能同时装着,也不挤占上下文
练习 一全班同一个技能 · 材料包 MDE-02 里有

让 AI 装上 fix-chinese

I

在技能页点「上传技能」选材料包里的 fix-chinese 文件夹;或者直接对它说:把这个文件夹装成技能,装好告诉我装在哪

II

看它知道什么

开个新会话问:不打开任何文件,你现在知道 fix-chinese 的哪些信息?它答得出的,就是目录那一层

III

用一次

贴三句带 AI 味的中文让它改,再追问:你是按哪个技能的哪几条改的?

第二步是渐进式披露在你眼前发生:没挑中之前,它手上只有名字和描述。第三步它才去翻正文。
II休息

休息十五分钟

回来第一个问题:你装了三十个技能,它怎么知道该用哪个?
III
PART III · 第三部分

描述决定
它想不想得起

装了三十个技能,它凭什么挑中这一个
III先别急着答

你装了三十个技能,它怎么知道该用哪个?

你装了三十个技能,它怎么知道该用哪个?
它手上有什么

三十行目录,每行一个名字加一句描述

它怎么挑

拿你那句话去对描述,对得上才翻开正文

所以

描述写糊了挑不中;两个描述写得像,就互相抢活

描述是它挑技能时唯一看得见的东西。
III由此推出

两条判断,下次课一直要用

一 · 名字和描述决定它会不会被想起来

  • 正文写得再好,挑不中就等于不存在
  • 描述写得含糊,它永远不触发
  • 这是新手最常见的失败,练习二你会亲手制造一次

二 · 一个技能只干一件事

  • 职责一混,描述就写不准
  • 描述写不准,触发也跟着乱
  • 「办公助手」这种技能,什么都想干,结果什么都不触发
这两条今天先记住。下次课造技能时,我会一条一条拿出来对
III写法

描述怎么写才会被想起来

这样写,永远不触发

  • 「处理文本」
  • 「文档助手」
  • 「办公效率工具」
  • 「智能分析」

这样写,才挑得中

  • 动作 + 对象:把 Markdown 转成排版规范的 Word
  • 触发场景:用户提到 .docx、Word 文档、或要一份正式报告时
  • 反向排除:不要用于 PDF,不要用于电子表格
第三部分 · 记住一句

想不起来
等于没装

装了三十个技能却一个都不触发,比只装三个还糟:你会以为它在用。
III最隐蔽的一个坑

装了 / 用了

装了 / 用了
装了没触发

照样给结果,看着像回事,技能里的规矩一条没用

真的触发了

按技能的步骤走,问得出它第几步做了什么

怎么验

问一句:你刚才是按哪个技能的第几步做的?

答不上来就是没触发。练习二会让你亲眼看一次
III想不起来怎么办

它想不起来,你就点名

?

等它自己想起来

你说一句话,它扫一遍描述,觉得对得上才用。描述写得好,你什么都不用管

帮我把这段中文改得像人写的
/

点名叫它来

输入框里敲 /,弹出已装的技能,选一个。跳过了挑选那一步,描述写成什么样都会用

/fix-chinese 把这段改得像人写的
点名能救急,但治不了根。你不会每次都记得点名,描述写对了它才会自己想起来
III还有一个问题

技能之间,能不能套着用?

某个「写月度快报」技能 / 正文
## 步骤 1. 读三份部门月报 Word 用 docx 技能读 2. 按 AGENTS.md 的口径汇总,数字标来源 3. 成稿后用 fix-chinese 过一遍中文 4. 用 md-to-docx 转成 Word
  • 。办法很朴素:正文里写一句「这一步用某某技能」,做到那一步它就去读那个技能
  • 被叫的那个也得装着,名字要写对
  • 套得越多,越难验出哪一步没触发。套一层就够
几个技能同时装着,各管各的,别抢同一类活
练习 二在练习一装好的 fix-chinese 上动手

把描述改坏,再用 / 点名

改坏

打开 fix-chinese 的 SKILL.md,把 description 换成四个字:「处理文本」

看它不来

开新会话,说「帮我把这段中文改得像人写的」,再问它按哪个技能做的

点名

敲 / 选 fix-chinese,同一段话再来一次,两次结果摆在一起比

改回来

把原描述贴回去,开新会话,不点名再说一遍,看它来不来

描述管它想不想得起,/ 管你点不点名。一句描述的差别,就是这个技能存在与不存在的差别。
IV
PART IV · 第四部分

技能
从哪里来

系统自带、技能市场、官方仓库、GitHub、同事和材料包
IV五个来源

技能从哪来,决定你要多小心

来源例子装之前看什么
系统自带/init、/compact 这类内置命令不用装,敲 / 就在
技能市场WorkBuddy 技能页「查找技能」,官方的 SkillHub上架有审核,照样先看描述
官方仓库Anthropic 开源的 docx、pdf、skill-creator质量稳,原本写给 Claude
GitHub 社区个人或公司开源的,比如 web-research(LangChain)参差不齐,看谁写的、写给哪个工具
同事和材料包本课的 MDE-02;同事写好发你的文件夹装之前把 SKILL.md 读一遍
还有第六个来源:自己造。那是下次课的事。
IV怎么搜

产物,不搜身份

搜产物,不搜身份
搜不到

岗位名「客户经理」、软件名「Excel」、大词「AI 办公」

搜得到

动作加对象:把走访记录写成周报、把 Markdown 转成 Word

多换几种说法

同一个意思换三种说法,各搜一遍

技能是按它能交出什么写描述的,不是按谁在用它。
IV四步

拿到一个陌生技能,这么走

拿到一个陌生技能,这么走

用你想要的产物命名

装之前先看描述,看它说不干什么

先跑五分钟能验完的小样本

跑之前写好三条合格标准

第四步最容易被跳过:跑完再补的标准,一定是照着结果写的
IV演示 · 搜一个

现在我去搜一个

WorkBuddy 技能页 · 查找技能
搜索:演示文稿 结果里我要看的不是名字,是描述: ① 它说自己干什么? ② 它有没有明确说不干什么? ③ 它需不需要额外的账号、密钥或别的工具才能跑? 第三条最容易踩坑。装上跑不起来,九成卡在这里。
V
PART V · 第五部分

四个
常见误区

四条今天下午都见过
V对一遍

四个误区,今天都见过

误区问题出在哪正确做法今天在哪见过
技能越大越好边界模糊,触发失真一个技能只做一类事docx 大是因为资料多,管的事只有一件
没有脚本就不算技能把最小一级当成残次品只有一份 SKILL.md 也成立fix-chinese 就一个文件
描述越宽泛越好它没法准确匹配写清触发场景和不干什么练习二你亲手改成「处理文本」
先收集技能再学原理没有判断,看不出好坏先懂原理,再决定用谁的所以今天先讲三部分,练习三才去搜
第四条是给个人作业打的预防针:收藏一百个技能并不重要,不如仔细看其中两三个
练习 三每人认领一个主题 · 同组不撞车

按主题搜一个,装上,让它介绍自己

按下一页的主题和检索词搜。搜不到就换说法,至少换三种

装之前看

谁写的、描述怎么写的、要不要额外账号

让它介绍

装上后用指令卡 3-1 问它五个问题,对照 SKILL.md 看它说得对不对

跑小样

先写三条合格标准,再跑一个五分钟能验完的样本

这一练就是个人作业一的第一步。搜到好用的,直接留着做作业。
V练习三 · 主题卡

八个主题,按功能分四类

功能主题(用要交出来的东西命名)建议的检索词
文件进出把一摞 PDF 变成能检索的文字PDF 转文字 | 扫描件 OCR | PDF 提取表格
把 Markdown 变成排版规范的 WordMarkdown 转 Word | md 转 docx
读懂并清洗一张很乱的表清洗表格 | 修复 Excel | 处理电子表格
查东西查一个行业问题并给出带来源的报告联网调研 | 带来源的检索 | 深度研究
把一段录音变成会议纪要录音转文字 | 音频转写 | 会议纪要
交东西做一份今天就能放映的演示文稿生成演示文稿 | 做 slides | 做 PPT
把一段中文里的 AI 味去掉(fix-chinese 之外再找一个)中文润色 | 去 AI 味 | 改写中文
替你办事自动打开一个网页把表填了浏览器自动化 | 自动填表 | 网页抓取
V练习三 · 指令卡 3-1

让它介绍这个技能,问五件事

指令卡 3-1 · 练习页上可一键复制
打开你刚装的【技能名】的 SKILL.md,读完告诉我五件事: 1. 它从哪来:谁写的,原本写给哪个工具用 2. 描述原文是什么,按描述它会在什么时候被想起来 3. 它明确说了不干什么吗?没说就直说没说 4. 正文分几步,有没有参考资料和脚本,属于第几级 5. 跑它需要额外装什么、要什么账号 每一条都指出是 SKILL.md 里的哪一句,找不到就说找不到。
它介绍完,你自己翻开 SKILL.md 对一遍。对不上的地方,就是它在编
VI
PART VI · 第六部分

个人
作业一

找到和你工作最相关的三个技能,用它们做出一样东西
VI要交什么

个人作业一:三个技能,一件作品

找三个

搜出和你的工作最相关、最重要的三个技能,装上跑通

讲清楚

每个写三样:来源description 原文为什么你觉得它重要

做一件

用这三个技能完成一个作品:报告、演示文稿、数据看板或网页

交上来

存成 md 或 html,上传作业平台「个人作业一」

第 4 次课末报名加抽人展示。上台用第 3、4 次课新学的东西,说一条怎么改进它
VI举个例子 · 一

web-research 当例子

web-research / SKILL.md · 头三行原文
--- name: web-research description: Use this skill for requests related to web research; it provides a structured approach to conducting comprehensive web research ---
VI举个例子 · 二

它的正文,分三步干活

I

先写计划

把问题拆成 2 到 5 个不重叠的子课题,存成一份 research_plan.md

II

分头去查

每个子课题派一个子代理,最多三个同时查,每个只许搜 3 到 5 次,结果各存一个文件

III

合成报告

读完所有子课题的发现,写成一份带引用链接的报告,并写明还缺什么

第二步那个「分头去查」,就是第 5 次课要讲的多子代理。今天先会用,那天再拆开看。
VI举个例子 · 三

作业里,一个技能这样写

个人作业一.md · 技能二(示意,数字换成你自己的)
## 技能二:web-research 来源:GitHub · LangChain 社区,非官方。原本写给另一套工具,WorkBuddy 里要先试小样 描述原文:Use this skill for requests related to web research; … 为什么重要:我每月写一份【区域信贷政策简报】,最费时间的是找近三个月的 政策原文、核发布日期,每次【约 4 小时】。它先拆子课题再分头查,每条带链接, 我只需要核来源 怎么验的:抽三条结论点开原文,【3 条里对上 2 条】,对不上的那条已删 在作品里干了哪一段:简报第一节「政策梳理」
「为什么重要」要写到哪件活、多久一次、省在哪一步。写「提高效率」不算。
VII
PART VII · 第七部分

三个组
上来讲

每组 10 分钟,讲完我和大家提问。到点打断
VII讲什么

只讲这四件事

题目要说清什么
为什么选这个场景现在谁做多久一次、每次多长时间几个人、卡在哪一步
指望 AI 做哪一段对应上午四个介入深度的哪一层:起草/核对/汇总/建议
工作流程怎么走三到五步;哪一步交接、哪一步必须人工确认、哪一步现在数据拿不到
做成了是什么样一条能判定过与不过的验收口径。「提高效率」不算
说不出频次和耗时的场景不要拿上来讲。这两个数字是最后一天做效率对照表的基线,现在没有,那天也拿不出来。
VII怎么挑

选场景要过四道关

够不够高频

这个月还要再做几遍?一年一次的不做

有没有标准

什么样算合格说得清吗?说不清就没法验收

我判断得了吗

自己是不是内行?最容易被忽略的一关

砸了会怎样

先挑返工级别的练手,别拿出事级别的

第三关的意思是:它交回来一份东西,你看得出好坏吗?看不出,就是把判断权交出去了。
VII其余十一组

没上台的组,也别放松

VII课后

课后要做四件事

做什么谁做交到哪什么时候
更新《场景讨论卡》V2
不交就默认沿用第一版
组内一人交即代表全组作业平台 · 小组任务下次课课前
开始探索本组场景怎么用 AI 实现全组不用交,第 3 次课接着做下次课前
完成个人作业一每人作业平台 · 个人作业下次课课前
课间问卷每人作业平台 · 问卷今天课后

下次课见

W2 上午 · 造自己的技能,给它接上数据
下次课你会做出你的第一个 SKILL.md
张一帆 · 中山大学岭南学院 · 经济金融 AI 智能体设计