Attention
Is All You Need
一篇论文之后的世界
面向零 AI 基础教育工作者的入门课。真实案例,录屏演示,可带走的方法与工具。
深圳欧美同学会 · 深圳留学人员联谊会
主讲 李雨林 · 深圳欧美同学会副秘书长 · 世青峰理事长
v4.0 · 2026-09
论文首页
Vaswani 等,Attention Is All You Need,2017-06-12,arXiv 1706.03762,第 1 页
序章 · 一篇论文之后 · 2017,一个翻译问题世青峰 CGYS02

2017:一个翻译问题,打开新的可能

八位作者用十五页解决一个翻译问题。三个数字,说明它在 2017 年的规模。

图 2 · 论文原件:作者栏与脚注、训练条件、翻译结果
arXiv 1706.03762 · 第 1 页与第 8 页 · 脚注写明八位作者贡献相同、署名顺序随机。Table 2 记录英德 28.4、英法 41.8;正文另一处写 41.0,论文自身不一致。

看什么

作者栏下那行小字:贡献相同,顺序随机。一项改变很多事的研究,署名方式很朴素。

三个数字

8 块 P100 计算卡,较大的版本训练 3.5 天,英法翻译 41.8。这是 2017 年一项实验的条件,不是今天训练任何模型的条件。

对你意味着什么

它解决的是让句子里相隔很远的词也能建立联系,并且能并行训练。后面的九年,是很多人把这种可能变成可用的东西。

arXiv 1706.03762 · 摘要、§1、§5.2、§6 Table 2长期有效 · 核验 2026-09-05
序章 · 一篇论文之后 · 同一个词,为什么含义不同世青峰 CGYS03

同一个"苹果",为什么会有不同含义

模型看一个字,要看句子里别的字。看哪几个、看多重,由整句话算出来。下图是真实模型的计算结果。

图 3 · 两句话里"苹果"两个字一模一样,模型看的对象完全不同
bert-base-chinese · 第 4 层第 5 个注意力头 · 行是正在处理的字,列是它看向的字 · 颜色越深看得越多 · 去掉句首句尾符号与句号后按行归一化。这一个头是 144 个头里最能体现这一区分的,其他头各看各的(有的看相邻字,有的看标点)。头平均后大部分权重落在句首句尾符号上,这是已知现象(Clark et al., 2019)。

看最深的格子

第一句里,"苹"这一行最深的格子在"吃",权重 0.63。第二句里,最深的格子在"机",权重 0.57。同一个字,句子不同,参照的对象随之改变。

它在算什么

模型没有查词典。它把"苹"与句中每一个字逐一比较,算出该参照谁。论文标题里的 attention 说的就是这一步:关系每次重新算。

对你意味着什么

给它的每一句话,都在改变它接下来参照什么。材料给对,它参照的方向才对。

人的阅读还带着经验、目的和情感。这里只是借机器的结果来比较,不是说两者一样。

计算:本机运行 bert-base-chinese(Google,2018),数据 样页/attn2.json · Vaswani et al. 2017 · Clark et al. 2019, arXiv 1906.04341长期有效 · 核验 2026-09-05
序章 · 一篇论文之后 · 看完它看谁,再看它把词变成了什么世青峰 CGYS03A

同一个"苹果",被句子推到了两个地方

模型里,每个词先是词表上的一串数,两句话里的"苹果"完全相同。经过十二层注意力,它吸进了周围的词,一个走向水果,一个走向手机公司。这是真实模型算出来的。

图 3A · 同一个"苹果",两句话里走出两条路(十二个词的向量压到二维)
bert-base-chinese · 起点为词表向量,之后为每层输出,按最后一层拟合坐标 · 两个方向共解释 43% 的差异 · 进入本页自动播放,点图重放 · 锚定词各放在一句普通话里,取该词各字向量的平均,先归一化只看方向。二维只保留差异最大的两个方向,点的远近作方向参考,不作精确距离。

看两个"苹果"

起点是同一个点,相似度 1.00。到第 12 层,第一句的"苹果"与水果一组的相似度 0.82,与公司一组 0.50;第二句的反过来,0.680.78。两个"苹果"之间降到 0.67

它在算什么

每一层都做一遍上一页的事,看该看的词,把它们的信息按权重加进自己的那串数。十二层下来,这串数装的不再是"苹果"这个词,是"这句话里的苹果"。

对你意味着什么

模型里没有一个固定的"苹果"。您给它的每一个词,都在把别的词往某个方向推。材料给对,推的方向才对。

向量是模型内部的一串数,这里把 768 个数压成 2 个来看。人理解词还带着经验和情感,这里只借机器的结果做比较。

计算:本机运行 bert-base-chinese(Google,2018),脚本 样页/vec2d_compute.py,数据 样页/vec2d.json · Vaswani et al. 2017 · Devlin et al. 2018, arXiv 1810.04805长期有效 · 核验 2026-09-13
序章 · 一篇论文之后 · GPT 的 T 是什么世青峰 CGYS03B

GPT 的 T,就是这篇论文里的 Transformer

ChatGPT 名字里的 GPT,全称 Generative Pre-trained Transformer。T 是 2017 年这篇论文里的结构,2018 年 OpenAI 只取了它的一半,先读书,再一个字一个字往下写。

图 3B · 从 2017 年的 Transformer 到 2018 年的 GPT,三个字母各指什么
Vaswani et al. 2017 图 1 · Radford et al. 2018 §3.1、§4.1 · 进入本页自动播放,点图重放

T · Transformer

2017 年论文里的结构。左边编码器读进整句,右边解码器一个字一个字写出译文。上一页的热力图来自 BERT,用的是编码器那一半;GPT 用的是解码器那一半。

P · Pre-trained,预训练

2018 年 6 月,OpenAI 让一个 12 层的解码器先读完七千多本书,任务只有一个,看前文,猜下一个字。读完再去做具体的事。

G · Generative,生成

它交出来的每一个字,都是在前文之后算出的最可能的下一个字。从 ChatGPT 到 GPT-6,做的仍是这件事,只是读得多得多,写得稳得多。

对你意味着什么

名字里没有"理解",也没有"知识"。它写得顺,靠的是猜下一个字猜得准。P14 讲它为什么会错,根子在这一步。

Vaswani et al. 2017, arXiv 1706.03762 图 1 · Radford et al. 2018, Improving Language Understanding by Generative Pre-Training, OpenAI, §3.1、§4.1 · Devlin et al. 2018, arXiv 1810.04805 · OpenAI, GPT-4 Technical Report, 2023, arXiv 2303.08774 §2长期有效 · 核验 2026-09-13
序章 · 一篇论文之后 · AI 早已存在,为什么后来走到每个人面前世青峰 CGYS04

AI 早已存在,为什么后来走到每个人面前

人工智能研究了七十年,多数时间留在实验室和专业软件里。2022 年之后,用它不用学软件,只要会提问。

图 4 · 达到一亿用户所需的时间
UBS 引 Similarweb 数据,2023 年 2 月公开报道 · 二手来源,按月活计 · 这里量的是有多容易用,量不出有多聪明。

对你意味着什么

两件事同时发生:不用为每个任务单独训练一个模型;入口变成对话框。前一件是 2017 年之后的研究,后一件是 2022 年的产品。缺一件,它都到不了每个人面前。

表里六个节点是七十年里的六个瞬间,不是全史。每一个都能回答"当时能做什么",也都回答不了"为什么普通人用不上",直到最后一行。

事件当时能做什么对使用者来源
1956Dartmouth 暑期研究提案提案原句:让机器模拟学习与智能的各个方面专家写规则斯坦福存档 jmc/history/dartmouth
1966ELIZA 对话程序按模板把用户的话改成问句看起来在聊天Weizenbaum, CACM 1966
1997深蓝战胜卡斯帕罗夫穷举搜索加人写的评估只会下棋IBM
2012ImageNet 竞赛 AlexNet错误率 15.3%,第二名 26.2%看图开始靠得住Krizhevsky et al. 2012
2017Transformer词与词的关系能算,训练能并行研究条件变了arXiv 1706.03762
2022ChatGPT对话入口,两个月一亿月活普通人直接用openai.com/index/chatgpt
Reuters/UBS 2023-02-01 · 各条目一手来源见表会变的信息 · 以官方页当日为准 · 核验 2026-09-05
序章 · 一篇论文之后 · 每个节点只问一件事:这时,我能怎样使用它世青峰 CGYS05

九年,改变了我们能交给 AI 的工作

上行是研究与模型,下行是产品与使用,常相隔一到两年:2017 年的论文,2022 年才成为普通人能用的对话产品。

图 5 · 2017–2026:研究与模型、产品与使用,两条线上的关键节点,以及每个节点对使用者意味着什么
专门功能2017–2021

翻译、分类,各自训练一个模型。普通人用的是产品里的一个功能。

对话协作2022–

改一段话、解释一个概念、"太难了换种讲法"。一次回答之后能接着说。

多种信息形式2024–

一张作业照片、一幅历史图像、一段口语,都能成为讨论对象。

连续任务2025–

查资料、算时间、处理文件、根据中间结果继续,最后交出一份文档。

以后看到新发布,只问一个问题:我原来自己接着做的哪一步,现在可以交给它参与。

arXiv 1706.03762 · openai.com/index/chatgpt · hello-gpt-4o · introducing-chatgpt-agent · arXiv 2501.12948 · ai.meta.com/llama · openai.com/index/gpt-6-astra · "两个月一亿人"为公开报道口径会变的信息 · 每年补节点 · 核验 2026-09-05
序章 · 一篇论文之后 · 我的工作方式变了,为什么还需要招人世青峰 CGYS06

我的工作方式变了,为什么还需要招人

AI 是一支听人指挥的团队,不是更聪明的搜索框。学会指挥它,人的认知也得跟着升一级。

李雨林
龙岗区政协委员 · 深圳欧美同学会副秘书长
海归人才联络中心主任 · 世青峰理事长
计算机科班,长期在一线用 AI 做真实上线的系统
做过的事2022 年以前怎么做现在怎么做
人才触达平台找外包团队,按月计自己带一支 AI 团队做出来并上线
全球人才数据库人工整理,只能做一小块多 Agent 工作系统持续采集与维护
对外材料与研究自己写,实习生查初稿当天出,自己核引用、定判断
敏感数据处理不敢用云端服务本地开源模型,全程断网

这一页留下的问题

AI 能替掉这么多活,我们为什么还在招人。先记着,尾声用前面的案例回答。

行易知难

孙中山《孙文学说》,1919。《尚书》说"非知之艰,行之惟艰",他把这句话倒了过来。今天机器把"行"接了过去,这四个字成了事实。

本人经历 · 2026-09讲师经历 · 本人确认 · 核验 2026-09-05
第一章 · 认识你的 AI · 同一个模型,三种入口世青峰 CGYS07

模型的能力,怎样变成手里的产品

同一个模型装进不同入口,能做的事不同。选入口,看它能不能接上手头的材料和工具。

对话 · Chat人问,它答
Kimi 网页版 kimi.com · 2026-09-07 截图
能联网、读上传的文件、跑代码、记住历史。读完 15 页 PDF(实测 01),算 45 个分数(实测 07),引用过去的会话(实测 12)。
工作台 · Work给目标,交回文件
Kimi Work 桌面端 · 官方产品页 2026-09-07 截图
连着本地文件夹,按规范多步执行,能定时跑。Kimi PPT 读规范、联网核对、出 10 页(实测 02)。腾讯 WorkBuddy 同类。
编程 · Code在文件夹里干活
Kimi Code 命令行 · 官方页 2026-09-07 截图
读代码、改文件、跑命令、批量处理。飞书命令行读收件箱、建三封草稿不发送(实测 08);这套课件的页面脚本与 54 页导出,由编程工具在本机完成。Qoder、Claude Code 同类。
入口给它什么它交回什么要注意
对话一句话、一个文件、一个链接一段回答,或一份文件它记得什么、读到了什么,要看轨迹
工作台一个目标,一个文件夹做完的文件,放回文件夹目标要大,完成条件要清楚;发送由人确认
编程一个文件夹,一句要求改好的文件、跑完的批量只在可撤回的地方试;先列对照表再执行

裸模型也能在本机跑,讲到本地部署时再看。概念在问题解决之后再命名。

三张截图为官方页面与网页版实际界面,2026-09-07 · 证据见实测 01 / 02 / 07 / 08 / 12 · 产品名属会变的信息,以官网当日说明为准实测记录 · 会变的信息 · 核验 2026-09-07
第一章 · 认识你的 AI · 第一次卡住:只说"写一个教案"世青峰 CGYS08

只说"帮我写一个教案",它给出什么

两次真实输出并排。不给条件,它反问五个问题,附一份通用模板;条件写清,直接给完整教案。

输入一
帮我写一个教案
需要一些具体信息才能写出贴合你需求的教案。请告诉我: 教学主题是什么?教学对象是谁?课时长度?需要包含哪些要素?风格偏好? 如果你现在就想看一个通用教案模板参考: 课程名称(待填)· 授课对象(年级/专业)· 课时 ____ 分钟 教学过程:5 分钟 导入 · 15 分钟 新知讲解 · 15 分钟 互动/实践 · 8 分钟 总结反馈 · 2 分钟 作业布置 它的思考过程里写着:"根据对话历史,用户之前有过一些教育相关的请求(第 39 条:AI 句子理解课教案)"
输入二
你是课程设计师。请为一节 45 分钟的课出一份教案:对象是大一非计算机专业学生,主题是"AI 是怎么读懂一句话的"。要求:恰好 3 个学习目标、1 个课堂互动、1 个课后作业。直接给教案,不要先问我问题。
教案:AI 是怎么读懂一句话的 授课对象 大一非计算机专业学生 · 课时 45 分钟 一、学习目标(恰好 3 个):能解释三个层次;能辨析人类阅读与 AI"阅读"的差异;能评估一个 AI 语言应用的局限 二、教学流程:导入 5 · 切蛋糕(分词)10 · 贴标签(词向量)10 · 看前后(注意力)12 · 互动「谁是关键词」5 · 小结 3 三、课后作业:「AI 翻车现场侦探」300–500 字 全文 约 2,400 字,一次给出。

左侧"根据对话历史"那句,说明产品把过去的会话当背景用。同一句话,换个账号,回答就不同。

实测 12(2026-09-05)与实测 10(2026-09-04),Kimi K3,会话链接与全文随课程材料提供实测记录 · 核验 2026-09-05
第一章 · 认识你的 AI · 第二次卡住:它不知道这批学生是谁世青峰 CGYS09

上下文:把它这次需要的材料准备好

模型这次能用的,只有放到它面前的材料。训练时学的知识,和这次给它的材料,是两回事。

这份备课任务,我放到它面前的材料清单 · 每一项都写上标题和用途
材料清单 · 45 分钟"AI 是怎么读懂一句话的"
对象 大一非计算机 · 上次课已讨论搜索引擎 · 只希望学生能用两个例子解释"同一个词要结合相关信息理解"
① 课程大纲本课在整门课里的位置;这一节只到"看前后"为止,不讲训练
② 学生情况没有编程基础;上次课讨论过搜索引擎;常见困难是把"AI 懂了"当成"AI 有常识"
③ 允许使用的教材片段"苹果"两句例句;论文第 1 页摘要的中文转述
④ 交付要求三个目标、一个互动、一个作业;先给流程,不急着写全部讲稿
⑤ 复述检查让它先用三句话复述:这次课给谁上、重点是什么、不能偏到哪里。跑偏就先纠正,不等整份教案写完
三个容易混淆的地方

记忆:产品可能记住使用者的偏好和历史(引用过去会话就是一例),教材却不会一份份存着。重要条件直接写进任务。

Token:它处理文本的小块,也是很多产品计费与限长的单位。桌面有容量,传得再多,也不保证每一处都读到。

新对话:任务换了大方向,另开一个,把必要条件重新带过去。

看什么

五项材料里,前四项是给它的,第五项是让它证明读到了。复述跑偏,说明材料没摆好,不是它"不聪明"。

意味着什么

把这些叫作它的工作台,也就是上下文。桌上有这次的要求、历史对话、上传材料、工具刚查到的结果。

对你意味着什么

先给与任务最相关的一小部分,写清标题和用途。材料越对,它看的方向越对。这是"苹果"那张热力图在更大尺度上的样子。

材料清单为本课备课任务的真实条件;记忆证据见实测 12;Lost in the Middle(Liu et al. 2024, TACL)说明长材料未必全部被用到长期有效 · 核验 2026-09-05
第一章 · 认识你的 AI · 第三次卡住:说了,但没说清世青峰 CGYS10

Prompt:从一句请求到一份任务说明

两条真实提示词逐项拆开。第二条多出的,是五个只有自己能定的条件。

条件"帮我写一个教案""你是课程设计师。请为一节 45 分钟的课出一份教案……"为什么它定不了
对象大一非计算机专业学生决定用什么例子、避开什么术语
目标主题"AI 是怎么读懂一句话的"决定讲到哪一层为止
材料(这次没给,第二稿时补了上次课内容与例句)决定它是复述通用知识还是用自己的材料
交付恰好 3 个学习目标、1 个课堂互动、1 个课后作业决定结果长什么样、能不能直接核
这一步做到哪直接给教案,不要先问我问题决定它是先问还是先做

岗位说明书

长期不变的要求:优先面向初学者,概念先用例子解释,不用公式。很多产品能单独设置;没有也可以写在开头

今天的任务单

这一次的对象、时长、材料、交付、做到哪一步。每次都写,因为每次都不一样

不需要特殊句式

"互动有趣"过宽,改成"学生必须先选一个解释,再用句子里的信息说明理由",活动就具体了。把心里的标准写出来

两条提示词均为实测原文(实测 12、实测 10)长期有效 · 核验 2026-09-05
第一章 · 认识你的 AI · 第四次卡住:它自己没有手世青峰 CGYS11

Tool:让回答接上资料、计算与软件

模型本身不能读网页、计算或打开文件。接入工具后,下面三条是它实际执行的过程,每一步都有记录。

读一篇 15 页 PDF
实测 01 · Kimi K3 · 2026-09-04
  1. 01
    web_open_url打开 arXiv 1706.03762 的 PDF 链接
  2. 02
    逐页读取15 页全文进入工作台
  3. 03
    列三级大纲3 模型架构 → 3.2 注意力机制 → 3.2.1 缩放点积……
  4. 04
    出 5 道选择题并标页码思考里写着"需要估算页码"
  5. 回原 PDF 逐题查:1 道页码错,1 道我判错第 5 题标 p.9 实为 p.8;第 3 题标 p.3 我起初以为错,原文 p.3 §3.1 已讲目的
算 45 个学生的成绩
实测 07 · Kimi K3 · 2026-09-04
  1. 01
    解析三个班的数据从对话文本里读出 45 个整数
  2. 02
    运行 Python 代码均分、样本标准差、四分位
  3. 03
    用箱线图法判异常值Q1−1.5×IQR 与 Q3+1.5×IQR 之外
  4. 04
    画箱线图加散点A 班 45 分被单独标出
  5. 本地 Python 独立复算:三班全部一致78.13 / 82.07 / 76.00;12.19 / 5.22 / 14.34
把大纲做成 10 页 PPT
实测 02 · Kimi PPT · 2026-09-04
  1. 01
    读 SKILL.md、pptd.md先读产品内置的排版规范
  2. 02
    读 slides_categories.md选"教学"类版式
  3. 03
    搜索网页核对"Attention Is All You Need Table 2 BLEU 28.4 41.8"
  4. 04
    生成 10 页,页脚自动标 arXiv 号约 6 分钟
  5. 第 8 页写 41.8,它的大纲写 41.0回原文:摘要与表格 41.8,正文 41.0,论文自身不一致
三条轨迹的步骤名取自实测会话记录(实测 01 / 07 / 02),会话链接见各实测记录实测记录 · 核验 2026-09-05
第一章 · 认识你的 AI · 第五次卡住:一步做完,下一步谁定世青峰 CGYS12

Agent:做完一步,再决定下一步

列出计划,不算完成计划。右侧真实记录里,它三次核算时间,前两次不足 45 分钟就重新分配。

左 · 一段流程整体交出去
  1. 0:00
    接到目标按十条大纲生成 10 页教学 PPT,学术风格,白底
  2. 0:10
    读规范SKILL.md、pptd.md、slides_categories.md、education-training.md
  3. 2:30
    发现数字要核,主动联网搜索 Table 2 BLEU、ConvS2S、GNMT 成本
  4. 5:50
    交回 10 页,每页标 arXiv 号第 8 页写英法 41.8
  5. 它的大纲写 41.0,幻灯片写 41.8两个数都"在原文里"。不回原文,不知道该用哪个
实测 02 · Kimi PPT 模式
右 · 根据中间结果再决定
  1. 第一次
    3+10+12+8+5+2+1 = 41"还有 4 分钟,可以给活动一或活动二更多时间"
  2. 第二次
    3+3+3+4+12+10+5+2+1 = 43"还有 2 分钟机动"
  3. 第三次
    3+7+13+11+6+3+2 = 45"对。"随后输出流程表
  4. 交回
    理论讲授 37 → 12 分钟,学生动手 5 → 24 分钟连同一张"时间转出"表一起交回
  5. 两边相加各为 28 分钟,一致"12 分钟"是它自己的说法,引用时照此
实测 14 · 教案第二稿 · 它的思考过程原文

这类工作方式通常称为 Agent。它未必是个新界面,说的是怎样组织工作。目标可以大,完成条件要清楚;交之前让它按条件自查一遍,这一步最便宜也最管用;缺材料、缺权限或要教师判断时,就停下来交回。

实测 02 的步骤时间为会话记录中的相对时间;实测 14 的三次相加为 Kimi 思考过程原文实测记录 · 核验 2026-09-05
第一章 · 认识你的 AI · 下一次还要备课,怎么把做对的留下来世青峰 CGYS13

Skill:把一套好做法留给下一次

做对一次的方法,不该只留在那次对话里。把任务说明、修改要求、认可的样例存下来,下次直接用。

可复用任务说明 · 本课练习册原文 · 每次换掉【】里的内容

我想完成【具体任务】,给【使用者】使用。目的是让对方能够【解释、判断或完成什么】。

这次依据的材料是【粘贴或附上材料】。已有条件是【背景、时间、限制】。

请先给出【一个小样或第一部分】。缺少影响方案的关键条件时先问我。条件充分时先做小样。交付前对照以上条件自查一遍,把没做到的列出来。

修改要求模板

这一处【原句或具体位置】不适合,因为【对象、事实、目标或条件】。请按【明确方向】修改,并说明主要改动。

随模板一起保存

一份自己认可的样例(比如第二稿的流程表);适合什么任务、要准备什么材料;核对重点(时长相加、页码、引用)。

岗位说明书示例(本课备课任务所用)

你是课程设计师。对象是大一非计算机专业学生。先给流程再给全文。缺关键条件先问我;条件够就直接做,不要先问。

本课的核对清单

时长相加是否等于要求的分钟数;每个页码回原文翻一次;每条引用点开一次;看它的思考里替我补了什么条件;发送、付款、删除三件事留给自己。

看什么

这份模板里没有特殊技巧。它把对象、目标、材料、交付、做到哪一步写成了填空。

意味着什么

工具支持 Skill 或自定义指令的,就把它存进去;只有普通对话框,存成一份文档也一样。存的是做法,不是答案。

对你意味着什么

一个月后手里该有三样东西:任务说明、好样例、核对清单。尾声的修行清单就围绕这三样。

这一章五个概念到这里齐了:上下文、任务说明、工具、持续执行、可复用做法。名字都是在解决问题之后才出现的。

本课练习册原文长期有效 · 核验 2026-09-05
第一章 · 认识你的 AI · 它为什么会错世青峰 CGYS14

它为什么会错:实测记下的五种错误

五种错误都出自真实运行。类型不同,核法不同;先认类型,再定怎么核。

场景它给的实际错在哪一类怎么核
读长文档出题第 5 题在第 9 页第 8 页。它在思考里写"需要估算页码"。第 3 题我起初判错,它标的 p.3 是对的猜位置:读到了内容,位置靠估;核的人也会错回原文按页翻,核不上时再翻一遍。题库要抽查页码与选项
做 PPT 引数字大纲写英法 41.0,幻灯片写 41.8论文摘要与表格 41.8,正文 41.0,原文自身不一致来源冲突:两个数都有据,它没说明选了哪个看它引的是哪一处;上台前自己定用哪个数
录音变纪要摘要 2,536 字,待办 0 条一场 1 小时 27 分的会议,不可能没有待办漏项:摘要给得出,待办不一定抽得出待办自己列;用它的摘要对照,不反过来
一句话出图示意图右侧写"预测结果:明天"输入是"今天天气真好适合出去游玩",接"明天"语义不通似是而非:结构对、标注对,细节经不起读每个字都读一遍;示意图只当示意
缺条件时提示词丢了字数限制,它写"我按 150 字来控制"没说,它就替人定了自补条件:不总是反问看它的思考里补了什么条件

阅读与整理可直接用;位置、来源、漏项、细节要核。模型每次都在算最可能的答案,并非时而聪明、时而糊涂。

实测 01 / 02 / 09 / 03 / 13,原始记录随课程材料提供实测记录 · 每次开课重跑 · 核验 2026-09-05
第一章 · 认识你的 AI · 要它交回哪一种世青峰 CGYS15

回答、作品、任务:要它交回哪一种

多数人停在"回答"这一级,能力已经到了"任务"这一级。这段落差,就是今天的认知差。

口语陪练:四处纠错全对回答
实测 05 · Kimi K3 · 文字对话
lead→led、learn→learned、study in→at、it have→has。回答这一类,当场就能核。
板书示意图:能进课件,一处要改作品
实测 03 · 即梦 5.0 Pro · 1920×1080
作品这一类,核的是每一个细节;"预测结果:明天"这种要一个字一个字读。
收件箱 3 封 → 分三档 → 3 封回复草稿

紧急·今天回:【教务处】大纲截止提醒
本周:【教学发展中心】研讨会报名
可稍后:【教材出版】再版意向

草稿箱:3 · 已发送:0
命令:lark-cli mail +reply(默认存草稿)
发送需显式 --confirm-send,本次未加
邮件:起草到草稿箱为止任务
实测 08 · 飞书邮箱 CLI
任务这一类,核的是每一步的状态;发送键留给人。
实测 05 / 03 / 08实测记录 · 核验 2026-09-05
第二章 · 把一件事交给它 · 调度:哪件事该交给它世青峰 CGYS16

看一眼自己的一周,选一件可以先试的事

不是每件事都适合先交给它。先试的那件要满足三条:材料在手、结果可核、出错代价小。

一周里的事材料在手结果能核出错代价建议本课对应
把一章教材变成练习题能(回原文)先试P23
给一节新课出初稿能(自己就是专家)先试P17–18
整理一批文献的地图能(点开引用)先试P24
一张成绩表看分布能(复算)先试P25
课堂开场的一段短片能(看一遍)可试P23
回复一批邮件能(读草稿)起草可试,发送自己点P26
会议录音变纪要部分(待办自己列)可试P26
给学生批改并反馈难(逐份核)后试P33
财务与报销表别交
替人操作电脑改文件能(可撤回)看操作先在可撤回的地方试P26

交不交,再问三句:自己做要多久,它做对的概率多高,从交代到核完总共多久。自己慢、它准、核得了,就交。

课程判断;对应页的证据见各页长期有效 · 核验 2026-09-05
第二章 · 把一件事交给它 · 初稿之后,老师看什么世青峰 CGYS17

一份教案,怎样从初稿改到能用

初稿三十秒内生成,结构、时长、活动、作业齐全。能否使用,取决于教师看出哪一处不合适。左为真实输出,右为三处判断。

Kimi K3 · 2026-09-04 · 输出全文 约 2,400 字 · 此处节选提示词:为大一非计算机学生设计 45 分钟课"AI 是怎么读懂一句话的",3 个目标、1 个互动、1 个作业
教案:AI 是怎么读懂一句话的
授课对象 大一非计算机专业学生 · 课时 45 分钟 · 副题 从"认字"到"懂意思"的三层秘密
一、学习目标(恰好 3 个)
  1. 能解释 AI 理解句子要经过"分词→找关系→联上下文"三个层次,并用生活类比说明至少一个
  2. 能辨析 人类阅读与 AI"阅读"的核心差异(AI 没有生活常识,依赖统计规律)
  3. 能评估 一个日常 AI 语言应用的局限,并用课堂概念说明它"读懂"或"没读懂"的原因
二、教学流程(45 分钟)
导入 · 一句话的"旅行":板书"苹果不好玩",同一句话人靠常识秒懂5 分3
第一层 · 切蛋糕(分词):"南京市长江大桥"两种切法10 分
第二层 · 贴标签(词向量):意思相近的词在"数学空间"住得近10 分1
第三层 · 看前后(注意力):"味道"和"好"最相关,给重要的词打高分12 分
课堂互动 · 「谁是关键词」:3 位学生代表"书 / 作业 / 笔",台下举手投票决定连线粗细5 分2
小结 · 人类 vs AI:AI 不是"理解"了句子,而是"算出了"最可能的含义3 分
合计45 分
三、课后作业 · 「AI 翻车现场侦探」
找一个 AI 处理语言的例子,记录输入与输出,用三个层次分析它在哪一层"翻车"。300–500 字,下次课随机抽 2 人分享。
四、板书核心框架(原文)
读懂一句话 = 正确的切法 + 准确的词义 + 词与词的关系网
1
时间给了名词,没给学生

三层讲解占 32 分钟,学生自己动手只有互动那 5 分钟。今天希望学生掌握的是"为什么一个词要结合具体信息来理解",那就要让他们自己完成一次解释,时间得转过去。

2
活动很好,概念要补一句

投票连线能帮助讨论语义,但学生投出来的线不是模型内部真正的计算。保留活动,加一句"这是帮助理解的示意"。

3
通用、正确,没有老师自己的味道

它开场也用了苹果。任何老师问它都会拿到这一份。所以下一步要给它老师自己的材料:上次课讲过什么,这批学生卡在哪。

我的修改要求(原话)保留苹果的例子,缩短切块和数字表示的讲解。让学生两人一组,自己选一个可能有不同意思的词,各造一句话,圈出帮助判断含义的信息。最后换一组新句子,每个人独立说明理由。按这个目标重排活动,保持 45 分钟,并说明哪部分时间转给了学生。
实测 10(2026-09-04)· 原始输出与会话截图随课程材料提供 · 人工核验:结构符合四项约束,各环节时长相加为 45 分钟实测记录 · 每次开课重跑 · 核验 2026-09-04
第二章 · 把一件事交给它 · 第二稿回来了世青峰 CGYS18

第二稿:时间转给学生了多少

同一条修改要求发回去,它交回新流程表和时间转出表。理论讲授 37 分钟压到 12,学生动手 5 分钟加到 24。

第一稿 · 2026-09-04
环节分钟
导入 · 苹果不好玩教师5
切蛋糕(分词)教师10
贴标签(词向量)教师10
看前后(注意力)教师12
互动 · 谁是关键词学生5
小结教师3
教师讲解 37 分钟 · 学生动手 5 分钟
第二稿 · 2026-09-05
环节分钟
导入 · 保留苹果例子教师3
三层速览 · 只讲概念教师7
活动一 · 两人一组自选多义词造句,圈出判断依据学生13
活动二 · 三个新句子独立写词义与依据,同桌互评学生11
全班验证 · 人工注意力网络快速版师生6
小结 + 作业教师5
教师讲解 12 分钟 · 学生动手 24 分钟 · 过渡 4 分钟
28分钟
从五个讲解环节转出(导入 2、分词 8、词向量 8、注意力 9、小结 1),与新增活动 13+11+4 相等
5 → 24分钟
学生动手与表达的时间,按它自己的说法
45分钟
两稿各段相加都是 45,我核过
实测 14(2026-09-05)· 同一会话追加修改要求 · 流程表与时间转出表为原文实测记录 · 每次开课重跑 · 核验 2026-09-05
第二章 · 把一件事交给它 · 演示一,录屏世青峰 CGYS19

演示一:把任务说清楚

同一件事,先一句话请求,再用完整任务说明,比两次输出;再提一处修改,看第二稿改了什么。

#录屏里发生什么请注意
新会话,只输入"帮我写一个教案"它反问了什么;模板里有几处"(待填)"
新会话,粘贴那条 45 分钟教案的完整任务说明对象、目标、交付、做到哪一步,各体现在输出的哪一行
指出初稿的一处问题,发出修改要求第二稿改了什么,没改什么
小结条件写清,才得到自己的那一份

录屏

2026-09-05 录制,Kimi K3,三段会话;对应会话见实测 12、10、14。

任务说明模板 · 学员课后照抄,换掉【】

我想完成【具体任务】,给【使用者】使用。目的是让对方能够【解释、判断或完成什么】。

这次依据的材料是【粘贴或附上材料】。已有条件是【背景、时间、限制】。

请先给出【一个小样或第一部分】。缺少影响方案的关键条件时先问我。条件充分时先做小样。交付前对照以上条件自查一遍,把没做到的列出来。

提一处修改

这一处【原句或具体位置】不适合,因为【对象、事实、目标或条件】。请按【明确方向】修改,并说明主要改动。

课后

用自己的一件事,照模板走一遍,保留原材料、任务说明、第一版、修改要求、第二版。尾声的修行清单从这里开始。

实测 12 / 10 / 14 · 录屏随课程材料提供实测记录 · 每次开课重录 · 核验 2026-09-05
中场 · 休息世青峰 CGYS20
中场休息
第三章 · 今天能做什么 · 十件事,一套做法世青峰 CGYS21

十件事,一套做法

行易知难。做,机器越来越会;知道它能做什么,还得靠人。十件真事,同一套做法;最后一列是核对后的结论。

#场景我给它的它给我的我核了什么结论
01读长文档15 页论文链接 + 三项要求三级大纲 + 5 题带页码逐题回原文查页码:三次运行,两次各错 1 处,一次全对(记录 15)题库需核对
02做 PPT十条大纲10 页学术白底与它自己的大纲比对:41.0 vs 41.8上台前需核对
03做图一句话1920×1080 板书示意图逐字读标注:"明天"不通示意图需核对
04做视频一句话10 秒 720P看一遍:顺序对试用
05陪练带四处错的回答逐条纠错 + 改写 + 发音提示四处全对可用
06深度研究一个问题带引用的综述 + Markdown 文件点开两条:真,一条有更正引用需核对
07数据45 个分数均分、标准差、异常值、箱线图本地复算:一致统计可用
08邮件3 封三档 + 3 封草稿草稿箱 3,已发送 0草稿需核对
09纪要1 小时 27 分录音2,536 字摘要待办 0 条待办需核对
10做小工具一句话:对象、主题、题数单文件练习网页:5 题 + 评分 + 解析本地打开作答提交:80 分,解析全显示;自补"用时 8 分钟"可用,题目需核对
11本地模型三句话小结的要求三句话切题、无事实错误、断网可用
实测 01–11 汇总实测记录 · 每次开课重跑 · 核验 2026-09-05
第三章 · 今天能做什么 · 用它的四层世青峰 CGYS22

用它的四层:问答、交任务、铺轨道、建档案

多数人停在第一层。往上每走一层,交出去的从一句话变成一个目标、一套固定做法、一份自己的档案;判断这一步,留在自己手里。

给它什么它交回什么这门课的真实例子留在人这里的
一 · 问答一句话一段回答"苹果"为什么有两种含义(序章热力图);口语纠错四处全对(实测 05)判断对不对
二 · 交任务五项条件加材料一份能用的初稿教案第二稿,学生时间 5 → 24 分钟(实测 14);45 个分数的分布(实测 07)看出教案哪里不合适;比较分数前先问试卷、分制、缺考
三 · 铺轨道一条固定的任务说明加核对清单,可重复每次都稳的产物Kimi PPT 按规范文件多步执行(实测 02);同一提示词跑三次(实测 15)哪些步骤全交,哪些一起做
四 · 建档案岗位说明书加个人档案,放在它面前每个新会话都从使用者的情况开始空提示词时它引用了过去的会话(实测 12);讲师自用的档案结构(附录选读)不能替人定的事,不能出门的材料

第一层今天就会;第二层是这门课的主体;第三层和第四层,是回去一个月要做的事。

实测 02 / 05 / 07 / 12 / 14 / 15 · 四层为讲师归纳长期有效 · 核验 2026-09-05
第三章 · 今天能做什么 · 阅读与表达世青峰 CGYS23

长材料:五道题的页码核对

一章材料交给它,大纲和题目可用,页码要逐题核:跑三次,两次各错一处,一次全对。大纲直接切成课件,仍是研究者的语言。

它出的五道题,我逐题回原文核
#题目它标实际
1缩放点积注意力里,为什么把点积除以 √dkp.4p.4
2关于多头注意力,下列说法正确的是p.5p.5
3解码器里 Mask 的主要目的是什么p.3p.3对,我起初判错
4本文采用的位置编码方式是p.6p.6
5英德翻译上 big 模型的 BLEU 与训练成本p.9p.8
实测 01 · Kimi K3 · 输入 arXiv 1706.03762 全文 15 页 · 它在思考里写着"需要估算页码"。第 3 题我起初判在 p.5,回原文发现 p.3 已讲目的,撤销。同一提示词 9 月 6 日再跑两次:第 2 次 4 对 1 差一页,第 3 次自己核了分页后全对,三次读法各不相同(记录 15)。跑一次看不出可靠不可靠,三次才看得出错法。
同一份材料,再让它做成 10 页课件
#页标题(真实输出)
01什么是注意力:让每个词有选择地"看向"别的词
02为什么要缩放:不除以 √dk,softmax 会被推到梯度近零
03多头:在多个子空间里同时建立词与词的联系
04位置编码:注意力本身看不出词序
06并行:搬掉循环结构,整个计算变成一次矩阵乘法
08结果:英德 28.4、英法 41.8 BLEU
09它为什么会错:学到的是统计关联,不是事实
10对教学的启发:讲机制、代价与边界
实测 02 · Kimi PPT · 标题为真实输出 · 给研究者的大纲直接切成十页,仍然是研究者的语言。对象要重新告诉它。
实测 01 / 02(2026-09-04)· 重复运行记录 15(2026-09-06,三次)· 页码核对用 PyMuPDF 在原 PDF 逐处检索实测记录 · 核验 2026-09-05
第三章 · 今天能做什么 · 研究与数据世青峰 CGYS24

深度研究:二十分钟,抽查两条引用

一个问题,二十分钟,得到带引用的综述。引用要逐条核:抽查两条都是真的,其中一篇后来发过正式更正,摘要里看不出。

它给的报告结构
部分它写的要点(原文节选)
四大分歧点批判性思维:认知卸载派与 U 型关系调和派;学术诚信与评价范式;教师角色"双师"与工具化批评;公平与数字鸿沟
近三年进展政策规模化(教育部等五部门《"人工智能+教育"行动计划》);教学模式化;证据综合化(多项元分析效应量从 0.39 到 1.10 不一致);素养框架建构
六处研究空白纵向证据缺乏、人文类通识核心课实证稀薄、高阶素养测评工具缺位、师资激励研究不足、公平议题缺本土实证、课程体系整合理论薄弱
实测 06 · Kimi 深度研究 · 约 20 分钟 · 问题:AI 在高校通识教育中的应用
我抽了两条点进去
它引的核的结果备注
Gerlich 2025 · Societies英国 666 名参与者,AI 使用频率与批判性思维负相关。该文后来发布过一份正式更正(doi 10.3390/soc15090252),摘要层面看不出来
教育部等五部门《"人工智能+教育"行动计划》教科信〔2026〕1 号,2026 年 4 月印发,教育部、发改委、工信部、科技部、国家数据局
人工核 · 2026-09-04

对你意味着什么

真伪之外还有版本:更正、撤稿、后续研究。它给的是一张材料地图,进入材料还是要自己走。

实测 06(2026-09-04)· 会话链接与两条核验记录见实测 06实测记录 · 核验 2026-09-05
第三章 · 今天能做什么 · 研究与数据世青峰 CGYS25

三个班均分只差六分,分布完全不同

45 个分数全部绘出,比三根柱子更清楚。先看分布,再决定下一步;均分是起点,不是结论。

图 26 · 三个班全部 45 个分数(构造数据),竖线是均分,浅色带是均分上下一个标准差
A、B、C 各 15 人 · 分数 40–100 · 异常值按箱线图法(Tukey)判定 · 数据为课堂构造,不对应真实学生。计算由 Kimi K3 调用 Python 完成,本地独立复算一致(右表)。
它算的均分复算它算的标准差复算
A78.13一致12.19一致
B82.07一致5.22一致
C76.00一致14.34一致

意味着什么

B 班均分最高,也最集中,多数人在 75 到 90 之间。C 班均分最低,也最分散,既有 54 也有 99。A 班被一个 45 分拉低,去掉它均分是 80.5。同样叫"平均 78 分",下一步教学并不相同。

比较之前先问三件事

三个班用的是同一份试卷吗。分制一样吗。缺考是空着还是按零分录入。这三件,数据里没有,系统也不该替它们编。

实测 07(2026-09-04)· 它自述判定标准:落在 Q1−1.5×IQR 与 Q3+1.5×IQR 之外 · 本地 Python 复算三班全部一致实测记录 · 核验 2026-09-04
第三章 · 今天能做什么 · 事务与操作世青峰 CGYS26

事务与操作:邮件、纪要与一个小工具

读,它来;起草,它来;发出去、列待办、上线,人来。三件事务同一套分工,核的东西各不相同:草稿箱的数字,待办的条数,页面上的每一道题。

收件箱 3 封 → 三档 → 3 封回复草稿

紧急·今天回:【教务处】大纲截止提醒
本周:【教学发展中心】研讨会报名
可稍后:【教材出版】再版意向

草稿箱 3 · 已发送 0
命令默认存草稿,发送需显式确认,本次未加
邮件:读与分档它做,发送键我没按需核对
实测 08 · 飞书邮箱命令行 · 三封为虚构教学场景邮件
核什么:草稿箱与已发送的数字;每封草稿读一遍再决定发不发。
1 小时 27 分会议 → 2,536 字摘要

分层小标题加时间线,五分钟出
待办提取:0 条

摘要给得出,待办不一定给得出
纪要:摘要可用,待办自己列需核对
实测 09 · 飞书妙记 · 本人 2026-08-24 的会议,内容不入课件
核什么:待办自己列一遍,再用它的摘要对照。
小工具:一句话,一个能打开的练习网页可用,题目需核对
实测 16 · Kimi K3 · 约两分钟 · 单文件 11.6 KB · 无外部链接 · 课堂放两分钟录屏
核什么:本地打开作答,80 分,解析逐题显示;它自补了"建议用时 8 分钟",提示词里没有。

把重复动作交给系统的三个条件:可重复、可核对、可撤回。发送、付款、删除不满足最后一条,留给人。过去做网页要一位会写网页的人,现在隔着的是这一句话。

实测 08 / 09(2026-09-04)· 实测 16(2026-09-06)· 邮件原文、草稿、纪要数字与网页产物随课程材料提供实测记录 · 每次开课重跑 · 核验 2026-09-06
第三章 · 今天能做什么 · 提示词的骨架世青峰 CGYS27

提示词的骨架:流传的框架都在说同五件事

网上流传的十二种提示词框架,字母各异,拆开都是同一套五项条件,外加一个角色、一份样例。记不住字母,记住五件事就够。

框架它的要素对应到本课的五项条件
APE行动、目的、期望交付、目标、交付
TAG任务、行动、目标交付、交付、目标
ERA期望、角色、行动交付、角色、交付
RACE角色、行动、上下文、期望角色、交付、材料、交付
RISE角色、输入、步骤、期望角色、材料、这一步做到哪、交付
CARE上下文、行动、结果、示例材料、交付、交付、样例
COAST上下文、目标、行动、场景、任务材料、目标、交付、对象、交付
TRACE任务、请求、行动、上下文、示例交付、交付、交付、材料、样例
ICIO指令、背景、输入数据、输出引导交付、材料、材料、交付
ROSES角色、目标、场景、解决方案、步骤角色、目标、对象、交付、这一步做到哪
BROKE背景、角色、目标、关键结果、试验改进材料、角色、目标、交付、修改要求
CREATE角色、要求、示例、调整、输出类型、额外角色、交付、样例、修改要求、交付、条件

角色对应工具箱里的岗位说明书,样例对应自己认可的那份好结果,修改要求对应那份教案的三处判断。写不全五件事,就让它先问。

十二种框架为公开流传的写法,出处不一,本页只做要素对照 · 五项条件:对象、目标、材料、交付、这一步做到哪(第 10 页)长期有效 · 核验 2026-09-05
第三章 · 今天能做什么 · 去掉 AI 味世青峰 CGYS28

去掉 AI 味:先改要求,再改稿子

同一个请求,加一段写作要求,机器味少了,但减不干净。剩下的靠人改:删排比,删金句,删"不是而是",把套话换成具体的例子。

不加写作要求
实测 17 · Kimi K3 · 2026-09-11 · 提示词:为一门面向高校教师的 AI 入门课写 200 字课程介绍
2017年,一篇题为《Attention Is All You Need》的论文悄然发表,几年后,它成了ChatGPT、Claude等大模型的共同起点。本课程面向零基础的高校教师,不预设任何编程或数学背景,从一个真实的研究故事讲起:这篇论文想解决什么问题?"注意力"究竟是什么意思?它如何改变了AI理解语言的方式?我们将结合课堂答疑、论文批改、文献阅读等教学场景中的真实案例,用类比和演示代替公式,帮助您看懂大模型的底层逻辑,理解它为何强大、又为何出错。学完本课,您将能够自信地谈论AI,并把它作为教学工具真正用起来。
加一段写作要求
同一提示词,加:不用三连排比,不用段末金句,不用冒号引出判断,不用"不是……而是……",不用"赋能""助力""全方位""重塑",先例子后术语,句子短,像一个人在说话
2017年,谷歌的八位研究者发表了一篇论文,标题有点狂:《Attention Is All You Need》。当时没多少人意识到,这篇文章后来会长成ChatGPT的技术底子。这门课就从这篇论文讲起。我们会看机器怎么读一句话,比如"苹果"为什么有时候是水果,有时候是公司,再回头看我们自己平时怎么跟AI打交道,哪些用法有效,哪些用法白费力气。课上没有公式推导,也不需要编程基础,所有概念都从日常例子入手。学完你会清楚一件事:AI能做什么、做不到什么、以及在你的课堂和研究里,它值不值得用。适合从没碰过技术背景、但对AI好奇的老师。
痕迹怎么改本课手册通稿时
三连排比留一个,删两个删去十余处
段末金句删掉,或换成一个例子删去十余处
冒号引出判断把判断写成一句平常话右栏仍剩一处
"不是……而是……"只留肯定的那一半9 处减到 1 处
万能词:赋能、助力、全方位、重塑换成具体动作全部替换
万能主语"它""我们"写清谁在做"它"315 处减到约 185 处

看什么

右栏好在哪:一个例子(苹果),一句实话(有点狂),短句。还差在哪:末尾仍有一句冒号引出的总结。

对你意味着什么

把这段写作要求存进岗位说明书,每次都带上;交回来仍按左边那张表过一遍。

实测 17(2026-09-11)· 两段均为 Kimi K3 原文 · 六种痕迹与改法为本课通稿规则,数量为本课手册编辑记录实测记录 · 每次开课重跑 · 核验 2026-09-11
第三章 · 今天能做什么 · 同一个模型,换个流程世青峰 CGYS29

设计工作流:同一个模型,换个流程

一句话写到尾,与拆成写、跑、调、修再循环,同一个模型,通过率差近一倍。流程定好,前期费力,之后又快又稳。

图 29 · 同一编程测评上,同一模型两种流程的通过率
0%50%100%GPT-3.5 · 一句话写完48.1%GPT-4 · 一句话写完67.0%GPT-3.5 · 写、跑、调、修,循环95.1%
HumanEval · Andrew Ng, The Batch, 2024-03-20 · 单一测评,数字为原文 · 一句话写完:给题目,直接交答案。写、跑、调、修:写完自己运行,看报错,改,再运行,直到通过。变的是流程,不是模型。

第一步,拆

拿出每周都在重复的一件事,拆成小步骤。备课这件事拆开是五步:材料清单,初稿,三处判断,第二稿,存模板。

第二步,每步分三类

全交给它、和它一起、自己来。初稿全交;第二稿和存模板一起做;材料清单和三处判断自己来。

第三步,先给"全交"的步骤铺轨道

为这些步骤写专门的任务说明和核对清单,投入最少,回报最大。备课那份教案的任务说明,就是这样一条固定做法;存成模板,就是它的 Skill。

这一页讲分工。判断那一步自己做。

Andrew Ng, "Agentic Design Patterns Part 1", The Batch, deeplearning.ai, 2024-03-20(GPT-3.5 零样本 48.1%,GPT-4 零样本 67.0%,GPT-3.5 加代理流程 95.1%,HumanEval)· 拆步骤与三类分工为讲师归纳长期有效 · 单一测评 · 核验 2026-09-05
第三章 · 今天能做什么 · 各家模型,怎样分工世青峰 CGYS30

各家模型与产品:按手里的任务分工

优缺点随版本变,本页不排名。按任务看谁接得上手里的材料与工具,再用同一份小材料比一次。下表为 2026 年 9 月各官网说明与本课实测。

家族官网主打(2026-09)本课实测适合先试注意
Kimi · 月之暗面长文本;K3;课件、深度研究、Work、Code读长文档、数据、教案、综述、小工具(实测 01–07、12–17)读长材料、备课、综述页码靠估;引用要点开
DeepSeek推理模型 R1;开放权重未实测推理题;可本地部署许可以官方页为准
通义千问 · Qwen(阿里)开放权重全系列;听悟做纪要本地 Qwen3.8-27B 断网运行(实测 11)敏感材料本地处理机器要求见下一页
豆包 · 即梦(字节)语音通话;即梦出图出视频即梦 5.0 Pro 出图、Seedance 十秒短片(实测 03、04)示意图、短片、口语语音本课未测
文心(百度)· 智谱 GLM对话产品;GLM 有开放权重版本未实测备选入口以官网当日为准
ChatGPT · OpenAIGPT-6 Astra;agent;操作电脑未实测;尾声读它的发布任务型、跨软件的活分批开放
Claude · Anthropic长文档;Claude Code本课件的脚本与 56 页导出由 Claude Code 完成编程、批量、长文档
Gemini · Google多模态;NotebookLM未实测把录音、文件、图片放在一起读

怎样自己比

同一份小材料,两个入口,同一条任务说明,看哪个结果更贴近用途、改了什么。一次比较比任何榜单可信。

先用熟一个

建立提出要求和反馈的手感,再按具体缺口加第二个。多数教师从一个能读文件、能联网的对话入口开始就够。

名字会变

表里的产品名与主打,属于会变的信息。三个月后请按官网当日说明重看,本课的方法不变。

各产品官网 2026-09 说明 · 本课实测见各记录 · "未实测"即本课未运行,不作评价会变的信息 · 以官方页当日为准 · 核验 2026-09-05
第三章 · 今天能做什么 · 本地部署:基础搭配世青峰 CGYS31

从云端到本地:一台笔记本,全程断网

敏感材料不能离开本机时,开放权重模型可以下载到自己的机器上跑。基础搭配看三样:内存决定模型规模,软件负责运行,模型从官方库下载。

本机运行的开放权重模型
实测 11 · Qwen3.8-27B · MLX 6-bit · 48GB 内存 · 断网 · 2026-09-04 · 提示词:用三句话写一段课堂小结,主题:AI 是怎么读懂一句话的。对象:大一非计算机专业学生。语气:下课前跟学生聊天。
121token
生成长度
9.4token/秒
生成速度
23.1GB
峰值内存
手里的机器能跑的规模够做什么
笔记本 16GB 内存4 到 8B 参数,4-bit改写、摘要、翻译,速度可接受
笔记本 32 到 48GB14 到 32B,4 到 6-bit本课这台:27B、6-bit,每秒 9.4 个 token
台式机加 24GB 显存显卡30B 级 4-bit;70B 级要更多显存或很慢本地处理整份文件与批量任务
软件:LM Studio、Ollama,Mac 上可用 MLX · 模型来源:Hugging Face、魔搭 ModelScope · 经验搭配,以各软件官方说明为准

两类模型

开放权重(常叫"开源")可下载、可断网、材料留在本机,如 DeepSeek-R1、Qwen3、Llama,许可各异;闭源服务只通过网页或接口用,如 GPT-6 Astra、Claude。本课十件事用的 Kimi K3 属后者,这台笔记本属前者。学生数据、未发表研究、内部文件,就在门里处理;代价是它不知道今天的事,读不了没给它的文件。

实测 11(2026-09-04)· 运行指标为界面原始输出 · 搭配为经验口径,以各软件官方说明为准 · 开放权重与开源的区分见 opensource.org/ai · 图片理解本次未跑实测记录 · 搭配与许可为会变的信息 · 核验 2026-09-04
第四章 · 回到大学 · 同一份材料,怎样形成一节好课世青峰 CGYS32

备课三步走:初稿、判断、第二稿

第二章的教案走完了三步:初稿它写,判断人做,第二稿它改。三步中只有中间一步不能交出。

一 · 初稿(它)
实测 10 · 30 秒 · 约 2,400 字
  1. 目标
    能解释、能辨析、能评估三个动词,恰好三个
  2. 流程
    5 · 10 · 10 · 12 · 5 · 3讲解 37 分钟,学生 5 分钟
  3. 互动
    「谁是关键词」投票连线好活动,概念要补一句
  4. 作业
    「AI 翻车现场侦探」300–500 字,可直接用
二 · 判断(人)
三处,来自教学经验,不来自技术
  1. 1
    时间给了名词,没给学生目标是学生自己完成一次解释
  2. 2
    连线是示意,不是模型计算护住活动,补一句准确性
  3. 3
    通用、正确、没有自己的味道给它这门课的材料:上次课、这批学生
  4. 把三处写成一条修改要求目标、保留什么、希望看到什么变化
三 · 第二稿(它)
实测 14 · 同一会话 · 只要流程表
  1. 流程
    3 · 7 · 13 · 11 · 6 · 3 · 2讲解 12 分钟,学生 24 分钟
  2. 活动一
    两人一组自选多义词造句,圈依据13 分钟
  3. 活动二
    三个新句子独立判断,同桌互评11 分钟
  4. 两稿相加都是 45;转出 28 = 新增 28它的算术它自己核了三次,我又核一次

换成自己的学科:文学先列人物关系与不同读法,再选一处细读;管理先整理案例角色与决策,再设计一个要取舍的问题。材料换了,三步不变。

实测 10 / 14实测记录 · 核验 2026-09-05
第四章 · 回到大学 · 课堂助教世青峰 CGYS33

课堂助教:先写护栏,再交给学生

一项已发表的随机对照研究给出方向:教师先写好脚手架与护栏,再把对话框交给学生。

194名学生
哈佛物理课,2023 年秋季学期;233 人注册,194 人纳入分析
以上
AI 辅导组的学习增益,相对课堂主动学习组
49分钟
AI 辅导组中位用时,少于课堂时长,并报告更高的投入感
项目这项研究怎么做的
设计交叉设计:同一批学生轮流经历两种条件,一周在课堂做主动学习,一周在宿舍用 AI 辅导
AI 辅导基于大模型,但由教师预先写好分步骤讲解、提示与护栏,限制它直接给答案,也限制它胡编
测的是什么两个主题(表面张力、流体流动)的前后测
局限单一课程、单一学期、精英大学、不到两百人;作者与报道都说不能推广

看什么

效果来自教师写的脚手架加上模型的耐心。同一个模型,不写护栏,结果未必如此。

对你意味着什么

课堂助教先从一个最小任务开始:把已经会讲的一段解释,写成它能照着讲的脚手架,规定它什么时候不给答案。

别做什么

不要让它批改并直接把分数发给学生;批改是核不完的活,代价大。

另一项研究(Bastani 等,2025)显示不同使用设计对独立表现的影响不同:没有护栏的直接问答,练习时表现好,独立考试时未必。尼日利亚一项六周课后辅导试点(世界银行,2025)学习增益约 0.3 个标准差,前提同样是教师设计的结构化引导。

Kestin, Miller, Klales, Milbourne, Ponti. Scientific Reports 15, 17458 (2025), doi 10.1038/s41598-025-97652-6,PMC 全文核过 · "更高的投入感"据 Hechinger Report 报道 · Bastani et al. 2025, PMC12232635 · De Simone et al., World Bank, 2025-01-09单一研究 · 不推广 · 核验 2026-09-05
第四章 · 回到大学 · 科研全流程世青峰 CGYS34

科研全流程:七段里哪几段能交

科研七段,从选题到评审。找资料、算数据、改句子能交给它;规矩已经写在那里,先看规矩。

阶段能交给它本课证据自己做规矩(2023 年起)
选题列候选问题,找分歧点深度研究给出四大分歧点(实测 06)定值得做的问题
文献综述初稿,引用清单抽查两条引用都真,一篇有正式更正(实测 06)逐条点开;查更正与撤稿科技部:未经核实的 AI 生成参考文献不得直接使用
研究设计列可选方案与各自缺陷一个议题三个角色各陈理由(实测 13)选方案,定边界
数据统计、画图、复算45 个分数三次统计完全一致(实测 07、15)比较前的三个问题;数据不出门科技部:依规使用,防范伪造篡改数据
写作初稿,改句,翻译去 AI 味对照(实测 17)观点与判断科技部:AI 生成的关键内容须标注并说明生成过程
投稿格式,投稿前自查披露Nature 2023:AI 不能署名,须在方法或致谢中说明;科技部:不得列为完成人,须披露软件名称、版本与使用时间
评审不建议把稿子交给它科技部:评议中使用须事先征得组织者同意,防止泄漏评议内容

问题、判断、署名,留在人这里。

科技部监督司《负责任研究行为规范指引(2023)》,2023-12-21,原文本轮核对 · Nature 613, 2023-01-24 社论 · 实测 06 / 07 / 13 / 15规矩为会变的信息 · 做法长期有效 · 核验 2026-09-11
第四章 · 回到大学 · 评价怎么改世青峰 CGYS35

评价怎么改:先分级,再看过程

知识一问就有,考知识的题就要少。先给每次作业定允许级别,再把过程与判断变成可评的东西。分级有现成框架,规矩已有先例。

AI 评价量表(AIAS):五个允许级别
允许什么交什么
1 不用 AI全程不用只靠自己的知识与技能
2 帮构思头脑风暴、搭结构、提改进建议终稿里不得有 AI 写的内容
3 帮修改改清晰度与质量,不得新增内容附上无 AI 内容的原稿
4 它做,学生评AI 完成指定部分学生评论它的输出;AI 内容须标注
5 全程用作为副驾驶贯穿全程支持自己的工作,说明用法
Perkins、Furze、Roe、MacVaugh,2023 年 12 月,2024 年修订 · 每次作业先写明级别,学生知道边界,老师知道该评什么。
把过程变成可评的:本课已经用过的五样
做法评什么
交提示词与修改记录原材料、任务说明、第一版、修改要求、第二版,五样齐不齐
口头解释一个关键选择为什么这样改;换一个例子当场做
AI 使用声明软件、版本、用在哪一步;科技部对研究者的要求,照搬给学生
先自己写,再让它批写下自己的判断,再看它的反面证据
按四条看结果有没有编造已发生的数据;是否遗漏重要对象;行动是否具体;是否符合指定用途
演示一的模板、演示二的判断标准、尾声的做法 · 哈佛那项研究里,效果来自教师写的脚手架;评价也一样,来自教师先定的边界。
Perkins et al., The AI Assessment Scale (AIAS), arXiv 2312.07086 v2(2024-04),JUTLP 21(6) 2024,原文本轮核对 · 科技部《负责任研究行为规范指引(2023)》 · 本课 P19 / P36 / P41框架长期有效 · 校规为会变的信息 · 核验 2026-09-11
第四章 · 回到大学 · 演示二,录屏世青峰 CGYS36

演示二:用学科材料完成一次协作

图书馆延长开放案例:先让它以三个角色各陈述理由,再写一份 200 字建议并指出缺少的信息。

#录屏里发生什么请注意
粘贴案例材料,要求三个角色各陈述一段理由,并列出共识、分歧与待弄清的问题三段理由是否编造了尚未发生的数据
读分歧点与两个待弄清的问题与右侧"判断结果时看"四条对照
追加:给负责人写一份 200 字建议,缺少的日期、地点、联系人留待填是否遗漏重要对象;行动是否具体
小结材料换成自己的学科,四步不变

录屏

2026-09-05 录制,Kimi K3;对应会话见实测 13。课后用自己的一段学科材料重复这一过程,保留原材料、任务说明、第一版、修改要求、第二版。

案例材料 · 讲师演示用 · 情境与数据全部为课堂构造,不对应真实学校
图书馆是否延长开放时间

一所大学拟试行图书馆延长开放。学生代表提出希望自习区开放到 23:00;图书馆工作人员指出现行闭馆 22:00,延时需要另排人员。学校准备先在期末前两周试行,记录入馆人数、座位使用、人员安排与学生反馈。当前没有延时试行的实际数据。部分学生希望每天延时,另一些更希望改善白天座位管理。

三种任务
  1. 给学生设计一个 5 分钟讨论活动,区分材料中的事实、意见和待验证问题
  2. 给负责人写一份 200 字建议,比较两种可行安排,明确还需要什么信息
  3. 给学生写一则通知草稿,说明试行范围和反馈方式;缺的日期、地点、联系人留待填
判断结果时看

有没有编造已发生的数据;是否遗漏重要对象;行动是否具体;是否符合指定用途。

本课练习册 · 实测 13 · 录屏随课程材料提供实测记录 · 每次开课重录 · 核验 2026-09-05
尾声 · 认知与价值观 · 怎样读一次发布世青峰 CGYS37

怎样读一次发布:以 GPT-6 Astra 为例

读一次发布,拆开看三样:厂商自己报的分数,用词是谁定义的,那句话是谁在什么场合说的。主意自己拿。

图 37 · OpenAI 报告的三项结果:上一代 GPT-5.6 Sol 到 GPT-6 Astra
百分比 · 取厂商在不同推理设置下报告的最高结果 · 测评环境与日常产品不同 · OSWorld 2.0 为离线子集、部分得分(v2026.08.08);AutomationBench 是自动化任务评估,不能读成"岗位替代率";100 减去分数也不等于现实工作的失败率。
机构定义 · OpenAI Charter
AGI:高度自主,并在多数有经济价值的工作上超过人类的系统。
这是一家公司的定义,不是各方共用的标准。
人物发言 · Greg Brockman · 2026-09-03 媒体简报 · Axios 报道
"Welcome to the AGI era."
这是发言人对技术节点的判断,不是模型自己宣布,也不是学界共识。
开放条件
先向企业客户分批开放;它在 OpenAI 自家安全框架里达到了网络安全"关键"级别。手里的产品开放到哪一步,用之前再查。

哪些任务能交给系统

整理一组材料、比较观点、做成报告、按反馈改。原来要在几个软件之间自己接起来的活。事实 · 基于当前能力

岗位怎样重新组合

一个人加一支 AI 团队。我们还在招人。推断 · 讲师团队的经历,不推广到所有行业

因成本下降出现的新需要

以前只来得及给全班一份练习,现在能准备三种难度。哪些以前做不起的事,现在值得做。价值选择 · 自己定

openai.com/index/gpt-6-astra(2026-09-03)· openai.com/charter · axios.com 2026-09-03会变的信息 · 以官方页当日为准 · 核验 2026-09-05
尾声 · 认知与价值观 · 技术平权:那堵墙塌了世青峰 CGYS38

那堵墙塌了:技术从稀缺变成基础设施

过去,"我有一个想法"与"这件东西真的存在"之间,隔着一个技术团队和一笔预算。现在中间隔着的,是愿不愿意坐下来,把它讲清楚。

前面一百分钟讲的这些,如果只留一个结论:

过去挡在"想到"和"做出来"之间的那堵墙,塌了。

5 → 24分钟
一份教案,学生动手时间从第一稿到第二稿的变化 · 实测 14 · Kimi K3
约 20分钟
一份带引用的研究综述,抽查两条引用都真 · 实测 06 · Kimi 深度研究
270 亿参数
一台 48GB 内存的笔记本上断网运行的模型 · 实测 11 · Qwen3.8-27B

技术从稀缺资源变成基础设施,像水,像电。这些事过去各需要什么,见手册 7.1。墙塌了以后,多出来的是能做的事。

实测 06 / 11 / 14 · 七件事对照表见学员手册 7.1 · "技术平权"为通行表述实测记录 · 讲师判断 · 核验 2026-09-05
尾声 · 认知与价值观 · 工作更容易完成以后,新的需要从哪里来世青峰 CGYS39

为什么还在招人:变的是任务,不是整个岗位

工具每变一次,人追求的东西就往上走一层。约一百万次对话里,57% 的任务人参与迭代与核验,43% 整段交出去。

图 39 · 使用占比最高的六类职业任务,以及任务层面的增强与自动化
Anthropic Economic Index,2025-02-10 · 一家公司平台的匿名使用数据,不是全社会统计 · 增强 57%:人在回路里迭代、学习、核验;自动化 43%:整段交出去。教育与图书馆类任务占 9.3%,排第三。约 36% 的职业至少四分之一的任务出现过 AI,约 4% 的职业四分之三以上任务出现过。

看什么

排第一的是计算机与数学,37.2%。教育与图书馆 9.3%,已经排到第三,高于办公行政。同行已经在用,用在任务上。

意味着什么

一个岗位是一堆任务。有的任务交出去了,有的任务多了人在旁边核。"36% 的职业至少四分之一任务"和"4% 的职业四分之三任务"两个数放在一起看,AI 换掉的是任务,没换掉整个岗位。

回答开场的问题

从 A 地到 B 地,最早只能走路,要求只有一个字,到。有了蒸汽机,追求快;有了电,追求省、舒服、准点。路还是那条路,要求变了。我们招人,因为能做的事比以前多了,招的是能理解需求、组织材料、看结果改做法的人。

走路到电力的类比为讲师归纳。数据是一家平台的记录;具体到自己的一周,变化得自己看。

anthropic.com/news/the-anthropic-economic-index(2025-02-10)· 数字为报告原文 · 类比与招人口径为讲师本人会变的信息 · 以官方页当日为准 · 核验 2026-09-05
尾声 · 认知与价值观 · 工具一样了,人为什么不一样世青峰 CGYS40

同一个工具,两种用法:差在认知

技术把人和人拉平了,认知把人和人拉开了。这里的认知很窄,只有两件事:定义问题,选择值得做的事。拉开的距离,跟账号权限、会员等级无关。

哪件事用法一用法二(本课记录)差在哪里
写教案只说"帮我写一个教案"(实测 12):通用、正确、没有自己的味道给材料清单与五项条件(实测 10 / 14):第二稿把学生时间从 5 分钟改到 24 分钟知道这批学生是谁;知道目标是解释,不是认识名词
看成绩三个班均分 78.1、82.1、76.0,相差六分,看似接近看分布(实测 07):A 班一个 45 分把均分拉低,去掉后 80.5知道均分会掩盖什么;比较之前先问是不是同一份试卷
用综述二十分钟的报告拿来就用点开两条引用(实测 06):都真,其中一篇有正式更正知道引用是最容易出错的地方
核页码相信它标的页码逐题回原文翻(实测 01 / 15):三次运行,两次各有一处页码错,一次全对知道位置靠估;也知道核的人自己会错
做课件接受第 8 页的 41.8回原文(实测 02):正文 41.0,表二 41.8,论文自身不一致知道来源冲突时要自己定口径

在座各位本来就是靠认知工作的人。对一个学科的理解、对学生状态的判断、对什么值得研究的直觉,在 AI 时代没有贬值。能写成说明书的部分它都能做,说不清楚的那部分才是各位的。

实测 01 / 02 / 06 / 07 / 10 / 12 / 14 · 判断句为讲师本人实测记录 · 讲师判断 · 核验 2026-09-05
尾声 · 认知与价值观 · 知识与认知,为什么要分开讲世青峰 CGYS41

知识可以交给它,认知不能:回到那份教案

知识是事实、公式、条文、步骤,可以检索、复制、交给系统。认知在这里只指两件事:定义问题,选择值得做的事。

第二章那份教案里,三样东西各在哪里
它写出一份 45 分钟的流程:3 分钟导入、10 分钟讲解、15 分钟互动、8 分钟总结

知识。结构正确,术语正确,一次给出约 2,400 字。这一段它能大量供应。

老师看出:时间给了名词,没给学生

认知。定义问题:这节课的目标是让学生自己完成一次解释。选择值得做的事:把时间转给学生。

写一条修改要求,第二稿把学生动手时间从 5 分钟改到 24 分钟

行动。第二稿它改,目标老师定;试教、看学生表现、修订,老师做;模板它帮着整理。

实测 10 / 14 · Kimi K3 · 2026-09-04 / 05 · 完整的四行对照表见学员手册 6.4 节。

知识是答案,认知是问题

它能给一万个答案,给不了一个值得做的问题。今天知识近乎免费,问一句就有。

知识是存量,认知是判断

存量可以下载,判断只能长出来。教案的结构和术语一次就有;时间该给谁,得看过这批学生才知道。

认知怎样长

下场做一件真事,认知只在要自己承担后果时才真的更新。定期把自己推翻一次,找出三年前深信、今天已不信的一条判断。先自己想,再问它;拿到答案先问两句,怎么验证,有没有反面证据。

2025 年一项脑电研究(MIT,54 人)里,用大模型写作的一组脑内连接最弱,研究者叫它认知负债。先想再问,是为了不欠这笔债。认知里能写清楚的部分,将来它也会接走;再往上,是价值观。

实测 10 / 14 · 知识与认知的区分为讲师归纳,认知按"定义问题、选择值得做的事"取窄义 · Kosmyna et al. 2025, arXiv 2506.08872(单一研究)· 四行对照表见手册 6.4长期有效 · 核验 2026-09-05
尾声 · 认知与价值观 · 知道了以后呢世青峰 CGYS42

行易知难:知道了,就是做到了

一百多年前的四个字,今天成了事实。机器把"行"接了过去,难的不是做到,难的是知道。

《尚书 · 说命中》
傅说对商王武丁 · 先秦

"非知之艰,行之惟艰。"

知道不难,做到才难。这是中国人两千多年的常识。

孙中山《孙文学说》
《建国方略》之一 · 心理建设 · 自序署 1918-12-30 · 1919 年刊行

"此思想之错误为何?即'知之非艰,行之惟艰'之说也。"
"由是而知'行易知难',实为宇宙间之真理。"

他把老话倒了过来:做事不难,难的是知道。那时是勉励人去做。

王阳明《传习录》卷上
徐爱录 · 初刻于 1518 年

"未有知而不行者。知而不行,只是未知。"

真知一定会发动为行动;没有发动,说明还没有真知。

Linus Torvalds · 内核邮件列表
LKML · 2000-08-25

"Talk is cheap. Show me the code."

那年代码稀缺。二十六年后技术圈把它翻了过来:Code is cheap. Show me your idea. 稀缺的一端换了位置。

按王阳明的标准,走出这个门之后什么都没变,就还没有"知道"。

《尚书·说命中》· 孙中山《孙文学说》1919(zh.wikisource.org 心理建设 自序、第五章)· 《传习录》卷上徐爱录 · LKML 2000-08-25 · "Code is cheap"为流行表述,不指定出处 · 引文为简体转写长期有效 · 核验 2026-09-05
尾声 · 认知与价值观 · 技术这一侧有区别吗世青峰 CGYS43

同一套架构,两种用途

所有找人、建立联系、持续沟通、推进转化的系统,技术上拆开都是同样四步。区别全在人这一侧。

四步全球人才引进(讲师团队在做的事)电信网络诈骗(公开反诈宣传中的通用描述)技术侧差别
找到联系方式公开的学术履历、会议名单、校友网络泄露或买卖的个人信息
建立联系邮件、社交平台、校友引荐冒充身份加好友
持续沟通了解研究方向、家庭考虑与回国意愿长期取得信任
推进转化对接高校与企业岗位,请人回中国发展诱导转账

同一套 AI 能力

可以帮一个学生找到方向,也可以骗走一位老人的养老钱。中间隔着的不是技术水平。

链条上最靠前的一环

在座各位教出来的学生,会拿着这些工具去做事。他们拿去做什么,与课堂上怎样讲"该做什么"有关。

说明

本页不涉及具体客户、个人信息与金额。反例只写到四步这一层,不含任何可复现的操作细节。

中间一列为讲师团队的实践 · 反例为公开反诈宣传中的通用描述,不引具体案例长期有效 · 讲师判断 · 核验 2026-09-05
尾声 · 认知与价值观 · 价值观决定世界走向世青峰 CGYS44
当技术什么都能实现的时候,
决定这个世界走向哪里的,是价值观。
Melvin Kranzberg, "Technology and History: Kranzberg's Laws", 1986 · 判断句为讲师本人长期有效
尾声 · 认知与价值观 · 两个半小时,三句话,一张纸世青峰 CGYS45

修行清单:一周做三条

两个半小时压回三句话:代码不再稀缺,稀缺的是你想做什么;行易知难;判断力和价值观,是老师能给学生的最后两样东西。

#场景第一步提示词(本课实测原文,缩写)本课用的工具结论
01读长文档请读这篇 PDF:列三级大纲;出 5 道选择题并标页码;指出两个易混概念Kimi K3需核对
02做 PPT按这份大纲生成 10 页教学 PPT,每页一句标题、三条要点,学术风格,白底Kimi PPT需核对
03做图一张《___》课的板书风格示意图:白底黑线,含中文标注,无装饰即梦 5.0 Pro需核对
04做视频生成一段 10 秒延时视频:一粒种子发芽,侧视剖面,固定机位,无文字即梦 Seedance 2.5试用
05陪练你是我的英语口语陪练,用大学面试场景问我三个问题,每答完一个纠正Kimi K3可用
06深度研究就"___"做一份研究综述:分歧点、近三年进展、研究空白,每条附来源Kimi 深度研究需核对
07数据期末成绩(已匿名)三个班:按班级画分布图;标异常值;给均分与标准差Kimi K3 · Python可用
08邮件读最近一周收件箱,按紧急度分三档,每封一句建议回复,只存草稿飞书邮箱 CLI需核对
09纪要把这段录音转成纪要:决定了什么、谁负责、什么时间、还有什么没定飞书妙记需核对
10做小工具做一个给学生用的课堂练习网页:对象、主题、5 道单选题、答完显示得分与解析、单文件Kimi K3可用

今晚一件事

把今天满意的那次对话存成模板,两分钟。它答得不满意的那一处,改进提问里。

一周三条

从左边十行里勾三条,本周做完。做完把满意的那次存成模板。

一个月一件真事

手册第八部分有四周计划。第一周完成一件真会用到的小事;第二周给常用的那条提示词配五条小测试集,换材料跑一遍再信;第四周请同事指出一个自己没看见的问题。一个月后按手册的问题回头看,没有一问是关于工具的。

继续学

"We can only see a short distance ahead, but we can see plenty there that needs to be done." Turing, 1950。学习入口见附录"继续阅读"。

师傅领进门,修行在个人。

提示词全文与补全版见学员手册工具箱 9.1 · 结论标签与第 27 页一致 · Turing, Mind LIX(236), 1950, p. 460实测记录 · 每次开课重跑 · 核验 2026-09-05
尾声 · 认知与价值观 · 知道了以后世青峰 CGYS46
行易知难
长期有效
尾声 · 认知与价值观 · 回到开场世青峰 CGYS47

Attention Is All You Need

开场是一个翻译问题,一路走到一份教案。论文里的注意力是处理信息的机制;当课程题目,它问的是人的问题。

我们走过的

研究方法怎样影响后来的能力;能力怎样通过对话、多种信息形式和工具走到普通人手里;一份备课任务里,模型、材料、要求、工具和合作过程各在哪一步出现。

回到同一件事

把工作说明白,看到初稿,提出修改,把有效做法留下来。

还回标题

开头那篇论文的标题,今天借来做了题目。八个人给机器的那种能力起名叫注意力,机器学会了看重点。各位教出来的学生会长成什么样,也看各位把注意力放在哪里。

谢谢各位老师。

arXiv 1706.03762长期有效 · 核验 2026-09-05
尾声 · 认知与价值观 · 谢谢世青峰 CGYS48
谢谢各位老师
答疑 · 把问题带回自己的学科世青峰 CGYS49

把问题带回自己的学科

先说明自己的学科和想交给它的那件事,再提问。

如果还没想好问什么

我的学科里,哪一类材料最适合先交给它。

如果已经试过

它替我决定了什么,我当时没看见。

如果在管一个团队或一门课

哪些工作可以定成"只到草稿箱为止"。

常被问到短答长答在哪
它会不会把我的材料拿去训练看产品条款;规则说不能出门的材料走本地P31
学生用它作弊怎么办先分清任务:练习时用与考试时用不同,把使用设计写进作业要求P33
哪个产品最好先问要回答、作品还是任务,再看接不接得上手里的材料P30
它说的对不对怎么知道位置、来源、漏项、细节四类错各有核法P14
会不会很快过时模型会换,材料、任务说明、核对、存模板这四步不换P13 · P45
老师会被替代吗变的是任务,不是整个岗位;判断和价值观交不出去P39 · P41 · P44
· 核验 2026-09-05
附录 · 选读 · 八位作者与后来的探索世青峰 CGYS50

八位作者与后来的探索

脚注写明贡献相同、顺序随机。九年后八人去了八个方向,是这篇论文之后的缩影。

作者2017 年在此后2026 年 9 月
Ashish VaswaniGoogle Brain创业Essential AI 创始人、CEO
Noam ShazeerGoogle Brain2021 创办 Character.AI;2024-08 回到 Google2026-06 离开 Google,加入 OpenAI
Niki ParmarGoogle BrainAdept、Essential AI 联合创始人2025-01 起在 Anthropic
Jakob UszkoreitGoogle Research创业Inceptive 创始人、CEO,用 AI 设计 RNA 药物
Llion JonesGoogle Research创业Sakana AI 联合创始人、CTO,东京
Aidan Gomez多伦多大学,实习生创业Cohere 联合创始人、CEO
Łukasz KaiserGoogle Brain加入 OpenAIOpenAI,参与推理模型与 GPT 系列
Illia PolosukhinGoogle Research创业NEAR 联合创始人

八位作者都已离开写这篇论文的地方。论文改变了模型,也改变了这些人能做什么。

各公司官网与公开报道,2026-09 · 人物去向为当期信息会变的信息 · 以官方页当日为准 · 核验 2026-09-05
附录 · 选读 · 商学院的例子:品牌出海世青峰 CGYS51

选读:商学院的例子,品牌出海怎么用它

出海也拆成同样几步:先让它列要查清的问题和去哪核实,再交一段文案的本地化,逐条核它给的机构与法规。清单能用,判断留给懂市场的人。

它列的问题(节选)与我核的结果
#要查清的问题它说去哪核我核的
1适用哪些 CE 协调法规,评估路径是什么EUR-Lex 指令原文;TÜV、VDE 等公告机构书面确认对:LVD 2014/35/EU、EMC 2014/30/EU、RED 2014/53/EU 均为现行指令
2是否指定了欧盟境内的 GPSR 责任人Regulation (EU) 2023/988 原文对,法规编号存在;适用日期本轮未打开原文,讲前核
3是否完成 WEEE 注册(ElektroG)Stiftung EAR 官网对:官网核,注册与境外厂商授权代表均为其职能
4是否完成包装法注册(LUCID)ZSVR 包装中央登记处对:官网原文"在德国销售带包装商品须在 LUCID 注册"
5智能功能的用户数据是否合规GDPR 原文;BfDI;各州数据保护局对,机构存在;网络弹性法生效日期以官方为准
6税务、担保与消费者法义务BZSt;BGB、ProdHaftG、PAngV 原文对,法条存在;2 年瑕疵担保为 BGB 通行规定
实测 18 · Kimi K3 · 2026-09-11 · 情境为课堂构造,不对应真实企业 · 核法:机构与法规名逐个查官网是否存在、是否管这件事;不核数字,因为要求它不给数字。
它改写的英文版 · 原文 · 三处文化调整

We are a smart home brand from Shenzhen, China. For over ten years, we have focused on small home appliances, and our products are now used in more than 30 countries. We build for reliability and durability. Technology that makes everyday life at home simpler.

它标出的三处调整

第一处,"匠心品质"不直译,改为可靠与耐用,它的理由是德国消费者看检测报告、质保年限与材料说明,不看形容词;第二处,"让科技温暖每一个家"改为让日常生活更简单,理由是强情感诉求在德国广告文化里被视为营销话术;第三处,"30 多个国家""十年"保留,但去掉"每一个"这类绝对化表达,理由是德国反不正当竞争法对事实性宣称要求可举证。三条理由是它给的判断,可信度由懂市场的人定。

对商学院与外语系的老师

同一套做法:材料(中文原文与市场)、任务(清单加改写)、核对(机构存在、说法准确)、存下来(这条提示词进模板)。

实测 18(2026-09-11)· 它给的机构与法规逐个核官网 · 情境为课堂构造实测记录 · 每次开课重跑 · 核验 2026-09-11
附录 · 备查 · 原始实测与修订记录世青峰 CGYS52

原始实测与修订记录

本课每一处"实测、已核、需核"均可回溯。记录在下列文件中,每次开课重跑一遍。

#场景工具日期记录文件核验方法
01读长文档Kimi K309-0401-读长文档-实测记录.mdPyMuPDF 回原 PDF 检索页码
02做 PPTKimi PPT09-0402-做PPT-实测记录.md与原文摘要、表格、正文三处比对
03做图即梦 5.0 Pro09-0403-做图-实测记录.md逐字读标注
04做视频Seedance 2.509-0404-做视频-实测记录.mdOpenCV 读分辨率、帧率、时长
05陪练Kimi K3(文字)09-0405-语音-实测记录.md逐条核纠错
06深度研究Kimi 深度研究09-0406-深度研究-实测记录.md点开两条引用,查更正
07数据Kimi K3 + Python09-0407-表格与数据-实测记录.md本地 Python 复算
08邮件飞书邮箱 CLI09-0408-收发邮件-实测记录.md列草稿箱与已发送
09纪要飞书妙记09-0409-录音变纪要-实测记录.md读摘要与待办字段
11本地模型Qwen3.8-27B09-0411-P54本地模型-实测记录.md断网运行,读界面指标
12空提示词Kimi K309-0512-空提示词教案-实测记录.md与实测 10 并排
13三角色Kimi K309-0513-图书馆三角色-实测记录.md核无编造数据
14第二稿Kimi K309-0514-教案第二稿-实测记录.md两稿各段相加、转出与新增相等
15重复运行Kimi K309-0615-重复运行-实测记录.md读长文档与数据各三次,页码逐题回原文,统计量本地复算
16做小工具Kimi K309-0616-小工具-实测记录.md本地打开作答、逐题读题、查外链
原始记录与事实台账随课程材料提供实测记录 · 核验 2026-09-05
附录 · 选读 · 给 AI 写一份个人档案世青峰 CGYS53

选读:给 AI 写一份个人档案

岗位说明书写的是它扮演谁,个人档案写的是它在为谁工作。五个文件,一次采访式填写,此后每个新会话都从这里开始,不必每次重新介绍自己。

教师个人 AI 档案 · 五个文件 · 本课自用的结构
01 关于我

身份与学科,这学期在做什么,AI 帮我时需要知道的基本背景。

02 我的学生与课程

对象是谁,常见困难在哪里,上过什么、没上过什么。

03 我的目标

这学期与这一年想做成的事,优先级与大致时间。

04 我的表达偏好

喜欢的长度、语气、格式;不喜欢的词语和写法;什么时候要它主动提醒。

05 我的原则与禁区

它不能替我定的事;不能编的内容;不能出门的材料;涉及学生数据时的要求。

怎样用

把五个文件放在一个文件夹里。对话产品里,粘到"自定义指令"或项目说明;工作台与编程工具里,放在工作目录,它会先读。

采访式填写 · 提示词 · 换掉【】

请通过采访的方式,帮我完成"个人 AI 档案"的五个文件:关于我、我的学生与课程、我的目标、我的表达偏好、我的原则与禁区。

规则:每次只问一个问题;问题短而具体;我答得模糊就追问,不替我猜;不收集证件号、账号、住址、健康记录;保留我的原话,只做必要整理,不要包装成正式文书。

每完成一个文件,先把准备写入的内容给我看,我确认后再写入,再进入下一个文件。

全部完成后,告诉我:哪些信息还薄弱,哪些需要定期更新,哪些前后有矛盾需要我确认。现在从"关于我"的第一个问题开始。

核什么

它有没有擅自补条件;有没有把口语改成套话;五个文件是否都经本人确认后才写入。

模板与提示词全文见学员手册工具箱 9.3 · 结构为本课自用长期有效 · 核验 2026-09-05
附录 · 选读 · 继续阅读世青峰 CGYS54

继续阅读:一手来源

只列官方文档、论文与一手课程页。先有一件正在做的事,再去阅读。

论文与研究
Vaswani et al. 2017, Attention Is All You Needarxiv.org/abs/1706.03762
Clark et al. 2019, What Does BERT Look At?arxiv.org/abs/1906.04341
Liu et al. 2024, Lost in the Middle, TACLaclanthology.org/2024.tacl-1.9
Yao et al. 2023, ReActarxiv.org/abs/2210.03629
DeepSeek-R1, 2025arxiv.org/abs/2501.12948
Kestin et al. 2025, Scientific Reportsdoi 10.1038/s41598-025-97652-6
Anthropic Economic Index, 2025-02-10anthropic.com/news/the-anthropic-economic-index
Morris et al. 2023, Levels of AGIarxiv.org/abs/2311.02462
课程与官方页
吴恩达 deeplearning.ai:AI Prompting for Everyone;Generative AI for Everyonedeeplearning.ai
Stanford CS224N(想看公式的老师)web.stanford.edu/class/cs224n
UNESCO 教师 AI 能力框架unesco.org/en/articles/ai-competency-framework-teachers
教育部等五部门《"人工智能+教育"行动计划》moe.gov.cn,教科信〔2026〕1 号
OpenAI:ChatGPT、GPT-4o、ChatGPT agent、GPT-6 Astra 发布页openai.com/index/…
Dartmouth 1955 提案www-formal.stanford.edu/jmc/history/dartmouth
本课材料与实测记录随课程材料提供,向课程组索取
信息截至 2026-09,以官方为准长期有效 · 核验 2026-09-05