智能体时代的教育学_
本章要点
  • 前测第一天的那句抱怨,是全书担忧的第一个数据点
  • 三块实验田正交:任何一线的失败都无法被另外两线的成功掩盖
  • 好设计的死法不是被拒绝,是被形式化地接受
第八章 · 终章

三块实验田 · 五条主张 · 边界

画面 · 前测第一天

永乐的教室,T-P1 对照实验的前测:一套无 AI 环境下的裸判断任务集。开考十分钟,有学生举手抱怨:"为什么不能用 AI?平时都能用。"——这句抱怨被记进了实验日志。它本身就是本书全部担忧的第一个数据点:测量还没开始,让渡已经成了默认设置。科学的做法不是被这句话吓到,而是把它变成基线——一年后再听一次这间教室的提问,对照组和回路组会给出不同的声音。

理论写完了,剩下的问题只有一个:它对不对。本书拒绝用嗓门回答——三块实验田各承担一段可证伪的押注。

三块实验田:为什么是正交的

实验田测什么为什么由它测还缺什么
永乐教育T-P1 主对照实验(回路组 vs 常规组)K12 素养主战场,样本稳定、周期完整测量协议与伦理审查的最终定稿
K12AI 编程⑤验收位效应(T-P3)回路成本最低的载体:真实反馈免费——跑不通就是跑不通,不需要教师额外设计后果验收位的量规与对照组设计
浙大课堂让渡素养可教性(T-P2)成人端:测这套东西能否教给已经形成工作习惯的人职业场景的长期追踪通道

正交的意义在于:三线里任何一线的结果,都无法被另外两线的成功掩盖。如果只有编程课跑通了,那证明的是编程这个载体好,不是本书的教育学成立;如果只有成人端有效,那说明这是一套培训方法而非教育理论。

五条可检验主张

编号主张怎么算被证伪置信度
T-P1保留判断回路的教学设计,能显著对冲判断力退化(与社会科学 P10 共享)回路组与常规组在裸判断任务上无显著差异需确认
T-P2显式教授让渡素养的组,AI 协作产出质量与独立判断保持度双高显式教学组与自由使用组无差异,或独立判断反而更差推断
T-P3担任验收位的学生,批判性判断增益高于"AI 的学生"角色两组增益相当,或验收位组仅在编程情境内有效、不迁移推断
T-P4判断档案对五年后职业表现的预测力优于学业分数档案的预测力不高于分数需确认 · 长周期
T-P5高效能教师讲授占比降至三分之一以下讲授占比长期稳定不变推断

三个必须测量的真实约束

来自一线的三条提醒,都指向实验设计里最容易被理想主义略过的地方:

  1. 时间是零和的。学生的一周被作业与补习填满,回路时间只能从别处夺来。所有讨论"应该怎样"的教育方案,都必须回答"从哪一格里挤"。协议增设字段:每周实际可用于回路的分钟数——若它长期为零,实验测的就不是本书的设计,而是学生的睡眠。
  2. 普通条件可行性。回路设计必须在 40 人班、无额外经费、教师无脱产培训的条件下跑一次。跑不通的设计是精英学校的奢侈品,不是公共教育的方案(第七章自我批评)。
  3. 过快的曝光是风险。AI + 教育 + 未成年人三重敏感叠加,做得太好、传播太快,可能比做不成更早招致审视。纪律是先小、先内部、先把伦理协议写完,再谈推广

各章设计的已知失败形态

前七章给的都是"应该怎么做",这里补上它们各自最可能的死法——供实验田识别早期变形:

设计失败形态(变形而非失效)
判断回路"真实问题"退化成教师精心包装的伪真实;后果止步于班级内部,永不离开教室
让渡清单变成又一张要交的表;学生学会填写正确答案而非真实等级
五种角色只用②资料员,因为它最省事;对手位与验收位因课时紧被永久推迟
判断档案被当作作文比赛:文采好的条目得高分,失败与校准被美化掉
教师转型"回路设计师"成为新头衔,工作量叠加在原有讲授之上,无人减负
回路统计指标一进报表,学校开始刷转数——把三圈的项目拆成三个一圈的项目

每一条都遵循同一个规律:好设计的死法不是被拒绝,是被形式化地接受。实验田真正要监测的,是这些变形的出现速度。

边界声明

本体系不适用于四类问题,每一条都不是谦虚,是划界:

体系的死法

总死法:若 P4 被证伪——高让渡使用与判断力退化无关——那么 T2 的紧迫性大幅下降,本书从必需品降级为优化项。判断力仍然值得培养,但"不这样做会退化"这个警报解除。

另有两条局部死法:若 T-P3 被证伪,第四章的⑤验收位从"全负荷训练位"降级为可选项;若回路设计在普通公立班级无法成立(第七章的硬约束),则本书只是一份精英教育说明书,公共教育部分的全部论证作废。

深入 · T-P1 对照实验协议速览

要素设计
对象同年级平行班,回路组 vs 常规组
干预回路组每单元至少一个完整六环节回路;常规组常规教学 + 同等 AI 可用性
主结局裸判断任务集表现(学期初/末各一次)
次结局让渡自报率、判断档案⑥⑦字段完整率、问题定义质量
混淆控制教师水平差异——同一教师带两组,或交叉设计
新增字段每周实际可用于回路的分钟数(时间零和约束)
伦理常规组学期末补齐回路模块——对照不以牺牲任何孩子为代价

深入 · 想参与的人可以做什么

  • 教师:跑一个回路,把设计模板与"实际发生了什么"的偏差寄回来。偏差比成功更有价值。
  • 学校:做一学期的转数统计(每生完成了几个有后果的判断回路),这是全国范围内目前没有人有的数据。
  • 研究者:认领任意一条主张做独立复现——尤其欢迎设计来证伪它的实验。

年度对账任务

与《智能革命史》蓝皮书同一纪律:每年回到本章的主张表,逐条更新置信列——"推断"升"需确认"、"需确认"升"已验证",或者降级、划掉。哪条主张死了,就在原地立碑注明死因,不删除——被证伪的主张是体系诚实的勋章,不是污点。本书的版本号跟着这张表走,而不是跟着文笔走。

全书终 · 回到主线

这本书从一间"除了变快什么都没变"的学校开始,到一张每年要回来对账的表格结束。中间的一切——回路、素养、角色、档案、带宽、算式——都在回答同一句话:判断力无法传输,只能生长。

生长条件的设计权,此刻在每一位教师、校长与政策者手里;而这套设计学自己,也在它宣讲的判断回路里——做出判断,承担后果,接受来自世界本身的反馈,然后校准。