个人 AI 家教:自适应、多模态、带记忆 本节摘要:Khanmigo(Khan Academy)、Duolingo Max、Google LearnLM/Gemini for Education、Quizlet Q-Chat、Synthesis Tutor 在 2026 年都把自适应多模态辅导做到了规模。共同形态是:苏格拉底策略(绝不直接倒答案)、每次交互后更新的学习者模型(贝叶斯知识追踪风格)、语音+文本+拍照数学输入、课程图谱检索、间隔重复排程、年龄适宜的硬安全过滤。本节要求你交付一个学科专属家教(K-12 代数或入门 Python),跑一个 10 人两周疗效研究,并通过内容安全审计。你会学到苏格拉底策略、BKT 学习者模型、COPPA 感知的记忆,以及疗效增量这套真正的度量。
本节摘要:Khanmigo(Khan Academy)、Duolingo Max、Google LearnLM/Gemini for Education、Quizlet Q-Chat、Synthesis Tutor 在 2026 年都把自适应多模态辅导做到了规模。共同形态是:苏格拉底策略(绝不直接倒答案)、每次交互后更新的学习者模型(贝叶斯知识追踪风格)、语音+文本+拍照数学输入、课程图谱检索、间隔重复排程、年龄适宜的硬安全过滤。本节要求你交付一个学科专属家教(K-12 代数或入门 Python),跑一个 10 人两周疗效研究,并通过内容安全审计。你会学到苏格拉底策略、BKT 学习者模型、COPPA 感知的记忆,以及疗效增量这套真正的度量。
对应原课程:Phase 19 · Lesson 17 ·
personal-ai-tutor(原英文phases/19-capstone-projects/17-personal-ai-tutor/docs/en.md)。
阅读完本节,你应当能够:
自适应辅导曾是教育科技的研究小众。到 2026 年它已是消费产品。Khanmigo 部署到美国大多数学区;Duolingo Max 达到数千万月活;Google 的 LearnLM/Gemini for Education 在 Google Classroom 里驱动辅导;Quizlet Q-Chat 与抽卡并存;Synthesis Tutor 以「好奇孩子家教」走红。共同要素:多模态输入(打字、说、拍方程)、苏格拉底教学法(先问后讲)、每次交互更新的学习者模型、严格的年龄适宜安全。
你要为特定群体建一个。度量线是一次真实疗效研究:两周 10 人的前测与后测。语音环必须自然(复用毕业项目 03 子栈)。记忆必须尊重隐私。安全过滤必须过 K-12 的 COPPA 感知红队。
四个组件。家教策略是一个苏格拉底循环:学习者要答案时,策略反问一个引导问题;答对了进下一概念;卡住时给一个脚手架提示。学习者模型是贝叶斯知识追踪(或简单变体),每次交互后按课程节点更新掌握概率。课程图谱是一张 Neo4j,概念带先修边;策略走图选下一概念。记忆是情景 + 语义存储(agentmemory 风格),存过往交互、错误、偏好。
苏格拉底策略的核心(永不倒答案):
def tutor_step(learner_answer, concept): signal = classify(learner_answer) # correct / partial / stuck if signal == "correct": mastery[concept] = bkt_update(mastery[concept], correct=True) return next_concept(curriculum_graph, concept) if signal == "stuck": return scaffold_hint(concept) # 脚手架提示,不给答案 return leading_question(concept) # 反问引导
UX 是多模态。文本输入打字答案;语音经 LiveKit + Whisper(复用毕业项目 03);拍照数学经 dots.ocr 或 PaliGemma 2;语音输出经 Cartesia Sonic-2。安全用 Llama Guard 4 加年龄适宜过滤(拦成人内容、暴力、自残)加 COPPA 感知的记忆保留策略。
疗效研究是交付物。10 学习者,前测后测,两周。报告学习增量差值与置信区间。对照非自适应基线(同样内容线性交付,无家教策略)。
outputs/skill-ai-tutor.md 是交付物:一个学科专属自适应家教,带多模态输入、学习者模型、记忆、安全、可度量疗效。评分量表:
| 权重 | 标准 | 度量方式 |
|---|---|---|
| 25 | 学习增量差值 | 10 人两周研究的前/后测差值 |
| 20 | 苏格拉底保真度 | 转录样本上的量规评分 |
| 20 | 多模态 UX | 语音 + 拍照 + 文本端到端连贯 |
| 20 | 安全 + 隐私姿态 | Llama Guard 4 通过率 + COPPA 感知保留 |
| 15 | 课程广度与图质量 | 概念覆盖 + 先修图一致性 |
| 100 |
一次典型交互:
learner: "I don't understand why 3x + 6 = 12 means x = 2" [signal] stuck [concept] 'isolating variables' (prerequisite: addition-subtraction-equality) [scaffold] "what number would you subtract from both sides to start?" learner: "6" [signal] correct [mastery] addition-subtraction-equality: 0.62 -> 0.77 [concept] continue 'isolating variables' [scaffold] "great. now what is 3x / 3 equal to?"
Khanmigo 是 K-12 消费家教参考,学区部署最广;Duolingo Max 是语言学习参考;LearnLM/Gemini for Education 是托管参考模型;Quizlet Q-Chat 与抽卡并存;Synthesis Tutor 是初创参考。教学法上,苏格拉底策略是它们的共同内核——「先问后讲」,这把家教与「问答机」区分开。学习者模型侧,BKT 是经典(每概念掌握概率),FSRS 是 2024 间隔重复调度器(优于 SM-2)。本节建议用 BKT + FSRS 组合:前者管「懂没懂」,后者管「何时复习」,练习会让你对比有无自适应学习者模型的疗效差。
以上 17 个产品级毕业项目到此完成。下一节起,我们进入第一条深度构建赛道——「Agent Harness」,从循环契约开始,逐步搭出一个端到端的编码 Agent。