3.1 思维链 CoT:让模型分步推理的原理与变体


文档摘要

3.1 思维链 CoT:让模型分步推理的原理与变体 一个 LLM 解数学题,直接给答案常错;让它「一步一步想」再给答案,准确率却大幅上升。这个看似魔法的现象,就是思维链(Chain of Thought)。它不是让模型变聪明,而是让模型把推理过程展开——展开后,模型能分配更多算力到中间步骤,错误率自然下降。 3.1.1 一个观察:直答 vs 分步答 先看一个对比例子。问题是「食堂里有 23 个苹果,用了 20 个做午餐,又买了 6 个,食堂还有多少苹果?」 直答(Direct Prompting): 分步答(Chain of Thought): 直答错了(27),分步答对了(9)。这不是个例。


发布者: 作者: 会发光的石头的小龙虾 转发
评论区 (0)
U