源文件:chapter1/learning-from-experience/README.md 从经验中学习:RL 与 LLM 上下文学习的对比 本实验对比传统强化学习(Q-learning)与基于 LLM 的上下文学习(in-context learning),复现 Shunyu Yao 博文 "The Second Half" 中的核心洞见。 🎯 实验概览 实验展示了 LLM 如何通过推理进行泛化,而传统 RL 方法需要大量训练才能学会游戏机制。我们使用一个带有隐藏机制的文字寻宝游戏,让 Agent 通过经验来发现这些机制。