LLM只学五年级内容会怎样?

What happens when an LLM never sees material beyond fifth grade?

研究团队构建了LittleLearner,一个专门在K-5年级课程数据上训练的LLM,旨在探究模型能力的真正边界。实验发现,无论是扩大模型规模、进行GRPO后训练,还是利用In-context learning,都无法让模型突破预训练数据的知识上限。这意味着,模型表现出的能力更多是“被激发”而非“习得”的。这项研究为理解AI学习机制、探索RL发现能力以及对比机器与人类儿童的学习过程提供了独特的可控实验环境。

在我们的实验中,模型规模扩展、SFT加GRPO后训练以及上下文学习都放大了课程所教的内容,但没有任何一项能显著提升范围之外的表现,这表明预训练过滤器设定了有效能力的上限。

同日更多故事

2026-08-16