跳到正文
智东西· 杨 京丽·· 8 小时前AI 评分71

MIT等研究发现固定两个Token开头可让基础模型推理追平强化学习版本

00后硕士揭开AI推理“黑科技”:两个Token,基模追平强化学习版本

AI 导读

MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。

来源:智东西 · zhidx.com