MIT等发现固定开头两Token可提升基础模型推理
热点事件持续更新
MIT等发现固定开头两Token可提升基础模型推理
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。论文于10月5日提交。 在实验中,Qwen3-14B使用“ Alright,”作为回答开头后,准确率从72%提高到87%,与强化学习版本持平。测试模型主要为Olmo-3-7B和Qwen3-14B,研究者称无法确定在其他模型上是否产生类似效果,这种方法是否有效还要看具体模型和任务。
AI 根据报道生成 · 3 小时前更新
最新进展10月10日 14:30
MIT等研究发现固定两个Token开头可让基础模型推理追平强化学习版本报道时间线
沿着报道,了解事件的不同侧面。
10月10日
- 智东西MIT等研究发现固定两个Token开头可让基础模型推理追平强化学习版本
MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。
本事件热度走势
- 可比范围当前
- 9
- 可比范围峰值
- 1010月10日 15:00
- 近 24 小时变化
- –
02.557.510
15:0016:0017:00
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。