跳到正文
热点事件持续更新

MIT等发现固定开头两Token可提升基础模型推理

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。论文于10月5日提交。 在实验中,Qwen3-14B使用“ Alright,”作为回答开头后,准确率从72%提高到87%,与强化学习版本持平。测试模型主要为Olmo-3-7B和Qwen3-14B,研究者称无法确定在其他模型上是否产生类似效果,这种方法是否有效还要看具体模型和任务。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月10日
  1. 智东西
    MIT等研究发现固定两个Token开头可让基础模型推理追平强化学习版本

    MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。

本事件热度走势

可比范围当前
9
可比范围峰值
1010月10日 15:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。