智东西· 杨 京丽·2026-10-10 14:30· 8 小时前AI 评分71MIT等研究发现固定两个Token开头可让基础模型推理追平强化学习版本00后硕士揭开AI推理“黑科技”:两个Token,基模追平强化学习版本AI 导读MIT、加州大学伯克利分校、华盛顿大学和艾伦人工智能研究所的研究者发现,固定基础模型回答开头的两个Token,就能让数学推理成绩接近对应的强化学习版本。来源:智东西 · zhidx.com开源生态数据与训练论文研究评测基准#论文/研究#数据/训练#开源/仓库#评测/基准查看事件全部后续