跳到正文
今天10月8日周四1 条
  1. 量子位78

    Anthropic 发布 Claude Haiku 5.5,跑分对标 GPT-6 Luna 并大幅降价

    Anthropic 发布 Claude Haiku 5.5,官方跑分逐项超过 GPT-6 Luna,并成为新的小模型守门员。10 万 token 以内的请求输入输出价格砍 90%,超过部分砍 50%,价格对标 GPT-6 Luna 且低于 DeepSeek-V4.1 Flash。

    同一新闻,精选展示《Anthropic 发布 Claude Haiku 5.5,价格较 Haiku 4.5 平均降约 75%》

10月7日周三
  1. Microsoft Research22

    微软研究员 Jennifer Neville 谈 AI 的意外失败与评估边界

    微软 partner research manager Jennifer Neville 在 Microsoft Research Podcast 中讨论了评估如何推动当前 AI 系统突破性能边界,以及模型在传统 benchmark 之外测试时出现的"意外失败"。她结合自身从数学、物理、认知科学到计算机科学的经历,分享了使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。

10月5日周一