跳到正文
  1. 量子位88

    OpenAI 公开 722 篇数学手稿,涉及准黎曼猜想与 BSD 猜想

    OpenAI 公开 722 篇数学手稿,归为 372 组结果,全部出自一个尚未发布的内部模型,论文、源码和部分 Lean 证明已上传 GitHub。手稿涉及准黎曼猜想、霍奇猜想、BSD 猜想、π 的无理性指数等,OpenAI 称模型共尝试约 4000 个研究问题,平均每项结果算力约相当于 ChatGPT Pro 思考 3 小时。

    推荐理由:OpenAI 一次性公开 722 篇数学手稿,读者可据此了解这批成果覆盖的猜想范围与数学界的核验争议。

  2. Microsoft Research71

    微软研究院开源 Agent Lightning v1.0:3500 行轻量级智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,用约 3500 行代码实现完整的 Harnessed Agentic RL 控制平面,让部署时使用的 agent harness 直接参与强化学习训练。

    推荐理由:微软研究院开源 Agent Lightning v1.0,读者可了解让部署用 harness 直接参与 RL 训练的思路与实测增益。

  1. OpenAI News62

    OpenAI 公布前沿模型在数学开放问题上的新结果

    OpenAI 发布内部前沿模型在数学开放问题上取得的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。

    推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可了解其研究细节。

  1. Google DeepMind62

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 发布 SynthID Bio,把 SynthID 水印技术引入合成生物学,将不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。

    推荐理由:SynthID 水印首次延伸到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及生物安全用途。

  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 自主模糊测试流水线

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。

    推荐理由:原文完整披露了自主模糊测试流水线的分层架构与覆盖反馈循环,可了解 LLM 智能体如何接手安全测试中的重复劳动。

  1. Microsoft Research60

    微软研究:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动机器人操作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。

    推荐理由:微软对机器人推理负载的系统性测量显示,把推理从机载 GPU 卸载到边缘或云端可同时改善任务成功率与续航。

  1. GitHub 热门 AIGC 开源项目83

    Lightricks 开源音视频生成模型 LTX-2.5 并发布完整推理流水线

    Lightricks 在 GitHub 开源 LTX-2.5,称其为首个基于 DiT 的音视频基础模型,可在同一模型内实现音视频同步、高保真与多种性能模式。仓库提供 DistilledPipeline、DFRPipeline 等十余条流水线,覆盖文生视频、图生视频、音频生视频、重拍与配音等场景,模型权重约 66 GiB,需从 Hugging Face 下载。

    推荐理由:原文给出 LTX-2.5 的模型清单、显存优化与多条流水线命令,读者可据此判断本地部署音视频生成的硬件门槛。

已经到底了