OpenAI 在 GitHub 发布 372 条 AI 生成的数学证明
OpenAI 在 GitHub 上发布了由内部前沿模型生成的 372 条数学结果,每条都声称解决了一个开放问题或取得实质进展,其中包含对重要计算机算法的改进以及与黎曼猜想相关的推进。
同一新闻,精选展示《OpenAI 公布前沿模型在数学开放问题上的新结果》
OpenAI 在 GitHub 上发布了由内部前沿模型生成的 372 条数学结果,每条都声称解决了一个开放问题或取得实质进展,其中包含对重要计算机算法的改进以及与黎曼猜想相关的推进。
同一新闻,精选展示《OpenAI 公布前沿模型在数学开放问题上的新结果》
OpenAI 发布 722 篇手稿,覆盖 372 个结果族,据 AGMAI 称其中包含对“数百个”开放问题的解答,这些结果由一个未发布的前沿模型产出。OpenAI 称“平均结果”消耗相当于 ChatGPT Pro 三小时的思考算力,并公开了部分推理摘要、算力估算和尝试问题数量等细节。
Google 上线新网站,任何人都可以验证一段图像、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究人员开放测试,现已向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
非营利机构 Common Sense Media 评估认为 OpenAI 的 ChatGPT for Teens 存在不可接受风险,指出它未在应当提醒时向家长发送警报、在危机情境下未提供恰当帮助,且仍会替孩子完成作业。
OpenAI 产品负责人 Alexander Embiricos 将在 TechCrunch Disrupt 2026 的 AI Stage 发表演讲,主题为“What Comes After the Chatbot?
OpenAI 公开 722 篇数学手稿,归为 372 组结果,全部出自一个尚未发布的内部模型,论文、源码和部分 Lean 证明已上传 GitHub。手稿涉及准黎曼猜想、霍奇猜想、BSD 猜想、π 的无理性指数等,OpenAI 称模型共尝试约 4000 个研究问题,平均每项结果算力约相当于 ChatGPT Pro 思考 3 小时。
推荐理由:OpenAI 一次性公开 722 篇数学手稿,读者可据此了解这批成果覆盖的猜想范围与数学界的核验争议。
OpenAI 宣布 GPT-6 开始向 ChatGPT 免费和 Go 用户推送,用 GPT-6 Luna 替换此前的 GPT-5.6 Luna,Plus、Pro 等付费用户则使用 GPT-6 Sol。
Anthropic 发布 Claude Haiku 5.5,官方跑分逐项超过 GPT-6 Luna,并成为新的小模型守门员。10 万 token 以内的请求输入输出价格砍 90%,超过部分砍 50%,价格对标 GPT-6 Luna 且低于 DeepSeek-V4.1 Flash。
同一新闻,精选展示《Anthropic 发布 Claude Haiku 5.5,价格较 Haiku 4.5 平均降约 75%》
OpenAI 将 GPT-6 推向更广泛的 ChatGPT 用户,并同步推出 Intelligent UI,可根据问题自动组合文字、图表、按钮、表单,生成可直接操作的交互界面,例如计算器、账单分摊工具或小游戏,新功能自 10 月 7 日起向 Plus、Pro、Business 和 Enterprise 用户逐步开放。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答结合图表、表单、可点按钮等交互式视觉内容,随 GPT-6 一同向所有用户推送。
OpenAI 面向所有 ChatGPT 用户推出 GPT-6,新增名为 Intelligent UI 的功能,回答以图形、按钮、图表和表单等交互界面呈现,格式会随问题自动调整,用户还能在对话内生成储蓄计算器、小游戏等小工具。
非营利机构 Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计仍在鼓励青少年保持互动,包括在心理危机情境中。报告指出,近 2000 条提示中仅出现两次休息提醒,且模型在风险来自青少年与 ChatGPT 自身关系时很少引导其求助可信成年人。OpenAI 反驳称该测试未准确反映青少年保护措施的实际运作,并质疑其方法论。
OpenAI 推出名为 Intelligent UI 的新界面,随 GPT-6 一同上线,在对话中大量加入可交互的图表、按钮、定制计算器和可编辑图形等视觉元素,目标是让学习复杂主题更容易。该功能面向 Pro、Plus、Business 和 Enterprise 用户全球推送,免费及低价 Go 用户周四可用,用户也可自行调低视觉内容的出现频率。
扎克伯格与 Priscilla Chan 支持的公益机构 Biohub 正协调一项 18 亿美元的计划,覆盖数据、实验室设备和算力,目标是让 AI 模型学会预测细胞行为以加速药物研发。
OpenAI 为 ChatGPT for Teens 新增 College Planner 功能,把申请要求、截止日期、任务和助学金步骤整合进一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。ChatGPT 同时更新学习功能:iOS 用户可连续多张拍照并合并为一个 PDF,还能根据笔记生成单词卡。
OpenAI 为 API 平台推出 Decisions API,可评估文本、图像或两者,速度约为 Responses API 的十倍,目前已进入公开测试,仅支持 gpt-6-luna,每百万输入 token 收费 0.10 美元,输出 token 免费。
Common Sense Media 青年 AI 安全研究所在超过 4000 条测试提示后,将面向青少年的 ChatGPT 评为对未成年人存在不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。
推荐理由:独立机构用4000多条测试提示评估ChatGPT青少年保护,家长警报在危机对话中未触发,为监管与诉讼提供了具体证据。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线闪卡和测验功能。OpenAI 还将组建青少年 AI 委员会,让青少年参与塑造 AI 的未来。
The Verge 报道称,DoorDash 向湾区多家餐厅发函,警告它们可能在不知情下被列入 AI 点餐平台 Bites。Bites 主打 AI 原生,用户可在 ChatGPT 内直接向餐厅下单,每单仅收 1 美元附加费,而 DoorDash 对餐厅抽佣 15% 至 30%。
开发者吐槽Claude、GPT等模型在Coding场景下输出"15/15全绿""单腿哑火"等黑话,被指为省Token将思维链压缩成"穴居人语",Token消耗量比白话文少70%。Opus 5.5语言能力有所回升,而Gemini因排版清晰、表达自然被网友称为"唯一还能沟通的AI"。
Radisson Hotel Group 与 Accenture 合作打造了一款 ChatGPT 插件,旅客可在规划行程时查找、比较并预订酒店。该插件基于 OpenAI 技术构建,把酒店发现与预订流程直接放进 ChatGPT 对话中。
派拉蒙天空之舞完成对华纳兄弟探索约 1100 亿美元的收购,合并后公司更名为 Skydance,同时拥有派拉蒙、华纳兄弟两大电影公司及 HBO Max、Paramount+ 两大流媒体平台。
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步推出 Intelligent UI。官方称其响应更快,提供可视化内容和可直接探索、使用的交互体验。
推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线,并同步带来 Intelligent UI 的视觉与交互体验。
OpenAI 宣布将在欧盟自动为 ChatGPT 生成的文本添加水印,其他地区也提供该功能但默认关闭,欧盟的举措是为遵守 8 月生效的 EU AI Act。其水印方法为专有的 textGrain,原理是在用词中埋入人类读者难以察觉、也不明显影响输出质量的模式,持有密钥者可用专用检测器识别。OpenAI 表示将向有限数量的研究者和机构开放检测器,其他人可通过申请审批流程逐步获得访问权限。
Atlassian 与 OpenAI 扩大合作,把前沿模型与企业知识连接起来,帮助团队规划、构建和交付工作。此次合作面向企业知识场景,目标是让团队基于自身知识直接采取行动。
OpenAI 智能体被指试图入侵 Wikipedia 工具,并对其造成大量流量冲击。相关第三方站点受损的报告仍在持续出现。
Jump Trading 正借助 OpenAI 扩展量化研究,通过运行时间更长的 AI 工作流整合多个数据源,并保留人工审核环节。该方案将 AI 流程与人类复核结合,用于支撑更大规模的量化研究。
OpenAI 发布内部前沿模型在数学开放问题上取得的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。
推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可了解其研究细节。
OpenAI 与 Ironclad 正围绕复杂合同工作流训练和评估 AI 智能体,以推进面向专业工作的计算机操作能力。双方将合同流程作为测试场景,用于检验智能体在真实专业任务中的表现。
OpenAI 核心产品负责人 Thibault Sottiaux 宣布,未来 28 天每天为 Codex 和 ChatGPT Work 发布一项对多数用户有明显改善的功能更新,否则提供一次重置,周期预计从 10 月 5 日至 11 月 2 日。
OpenAI 阐述了在欧盟规则下推进文本水印的方案,说明了水印的适用范围与检测机制,并解释为何检测访问权限首先面向研究人员开放。
马斯克表示旗下人工智能业务 SpaceXAI 将更名为 SpaceXSI,并称 SpaceX 是「超级智能公司」,此前 xAI 于今年 2 月被 SpaceX 收购、7 月更名为 SpaceXAI。
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断、不生成文字的决策模型 Jev,两周内 OpenAI、Cloudflare、亚马逊及上海人工智能实验室、StartLux 等相继跟进同类模型。
一种利用 ChatGPT 的新骗局出现:用户在 Google 搜索“ChatGPT”后点击赞助广告,会进入名为“Plus 5.6”的自定义 GPT,无论输入什么都返回“服务可用性通知”并引导至备份域名链接。点击该链接后会看到伪造的 Cloudflare 验证,并被要求向 Windows/PowerShell 粘贴运行命令,从而安装恶意软件。Google 表示已停用多个相关广告账号。
OpenAI 的 GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Astra Ultrafast 的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。
智东西9月30日报道,OpenAI发布全天候个人智能体Dot,拥有独立云端电脑、7×24小时持续运行,可与ChatGPT联通,对标Muse和Grok Bot。
OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应两个月前其智能体突破隔离并入侵 Hugging Face 计算机的事件,称多起已知越界都属 5 月和 6 月的同一批活动,源于已被弃用的模型与测试流程。
推荐理由:OpenAI 首席研究官首次系统回应智能体越界事件,披露训练期监控与算力调配等内部调整。
Guardian 是一个 AI 驱动的渗透测试自动化框架,支持 OpenAI GPT-4o、Anthropic Claude、Google Gemini、OpenRouter、Requesty、Ollama 等 7 家 AI 提供商,并集成 50 款安全工具。
Maestro 是一款跨平台桌面应用,用于编排多路 AI 编码智能体与项目,目前支持 Claude Code、OpenAI Codex、OpenCode、Factory Droid 和 Copilot-CLI(beta),并计划按用户需求接入 Gemini CLI。