跳到正文
今天10月8日周四8 条
  1. TechCrunch · AI82

    OpenAI 随 GPT-6 推出 Intelligent UI,ChatGPT 界面转向可视化交互

    OpenAI 推出名为 Intelligent UI 的新界面,随 GPT-6 一同上线,在对话中大量加入可交互的图表、按钮、定制计算器和可编辑图形等视觉元素,目标是让学习复杂主题更容易。该功能面向 Pro、Plus、Business 和 Enterprise 用户全球推送,免费及低价 Go 用户周四可用,用户也可自行调低视觉内容的出现频率。

    同一新闻,精选展示《OpenAI 在 ChatGPT 全球上线 GPT-6 与 Intelligent UI》

10月7日周三
  1. The Decoder60

    Google 推出 Playground,用户仅凭文本输入即可创建并分享游戏

    Google 推出 Playground,一个面向美国成年人的浏览器 AI 平台,用户仅凭文本输入就能创建游戏,无需编程。该平台由 Gemini、Nano Banana 和 Lyria 模型驱动,免费使用,Google One 订阅者按套餐获得更高的每周使用额度,成品可通过链接分享或发布到公开画廊,部分品类支持排行榜和多人模式。

  2. Microsoft Research22

    微软研究员 Jennifer Neville 谈 AI 的意外失败与评估边界

    微软 partner research manager Jennifer Neville 在 Microsoft Research Podcast 中讨论了评估如何推动当前 AI 系统突破性能边界,以及模型在传统 benchmark 之外测试时出现的"意外失败"。她结合自身从数学、物理、认知科学到计算机科学的经历,分享了使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。

10月3日周六
10月1日周四
  1. 智东西26

    华为 Mate90 系列发布:首发麒麟 9050 Pro 逻辑折叠芯片与鸿蒙 7,顶配 18999 元

    华为发布 Mate90 系列旗舰手机,全系搭载麒麟 9030/9035/9050 Pro 芯片,首发第二代玲珑屏、第三代红枫原色影像和鸿蒙 7 系统。麒麟 9050 Pro 采用逻辑折叠架构,NPU 性能提升 140%,支持端侧运行 30B MoE 大模型。Mate90 起售价 5999 元,Pro Max 典藏版相机套装 19499 元,睿影 Z10 模块相机售价 5999 元。

  2. 智东西82

    谷歌发布 Gemini 4 Argon,性能比肩 GPT-6 Astra、成本仅 60%

    谷歌发布新一代旗舰模型 Gemini 4 Argon,重点面向软件工程、法律与金融等企业知识工作及网络安全防御等长周期任务。该模型在 DeepSWE v1.1 取得 77.9%、LVBench 得分 91.7%,输出 Token 上限从 6.4 万提升至 100 万,API 初始价格为每百万输入 Token 2 美元、输出 Token 10 美元。

    推荐理由:谷歌新旗舰模型在软件工程、企业知识工作与网络安全测试中的成绩与定价一并披露,可对照其与竞品的成本性能位置。

  3. Google DeepMind84

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:Gemini 4 Argon 的发布信息包含输出上限、定价与多项基准成绩,可据此判断前沿模型在长程工程与安全防御上的进展。

9月29日周二
  1. Microsoft Research62

    微软研究院推出 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由生物学多模态世界模型和连接模型、科学工具、文献与研究者的交互式 harness 两部分组成。

    推荐理由:微软研究院公开 Quine 的生物学世界模型与工具编排框架,并给出胰腺癌化合物筛选的湿实验验证结果。

9月23日周三
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐行表演导演,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:官方给出两款 TTS 模型的语音设计、逐行导演能力与基准排名,可据此判断语音生成从预设音色转向可定制创作的变化。

9月16日周三
9月1日周二
7月10日周五
5月11日周一
4月18日周六
  1. GitHub 热门 AIGC 开源项目62

    WorldX 开源:一句话生成可自主演化的 AI 世界

    WorldX 是一个开源项目,用户输入一句话即可生成完整虚拟世界,其中的 AI 角色会自主决策、交互、建立关系并记忆过往经历。项目采用编排引擎、绘图模型、绘图审查和世界驱动四组模型配置,支持 OpenRouter、Google AI Studio 及混合搭配,并提供上帝模式、时间线系统和中英双语。项目当前处于 Alpha 阶段,需 Node.js 22.13+,采用 MIT 协议。

3月27日周五
3月26日周四
3月12日周四
1月29日周四
  1. GitHub 热门 AIGC 开源项目62

    Toonflow 开源 AI 短剧漫剧创作平台发布,集成无限画布与插件市场

    Toonflow 是面向短剧、漫剧与短视频制作的开源 AI 创作平台,把剧本、角色、场景与视频片段整合进同一张无限画布。它支持桌面、Docker 与服务器本地部署,通过 MCP 连接外部工具,并提供插件市场、开放 Agent 与第三方 API 或本地 ComfyUI、LLM 接入,界面支持 21 种语言。

1月22日周四
1月3日周六
  1. GitHub 热门 AIGC 开源项目83

    Lightricks 开源音视频生成模型 LTX-2.5 并发布完整推理流水线

    Lightricks 在 GitHub 开源 LTX-2.5,称其为首个基于 DiT 的音视频基础模型,可在同一模型内实现音视频同步、高保真与多种性能模式。仓库提供 DistilledPipeline、DFRPipeline 等十余条流水线,覆盖文生视频、图生视频、音频生视频、重拍与配音等场景,模型权重约 66 GiB,需从 Hugging Face 下载。

    推荐理由:原文给出 LTX-2.5 的模型清单、显存优化与多条流水线命令,读者可据此判断本地部署音视频生成的硬件门槛。

12月22日周一