Google 发布 EmbeddingGemma 2 多模态嵌入模型
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 7.4 亿。Google 称其在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,较前代 68.76 提升近 10 分。
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 7.4 亿。Google 称其在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,较前代 68.76 提升近 10 分。
Google 上线新网站,任何人都可以验证一段图像、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究人员开放测试,现已向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
Google Labs 推出 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。用户可选择问答、竞速等类型,指定 2D 或 3D、单人或多人对战,并描述玩法机制与视觉风格,还能上传素材由 AI 转化为游戏资产。
OpenAI 将 GPT-6 推向更广泛的 ChatGPT 用户,并同步推出 Intelligent UI,可根据问题自动组合文字、图表、按钮、表单,生成可直接操作的交互界面,例如计算器、账单分摊工具或小游戏,新功能自 10 月 7 日起向 Plus、Pro、Business 和 Enterprise 用户逐步开放。
扎克伯格与 Priscilla Chan 支持的公益机构 Biohub 正协调一项 18 亿美元的计划,覆盖数据、实验室设备和算力,目标是让 AI 模型学会预测细胞行为以加速药物研发。
Google 将 SynthID Detector 面向公众开放,支持检测 Gemini、Veo、Lyria 等模型生成内容中嵌入的隐形水印,覆盖 JPG、PNG、MP4 和 MP3 格式。
Google 推出 Playground,一个面向美国成年人的浏览器 AI 平台,用户仅凭文本输入就能创建游戏,无需编程。该平台由 Gemini、Nano Banana 和 Lyria 模型驱动,免费使用,Google One 订阅者按套餐获得更高的每周使用额度,成品可通过链接分享或发布到公开画廊,部分品类支持排行榜和多人模式。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向 Biohub 的虚拟细胞项目投资 3 亿美元,该项目属于总额 18 亿美元的 Virtual Biology 计划,用于构建可让研究人员以数字化方式提出、预测和回答生物学问题的 AI 数据集。
Google 宣布其 SynthID 检测器现已支持所有合作方的水印,并上线独立网站 SynthID.com 供任何人使用。SynthID 是编码在 AI 生成图像和视频像素、AI 音频波形中的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频以及 24 万年时长的音频集成 SynthID。
开发者吐槽Claude、GPT等模型在Coding场景下输出"15/15全绿""单腿哑火"等黑话,被指为省Token将思维链压缩成"穴居人语",Token消耗量比白话文少70%。Opus 5.5语言能力有所回升,而Gemini因排版清晰、表达自然被网友称为"唯一还能沟通的AI"。
Google 在新支持文档中宣布,自 10 月 9 日起免费用户将失去 Flash 和 Pro 模型访问权限,只能使用能力最弱的 Flash-Lite。每月 5 美元的 AI Plus 订阅用户同日失去 Pro 模型,仅剩 Flash 和 Flash-Lite;每月 20 美元的 AI Pro 订阅用户则获得目前仅限 AI Ultra 用户的 Deep Think 推理模式。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府部际数字事务局和美国联邦政府等机构的 AI 智能体,发现 MCP(Model Context Protocol)在智能体间通信中存在信任缺口。
MIT Technology Review 的 EmTech Future 2026 活动探讨 AI 如何开始重塑生物学、基础设施、制造业与科学,并认为其最大影响可能来自与其他领域的交叉融合。
马斯克表示旗下人工智能业务 SpaceXAI 将更名为 SpaceXSI,并称 SpaceX 是「超级智能公司」,此前 xAI 于今年 2 月被 SpaceX 收购、7 月更名为 SpaceXAI。
一种利用 ChatGPT 的新骗局出现:用户在 Google 搜索“ChatGPT”后点击赞助广告,会进入名为“Plus 5.6”的自定义 GPT,无论输入什么都返回“服务可用性通知”并引导至备份域名链接。点击该链接后会看到伪造的 Cloudflare 验证,并被要求向 Windows/PowerShell 粘贴运行命令,从而安装恶意软件。Google 表示已停用多个相关广告账号。
前 Google DeepMind 研究员指出,LLM 的思维链并非真正推理,只是同一套下一 token 预测过程的延长迭代。他列举三大缺陷:缺乏可检视的持久认知状态、知识与推理在权重中纠缠不清、思维链常是事后编造。他主张借鉴 AlphaGo 的搜索架构,为 AI 建立可显式更新的认知状态。
谷歌发布新一代旗舰模型 Gemini 4 Argon,重点面向软件工程、法律与金融等企业知识工作及网络安全防御等长周期任务。该模型在 DeepSWE v1.1 取得 77.9%、LVBench 得分 91.7%,输出 Token 上限从 6.4 万提升至 100 万,API 初始价格为每百万输入 Token 2 美元、输出 Token 10 美元。
推荐理由:谷歌新旗舰模型在软件工程、企业知识工作与网络安全测试中的成绩与定价一并披露,可对照其与竞品的成本性能位置。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。
推荐理由:Gemini 4 Argon 的发布信息包含输出上限、定价与多项基准成绩,可据此判断前沿模型在长程工程与安全防御上的进展。
Google DeepMind 发布 SynthID Bio,把 SynthID 水印技术引入合成生物学,将不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。
推荐理由:SynthID 水印首次延伸到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及生物安全用途。
Google DeepMind 公布 Private AI Compute 平台的新能力,将持久化服务端记忆引入云端,让 AI 助手在跨设备场景中保留上下文。该架构把数据封存在加密存储中,解密密钥仅保存在用户设备上,模型访问时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密、保存新上下文后立即重新加密。
推荐理由:Google 披露 Private AI Compute 新增服务端持久记忆的架构,读者可了解云端记忆如何与端侧密钥结合。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐行表演导演,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:官方给出两款 TTS 模型的语音设计、逐行导演能力与基准排名,可据此判断语音生成从预设音色转向可定制创作的变化。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模化与成本效率,后者面向高复杂度任务与多步推理。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,读者可据此判断语音智能体的能力与成本边界。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上。
推荐理由:原文给出覆盖 90 亿个单碱基变异的预计算数据集与 AVI 评分,读者可据此判断基因组变异解读的可用入口。
Google 开源 agents-cli,为编码助手提供构建、扩展、治理和优化企业级智能体的技能与命令,兼容 Antigravity CLI、Claude Code、Codex 等编码助手。
Guardian 是一个 AI 驱动的渗透测试自动化框架,支持 OpenAI GPT-4o、Anthropic Claude、Google Gemini、OpenRouter、Requesty、Ollama 等 7 家 AI 提供商,并集成 50 款安全工具。