Google 发布 EmbeddingGemma 2 多模态嵌入模型
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 7.4 亿。Google 称其在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,较前代 68.76 提升近 10 分。
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 7.4 亿。Google 称其在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,较前代 68.76 提升近 10 分。
Nous Research 以 15 亿美元估值完成 9000 万美元 B 轮融资,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 等参投,公司累计融资达 1.58 亿美元。
Mistral 表示其新模型 Le Chonk 能够与顶级闭源模型竞争,同时保持开放权重。该说法来自 Ars Technica 对相关消息的报道,原文未给出具体评测数据或参数细节。
NVIDIA《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。NVIDIA 发布 300 亿参数的 Nemotron 3 Large Telco Model(LTM),由 AdaptKey 基于开源电信数据集微调,并开放完整微调流程。
Mistral 发布 Mistral Large 4(ML4),昵称 Le Chonk,为万亿参数开放权重模型,目前处于公开预览阶段,权重将于 10 月 27 日发布。
马斯克表示旗下人工智能业务 SpaceXAI 将更名为 SpaceXSI,并称 SpaceX 是「超级智能公司」,此前 xAI 于今年 2 月被 SpaceX 收购、7 月更名为 SpaceXAI。
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断、不生成文字的决策模型 Jev,两周内 OpenAI、Cloudflare、亚马逊及上海人工智能实验室、StartLux 等相继跟进同类模型。
NVIDIA 将于 10 月 23 日通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售 DGX Spark 64GB 版本,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备端运行。
推荐理由:原文给出 64GB 版本的定价、上市时间与双机集群性能数据,可据此判断本地跑百亿参数模型的成本与扩展方式。
针对 2.8 万亿参数、104B 激活参数的开源模型 Kimi K3,浪潮信息与海外团队 Inferact 几乎同时给出推理优化方案。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上。
推荐理由:原文给出覆盖 90 亿个单碱基变异的预计算数据集与 AVI 评分,读者可据此判断基因组变异解读的可用入口。
WorldX 是一个开源项目,用户输入一句话即可生成完整虚拟世界,其中的 AI 角色会自主决策、交互、建立关系并记忆过往经历。项目采用编排引擎、绘图模型、绘图审查和世界驱动四组模型配置,支持 OpenRouter、Google AI Studio 及混合搭配,并提供上帝模式、时间线系统和中英双语。项目当前处于 Alpha 阶段,需 Node.js 22.13+,采用 MIT 协议。
rohitg00 发布开源 AI 工程课程 ai-engineering-from-scratch,含 523 节课、20 个阶段、约 342 小时,覆盖 Python、TypeScript、Rust、Julia,采用 MIT 协议免费开放。