Musubi 发布开源决策模型 PolicyLM-1.7B,用于实时内容审核
Musubi 发布轻量决策模型 PolicyLM-1.7B,采用开放权重,可将纯英文写成的内容政策在 50 毫秒内应用到消息上。该模型成本与速度接近主流社交平台的 AI 分类器,但具备现代 LLM 的灵活性,无需专门训练即可执行复杂政策,政策变更时也不必重新训练。Musubi 联合创始人兼首席 AI 官 Filip Jankovic 表示,这让平台管理者可以主动为内容打标。
Musubi 发布轻量决策模型 PolicyLM-1.7B,采用开放权重,可将纯英文写成的内容政策在 50 毫秒内应用到消息上。该模型成本与速度接近主流社交平台的 AI 分类器,但具备现代 LLM 的灵活性,无需专门训练即可执行复杂政策,政策变更时也不必重新训练。Musubi 联合创始人兼首席 AI 官 Filip Jankovic 表示,这让平台管理者可以主动为内容打标。
OpenAI 公开 722 篇数学手稿,归为 372 组结果,全部出自一个尚未发布的内部模型,论文、源码和部分 Lean 证明已上传 GitHub。手稿涉及准黎曼猜想、霍奇猜想、BSD 猜想、π 的无理性指数等,OpenAI 称模型共尝试约 4000 个研究问题,平均每项结果算力约相当于 ChatGPT Pro 思考 3 小时。
推荐理由:OpenAI 一次性公开 722 篇数学手稿,读者可据此了解这批成果覆盖的猜想范围与数学界的核验争议。
Artcraft 从可控 AI 图像视频编辑工具转向开源应用套件,用 Claude Opus 5.5 复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 七款 Adobe 软件的界面与工具,代码用 Rust 编写并提供 WebAssembly 浏览器版本。
微软研究院开源 Agent Lightning v1.0,用约 3500 行代码实现完整的 Harnessed Agentic RL 控制平面,让部署时使用的 agent harness 直接参与强化学习训练。
推荐理由:微软研究院开源 Agent Lightning v1.0,读者可了解让部署用 harness 直接参与 RL 训练的思路与实测增益。
OpenAI 发布内部前沿模型在数学开放问题上取得的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。
推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可了解其研究细节。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 19 种语言的 219 个 pull request。
Google DeepMind 发布 SynthID Bio,把 SynthID 水印技术引入合成生物学,将不可感知的签名直接嵌入生物代码,在数字模型和合成出的实体蛋白质上均可验证,同时保持其生物功能。
推荐理由:SynthID 水印首次延伸到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及生物安全用途。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
推荐理由:原文完整披露了自主模糊测试流水线的分层架构与覆盖反馈循环,可了解 LLM 智能体如何接手安全测试中的重复劳动。
微软研究院对移动机器人操作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。
推荐理由:微软对机器人推理负载的系统性测量显示,把推理从机载 GPU 卸载到边缘或云端可同时改善任务成功率与续航。
微软研究院在 Nature 发表逆合成预测框架 RetroChimera,并开源其实现与权重。该模型由 Transformer 的 R-SMILES 2 与基于 GNN 的 NeuralLoc 两个子模型组成,通过学习式重排序整合二者互补预测。盲测中化学家更偏好其单步反应预测,十个挑战性目标的多步路线中成功九个,对比之下 de novo 模型为五个、编辑模型为四个、NeuralSym 为两个。
微软研究院推出 GigaPath-Flash 和 GigaTIME-Flash,以蒸馏自十亿参数 GigaPath 编码器的 22M 参数 ViT-S 骨干大幅降低病理分析算力需求,二者均以 Apache 2.0 许可开源。
Hypit 开源了一个面向 AI 智能体的视频创作语言与系统,用户丢入一段视频,智能体即可克隆出包含素材、字幕、B-roll 和特效的完整工作流,安装方式为 npx skills add hypit-ai/hypit -g。
vox-director 是一个智能体技能,输入一句话主题即可自动生成 Vox 风格纸拼贴解说或广告视频,涵盖脚本、拼贴关键帧、动效、配音、音乐和字幕,最终输出 mp4。
Pixel2Motion 是一个面向 Codex 和 Claude 的开源技能,可将 PNG、JPG、WebP 或截图 logo 转为平滑 SVG,再生成 logo 动画 HTML、GIF/视频预览和动效 QA 证据。
nexu-io 开源 html-anything,一个本地优先的智能体 HTML 编辑器,可自动检测 PATH 上已登录的 9 个编码智能体 CLI(Claude Code。
EvoLinkAI 的 GitHub 仓库 awesome-gpt-image-2-API-and-Prompts 收录 GPT Image 2 的 API 与提示词资源。仓库包含 cases、data、docs、images、result、script、scripts 等目录,并提供 de、es、fr、ja、ko、pt、ru、tr、zh-CN、zh-TW 多语言 README。
WorldX 是一个开源项目,用户输入一句话即可生成完整虚拟世界,其中的 AI 角色会自主决策、交互、建立关系并记忆过往经历。项目采用编排引擎、绘图模型、绘图审查和世界驱动四组模型配置,支持 OpenRouter、Google AI Studio 及混合搭配,并提供上帝模式、时间线系统和中英双语。项目当前处于 Alpha 阶段,需 Node.js 22.13+,采用 MIT 协议。
Google 开源 agents-cli,为编码助手提供构建、扩展、治理和优化企业级智能体的技能与命令,兼容 Antigravity CLI、Claude Code、Codex 等编码助手。
DramaClaw 发布源码可得的 AI 短剧生产线,由无限画布 XiaHua 与剧集流水线 XiaJi 两条轨道共用同一资产库和内置智能体 Xia Director。
开源项目 remove-ai-watermarks 发布,可清除自己生成的图像和视频中的可见 AI 标记(如 Google Gemini 闪光水印、Sora、Veo、Seedance、豆包、Dola、海螺 AI、可灵 AI 等)、C2PA/EXIF/XMP/IPTC 等 AI 元数据,以及通过扩散重生成破坏不可见像素水印。
alvinreal/awesome-opensource-ai 是一个收录开源 AI 项目的 GitHub 资源合集仓库,内容按 assets、tools 等目录组织,并配有 .github/workflows 工作流配置。仓库包含 CONTRIBUTING.md 贡献指南与 LICENSE 许可协议,供开发者查阅和参与维护。
InkOS 发布 2.0 版本,把 Chat Agent 调工具与各类作品管线收敛为围绕 pi-agent 的统一生产 harness,模型负责理解与调用,InkOS 负责确认、上下文、状态与原子落盘。
Lightricks 开源桌面应用 LTX-Desktop,可在支持 CUDA 的 Windows/Linux NVIDIA GPU 或 Apple Silicon Mac 上本地生成视频,不支持本地生成的硬件走 API 模式。
HexmosTech 开源 git-lrc,通过 hook 接入 git commit,在代码落地前对每次 diff 运行 AI 审查,覆盖 10 类风险、100+ 失败模式,60 秒完成设置。
Toonflow 是面向短剧、漫剧与短视频制作的开源 AI 创作平台,把剧本、角色、场景与视频片段整合进同一张无限画布。它支持桌面、Docker 与服务器本地部署,通过 MCP 连接外部工具,并提供插件市场、开放 Agent 与第三方 API 或本地 ComfyUI、LLM 接入,界面支持 21 种语言。
waooAI 发布 AI 图像与视频创作工作台 waoowaoo 预览版,支持在画布上通过右侧 Assistant 构思创意、上传参考素材并整理生成结果。
Lightricks 在 GitHub 开源 LTX-2.5,称其为首个基于 DiT 的音视频基础模型,可在同一模型内实现音视频同步、高保真与多种性能模式。仓库提供 DistilledPipeline、DFRPipeline 等十余条流水线,覆盖文生视频、图生视频、音频生视频、重拍与配音等场景,模型权重约 66 GiB,需从 Hugging Face 下载。
推荐理由:原文给出 LTX-2.5 的模型清单、显存优化与多条流水线命令,读者可据此判断本地部署音视频生成的硬件门槛。
Guardian 是一个 AI 驱动的渗透测试自动化框架,支持 OpenAI GPT-4o、Anthropic Claude、Google Gemini、OpenRouter、Requesty、Ollama 等 7 家 AI 提供商,并集成 50 款安全工具。
Maestro 是一款跨平台桌面应用,用于编排多路 AI 编码智能体与项目,目前支持 Claude Code、OpenAI Codex、OpenCode、Factory Droid 和 Copilot-CLI(beta),并计划按用户需求接入 Gemini CLI。
MiniOneRec 是首个全开源生成式推荐框架,提供从 SID 构建、监督微调(SFT)到基于 GRPO 的推荐导向强化学习的端到端流程。它通过三级 RQ-VAE 将商品标题与描述量化为语义 SID,并在 RL 阶段采用约束束搜索保证推荐结果唯一有效。项目已支持 Amazon18 与 Amazon23 数据集,并可直接下载模型 checkpoint。
GitHub 项目 agentic-rag-for-dummies 用 LangGraph 以极简代码搭建模块化 Agentic RAG 系统,支持对话记忆、查询澄清与多智能体 Map-Reduce 并行检索。