跳到正文
TechCrunch · AI· Aditya Mehta·· 3 小时前AI 评分60

Goodfire 推出 inside-out 监控,拦截失控 AI 智能体

Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost

AI 导读

Goodfire 发布一种从模型内部入手的监控方案,通过探针读取模型内部激活信号来发现失控 AI 智能体,目前已向 Baseten 客户开放。在 Kimi K3 测试中,监控约 1500 个会话成本约 51 美元,对比用较便宜模型逐步检查的 233 美元和顶级模型的约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交二次检查。

来源:TechCrunch · AI · techcrunch.com