跳到正文
热点事件持续更新

Goodfire推出模型内部信号监控器

1 篇报道1 个报道来源23 小时前更新

先了解这件事

AI 综述

Goodfire面向Baseten客户推出通过读取模型内部信号监控AI智能体风险行为的工具,而不只是检查输出;在Kimi K3测试中,监控约100万次交互的成本约为185美元,探测器捕获了93%的恶意黑客会话,并将5.5%的无害会话交给二次检查。 Baseten客户可自行选择监控攻击性黑客行为、化学和生物武器滥用、奖励劫持等风险,并设定处置方式,包括记录事件、交由人工审核或直接拒绝请求。

AI 根据报道生成 · 4 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. TechCrunch · AI
    Goodfire推出“由内而外”监控器,低成本检测失控AI智能体

    Goodfire推出面向 Baseten 客户的“由内而外”监控器,通过读取模型内部信号检测 AI 智能体的风险行为,而不是只检查输出。在 Kimi K3 测试中,监控约 1 million exchanges 成本约为 $185,探测器捕获 93% 的恶意 hacking sessions,并将 5.5% 的无害会话交给二次检查。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。