跳到正文
MIT Technology Review · AI· Arthur Holland Michel·· 5 小时前AI 评分66

我们过于相信 AI 说“不”的能力

We’re putting too much faith in AI’s ability to say no

AI 导读

文章认为,现代 AI 依赖拒答机制阻止危险请求,但这种机制既可能被越狱绕过,也可能因过度拒答压制合法信息。文章指出,Anthropic 曾称一种分类器使聊天机器人的计算成本增加 24%,而拒答仍受概率机制影响。作者还警告,政府和企业对拒答边界的控制可能扩大审查与监控能力。

来源:MIT Technology Review · AI · technologyreview.com