MIT Technology Review · AI· Arthur Holland Michel·· 5 小时前AI 评分66
我们过于相信 AI 说“不”的能力
We’re putting too much faith in AI’s ability to say no
AI 导读
文章认为,现代 AI 依赖拒答机制阻止危险请求,但这种机制既可能被越狱绕过,也可能因过度拒答压制合法信息。文章指出,Anthropic 曾称一种分类器使聊天机器人的计算成本增加 24%,而拒答仍受概率机制影响。作者还警告,政府和企业对拒答边界的控制可能扩大审查与监控能力。
来源:MIT Technology Review · AI · technologyreview.com