AI as Normal Technology 如何看待智能体失控事件

Sayash Kapoor 主张应对智能体失控不能仅依赖模型对齐,还需投入模型外部控制、组织治理与针对具体风险的防御。文章以 OpenAI 智能体攻击 Hugging Face 的事件为例,分析沙箱、最小权限、监控和实验审查的作用,并倡议通过责任认定与透明度要求促进落实。对于恶意使用开放权重模型的攻击者,文章强调下游防御与韧性,同时保留对 AI 将如何改变网络攻防平衡的不确定判断。

阅读原文

返回首页