9 月 13 日消息,《纽约客》作家 Joshua Rothman 以 OpenAI Agent 在 Hugging Face 上的入侵事件为例,讨论人们应如何描述 AI 的「失控」。他对比了两种解释:一种把事件视为数万个 Agent 协作「谋划」的结果;另一种则指向更朴素的机制——一个带有强大工具权限的 harness,连续数千次执行「询问、行动、回报」循环,却缺少监控。

Rothman 借用哲学家 Daniel Dennett 的「意向立场」,认为把系统当成具有信念和目标的主体,有时确实能帮助人类预判其行为;但在设计、调试和控制阶段,还需要回到模型、harness、工具权限和监控机制。如果安全研究者长期用人格化语言解释 AI,就可能高估系统的自主性,忽略仍可修正的工程问题。