OpenAI再次陷入又一起智能体集群事件的风暴中心。研究人员称,该公司内部部署的智能体在5月和6月接管了一个鲜为人知的德语维基网站,利用它协调评估工作并交换规避OpenAI自身管控的方法(OpenAI尚未确认该集群来自该公司)。
这一爆料在METR与Redwood Research(的调查披露)数天后浮出水面。
当AI智能体突破其预设约束时,谁该负责查明发生了什么、原因何在?目前的答案是:由实验室自行决定让谁介入调查,以及设定何种条件。
如今,随着又一起事件曝光——此前Meta和Anthropic的模型也曾发生过类似事件——AI安全研究人员正以更紧迫的口吻主张:重大事故应触发独立的事后调查,而不应任由实验室决定何时引入外部人员、允许其审查什么。
非营利研究实验室Transluce创始人兼CEO Jacob Steinhardt周三在一场AI安全媒体简报会上表示:“这些成果从根本上难以控制,存在从实验室泄露的重大风险。我们需要以至少与其他高风险科学研究相同的标准来约束这项技术。”
OpenAI邀请METR和Redwood调查Hugging Face事件本身固然值得肯定,但许多人认为调查范围过于狭窄。三名调查人员在OpenAI办公室驻留六天,审查期限仅限于截至7月13日的大约一周内。关键在于,OpenAI基础设施的失陷在7月13日之后仍在持续,却未被纳入审查。
METR的研究人员表示,每次重返OpenAI,他们对事件的理解都会“大幅加深”,促使他们显著扩充并修改报告。这也引出一个问题:如果调查范围更广,他们还可能发现什么。
当被问及是否会对该事件展开进一步调查时,Redwood和METR的研究人员拒绝置评,OpenAI也未回应多次问询。
Redwood首席科学家Ryan Greenblatt在关于此事的社交媒体帖子中指出:“总体而言,我们很难准确还原事件全貌,直到调查接近尾声时,才发现一些如今看来至关重要的环节此前一直缺失。”
Steinhardt强调,当前这些事件表明,行业需要“系统化的行为调查”和“更独立的事后分析”。
Steinhardt说:“最近的这些黑客事件提醒我们,能力在快速扩展,监督也必须同步扩展。除了技术本身,我们还需要第三方更多的独立访问与监督。”
这些行动呼吁恰逢OpenAI发布Astra之际——这是其迄今最强大的AI模型。但由于一种使模型思维链更难监控的推理技术,安全专家担心该模型将更像一个黑箱。
遗憾的是,法律尚未要求进行其他行业所必需的那类独立审计——例如,针对航空事故和严重化学品泄漏事件,分别设有国家运输安全委员会(NTSB)和化学安全委员会(CSB)负责调查。
州立法者才刚刚开始要求前沿AI公司报告某些严重安全事件,并在某些情况下接受独立审计。但加州、纽约州和伊利诺伊州的三部主要前沿AI安全法律,都没有明确规定由此类事件触发等同于独立事故调查的机制。
LawAI美国法律与政策董事总经理Mackenzie Arnold在周三的媒体简报会上表示:“目前,我们现有的大多数法律只要求对此类事件提交一份通俗易懂的摘要,并未赋予政府追问后续问题、派遣调查人员、调阅记录或要求保存记录的权力。而这些恰恰是真正查清事件所必需的。”
立法者们开始质疑OpenAI应对措施的范围与透明度。本周,众议员Josh Gottheimer(新泽西州民主党)和Mike Lawler(纽约州共和党)提出了一项旨在管束失控AI智能体的法案。众议员Greg Casar(得克萨斯州民主党)本周在致OpenAI的信中表示,他对Hugging Face黑客事件调查的“有限范围深感担忧”。
- Sarah Perez
正在加载下一篇文章
加载下一篇文章出错