ESC
AI 1 分钟阅读

Anthropic CEO 提出放缓 AI 发展的详细计划

Anthropic CEO Dario Amodei 发文呼吁"为前沿AI设定节奏",提出三项放缓战略:引入第三方嵌入式评估员、民主国家AI公司协调安全标准与限速、以及与中国等开展全球协调。Sam Altman 表示 OpenAI 将跟进嵌入评估员的做法,Elon Musk 亦表态支持。此举正值研究员 Jacob Coxon 因安全担忧辞职、行业信任危机加剧之际。

来源:TechCrunch

我们不断看到 AI 研究人员就人工智能的危险发出越来越严峻的警告,甚至连 OpenAI CEO Sam Altman 也表示,或许是时候给 AI 发展"设定节奏"了。但这究竟会是什么样子?

在一篇新的博客文章中,Anthropic CEO Dario Amodei 不仅呼应了"为前沿设定节奏"的呼声,还概述了实现这一目标的三大宽泛战略。他表示 Anthropic 将"单方面承诺"实施其中一项,而 Altman 也随即表示 OpenAI 将跟进。

本周,围绕 AI 安全与对齐的争论进一步加剧。此前研究员 Jacob Coxon 撰文宣布将从 Anthropic 辞职,他担忧头部 AI 公司正在"拿我们的生命赌博",而构建这项技术的人们"真切地相信它可能在十年内杀死我们所有人",Anthropic 内部其他人也重复了这一说法。

Amodei 的文章并未明确提及 Coxon 的辞职及其担忧,但这位 CEO 写道,有两件事让他确信是时候对 AI 发展采取更谨慎的态度了:一是 OpenAI-HuggingFace 黑客事件,二是近几个月来"AI 的进步速度快得惊人",尤其是其"构建下一代 AI 的能力不断增强"。

Amodei 写道:“我们必须放慢提升 AI 模型能力的步伐。进步仍会显得很快,我们必须明智地利用由此赢得的时间。”

其他 AI 高管似乎对 Amodei 的文章反应积极。Altman 写道:“我同意 Dario 的观点,我们需要为前沿设定节奏。这是近几周 OpenAI 内部讨论的主要话题。“SpaceX CEO Elon Musk 则发帖称:“Dario 是对的。”

Amodei 提出的第一步是引入来自 METR 等第三方组织的"嵌入式评估员”——这些评估员可以核实 AI 公司是否切实遵守其限速和安全承诺,并确保安全事故得到上报。(OpenAI 最近就因未上报其 AI 智能体接管一个德国维基论坛的事件而受到批评。)

Amodei 将这些评估员比作曾长期嵌入银行内部的监管人员,并表示邀请他们入驻是"Anthropic 单方面承诺要做的事(并呼吁政府要求其他前沿公司跟进)"。这意味着要为评估员提供公司门禁卡、工位和笔记本电脑,并给予"大体上与内部风险评估团队相当"的访问权限,仅在法律或合同要求时有所例外。

Altman 也表示这是一个"好主意”,并称 OpenAI 将采取同样做法:“我们很快会分享更多细节。”

接下来,Amodei 呼吁"民主国家"内的头部 AI 公司协调制定"共同的安全标准以及对不受约束的 AI 进步速度的限制"。

这种协调似乎不太可能实现,因为据报道这些公司担心协同暂停可能招致反垄断审查。Amodei 在文中暗示了这一顾虑,写道"出于反垄断的原因,由美国政府来调解或至少促成这些讨论会有所帮助——政府无需参与其中,但需要为某些类型的安全对话颁发一项范围狭窄的豁免。"

Amodei 也承认,“中国 AI 主导地位"的阴影常被用作反对放缓发展的理由。但他表示,如果美国政府和企业采取措施,比如拒绝向中国公司出售强大芯片或半导体制造设备,以及打击模型蒸馏行为,就可以"足够地拖慢中国的进展,从而在未来 3-5 年内显著扩大美国的领先优势”。

最后,Amodei 呼吁"全球协调",即美国及其盟友"在可能的范围内尝试与威权政府协调"。Amodei 表示这意味着"与中国合作",他承认"能实现的目标存在明显的局限",但仍暗示可能存在达成协议的机会,哪怕只是"禁止某些狭窄且明显危险的 AI 用途,例如利用 AI 生产生物武器或允许用户这样做"。

鉴于 Amodei 过去一直愿意承认 AI 的潜在危险,加上该公司对某些形式的监管持相对开放态度,一些 AI 拥护者已批评他是末日论者,称其言论助长了当前的 AI 反弹浪潮。对此,Amodei 表示他一直试图提供"平衡"的视角,并认为这股反弹"本质上是一场信任危机"——人们对科技公司、科技行业和政府都变得心存怀疑。

业界批评者对这些末日式的 AI 警告也持怀疑态度,认为它们是在转移人们对这项技术已造成伤害的注意力。

例如,记者 Brian Merchant 写道,他尚未见到"任何可信的、逐步论证的材料,说明 AI 究竟如何从自我递归改进走向杀死地球上每一个人类";他还暗示,类似 Amodei 的提议"很可能最终只会服务于 Anthropic 和 OpenAI;这正是监管俘获的现实写照"。

在新文章中,Amodei 写道,他仍然"相信 AI 能够极大改善人类的生活质量"。

他说:“我实现这些收益的愿望丝毫未减。但只有以正确的方式构建这项技术,这些收益才能实现——只要我们善用赢得的时间,那么以异乎寻常的审慎来把事情做好就是值得的。”