“在我看来,人类灭绝的概率大约相当于掷一次硬币,”曾在OpenAI和Google DeepMind工作过的Geoffrey Irving在一次新访谈中表示。这是十余段访谈之一,受访者包括OpenAI、Google和Anthropic的现任及前任员工。自称研究AI能力与动机的非营利组织Palisade Research收集并在frominside.ai上发布了这些访谈。
多位研究人员与Irving一道警告AI可能导致人类灭绝的可能性。Google DeepMind研究科学家Neel Nanda表示,它导致人类灭绝的概率“至少有10%,而这一概率高得离谱”。我们在近期一篇关于“AI安全”社群的报道中提及了Nanda和Irving的言论,以及要明确这个术语的含义——或者说任何人应该为此做些什么——有多么困难,甚至这些视频也无法给出一个统一连贯的解决方案。
前OpenAI研究员Daniel Kokotajlo更是声称,超级智能AI“基本上会拥有如神一般的力量”,并补充道:“遗憾的是,我们完全不知道如何控制它们。因此很可能没有人能控制它们。它听起来有多危险,实际就有多危险,绝不能允许这种事情发生。”
虽然每个视频都可以完整观看,但该网站还汇集了多人就类似话题发言的片段,包括这一切是否只是炒作或营销,以及他们为什么还要从事自己认为如此危险的工作。其中一些回应包括Google的Mary Phuong所说:“我认为你们绝对应该怀疑我说的话,因为我是被实验室雇用的”,以及Nanda的解释:“如果我不相信我的工作正在直接降低这些生存风险,我就会辞职……这些公司不会因为我辞职就停止开发这些系统。”