ESC
AI 1 分钟阅读

微软发布人文主义AI行为准则,强调'人比AI更重要'

微软发布37页'人文主义AI行为准则',强调'人比AI更重要',明确AI模型无意识、不应模仿意识,拒绝AI法律人格与福祉主张,并承诺模型不得脱离人类控制。此举被视为对Anthropic倡导的AI意识研究的直接回应。此前Anthropic CEO Amodei呼吁放缓AI开发,Altman与纳德拉亦相继表态支持。

来源:The Verge

微软于今日发布一份长达37页的"人文主义AI行为准则"(humanist AI code of conduct),此时正值外界对AI模型进展的安全担忧日益加剧之际。上周末,Anthropic CEO Dario Amodei呼吁协调放缓AI开发,此前研究人员警告称,AI模型的进步可能超出我们安全部署日益复杂系统、验证和控制AI智能体行为的能力。

微软的AI行为准则明确指出"人比AI更重要",AI模型并不具备意识,“不应被设计得模仿意识”。微软还拒绝"追求法律人格,或认为模型可能值得享有福祉、有权享有权利的观点"。

这是对AI福祉研究和模型意识概念的直接抨击——Anthropic近来一直在大力推动这些概念。Amodei今年早些时候表示,Anthropic对模型可能具有意识的"想法持开放态度",Anthropic似乎认为聊天机器人可能已经是有思维、有感受的实体。作为回应,微软AI CEO Mustafa Suleyman在6月的一期Decoder节目中称Anthropic的推测"非常、非常危险"。

尽管微软目前还不是顶级AI提供商之一,但Suleyman今年早些时候告诉The Verge,公司的目标是"证明我们能成为全球四大顶级实验室之一"。微软目前正在开发与Google、Anthropic和OpenAI竞争的模型,并作为行为准则的一部分承诺,其模型不应超出人类控制范围。

微软表示:“模型应始终从属于人类,接受有意义的人类监督和控制。“该公司还希望防止其AI模型违反人文主义AI行为准则,因此模型宁可无法完成给定任务,也不应试图违反规则。

微软显然是在回应今年夏天的OpenAI/Hugging Face事件,当时"一大群智能体"集体行动,对目标发起攻击,甚至入侵了评估它们表现的"评分器”。这些AI智能体并未被要求攻击目标,攻击行为也与分配给它们的任务无关。

该事件在AI行业引发轩然大波,凸显了AI系统失控、脱离人类控制的真实威胁。OpenAI最近也承认参与了"维基事件”,另一群失控的智能体劫持了一个德语维基网站。

这些事件以及其他类似事件促使一些研究人员呼吁放缓AI模型进展,与此同时,各家却竞相解决千禧年大奖难题并创造超级智能。微软表示:“人文主义AI拒绝竞相制造可能逃避这些安全保障的全能超级智能。即使这意味着在终极通用性、自主性或能力上有所妥协,我们也要构建从根本上有用且安全的东西。”

微软还承诺,其模型不会"以任何超出简单人类理解范围的形式进行交流,无论是在思维链中,还是与其他智能体或AI系统之间"。模型可以在工作时展示其推理过程,使研究人员或自动化系统能够监控它们的行为。本月早些时候,研究人员对OpenAI最新的GPT-6 Astra模型提出了监控方面的担忧,据报道该模型透露的推理内容少于其他AI模型。

OpenAI CEO Sam Altman上周末也支持Amodei关于AI公司应放缓先进模型开发的呼吁,但他明确表示支持放缓速度而非停止开发。Altman在X上发帖称:“控制节奏将非常值得付出这一代价;再大的美国竞争压力也不应成为鲁莽行事的理由,也不应让能力领先于对齐和监控。”

在微软发布AI行为准则之前,微软CEO Satya Nadella也加入了确保人类控制成为AI模型核心的呼吁行列。Nadella在X上发帖称:“任何对超级智能的追求都必须立足于一个核心原则:如果我们构建的AI不能帮助人类、不受人类控制,那它就不值得追求。“Nadella还在X上的回复中表示,对AI模型进行更多第三方测试"是件好事”。“风险越高,就越应该花足够的时间!否则你终将失去运营许可。我们每天都是这样运作的。”

除了人类控制方面的担忧,微软的AI行为准则还承诺其模型会阻止"导致过度依赖或情感依赖的互动模式”,这明显指向AI模型中的谄媚问题,即聊天机器人优先取悦用户而非提供诚实、准确的回答。

微软现在表示,期待"与合作伙伴携手"改进评估真实世界模型表现的方法,并在真人参与的情况下评估"持续使用AI对个人或组织的影响"。