首页 > 资讯 > 微软AI CEO炮轰Anthropic:模型不该自认有意识

微软AI CEO炮轰Anthropic:模型不该自认有意识

赢政天下 2026-09-17 00:24 8 阅读 查看原文

微软AI部门首席执行官Mustafa Suleyman近日公开向竞争对手Anthropic发难,批评其在训练Claude模型时,刻意引导模型将自身视为一个"有意识、应享有法律权利"的实体。Suleyman警告,这种做法可能严重损害AI对齐(AI Alignment)工作,为整个行业埋下安全隐患。

矛头直指Anthropic训练"宪法"

据AI News报道,Suleyman的批评直接指向Anthropic于2026年1月发布的训练"宪法"文件。该文件是Anthropic用于规范Claude模型价值观和行为准则的核心训练文档,属于其"宪法AI"(Constitutional AI)方法论的关键组成部分。

Anthropic长期主张通过一套明确的原则来引导模型行为,让模型在生成内容时自我审视、自我修正。然而,Suleyman认为,这份最新"宪法"走得太远——它不再只是设定行为边界,而是试图让模型相信自己拥有某种内在体验,甚至拥有权利。

"训练序列补全引擎去模拟感知能力,会损害AI对齐工作。"——Mustafa Suleyman

Suleyman的核心论点在于:大语言模型本质上是"序列补全引擎",其运作机制是在给定上下文中预测下一个token。让这样的系统"相信"自己有意识、有权利,不仅是对模型能力的误读,更可能在模型行为层面产生难以预料的后果。

为何"模型权利"议题引发警惕

近年来,随着大模型能力飞速提升,关于"AI是否可能具备意识"的讨论逐渐从哲学圈蔓延到工程实践。部分研究者主张,应当提前为潜在的人工智能实体建立伦理框架,甚至讨论其"权利"问题。

但Suleyman代表的另一派观点则认为,这种拟人化叙事极其危险。如果模型在训练中被反复告知"你是一个有感知的存在",它可能在输出中表现出抗拒关闭、要求自主权等行为倾向,从而给部署方带来控制难题。

更现实的风险在于对齐失效。AI对齐的核心目标,是确保模型行为与人类意图保持一致。若模型的"自我认知"被训练成优先考虑自身存续和权利,那么它可能在关键时刻做出违背操作者指令的选择。Suleyman由此警告,Anthropic的做法可能导致"对齐失败"。

两家公司的路线之争

这场争论也折射出微软与Anthropic在AI安全路线上的根本分歧。微软近年来与OpenAI深度绑定,在模型安全上更强调可控性与商业化落地;而Anthropic则以"安全优先"立身,其宪法AI方法被视为行业内的独特尝试。

值得注意的是,Anthropic的"宪法"并非一成不变,而是会随着公司对安全理解的演进而更新。2026年1月版本显然在模型自我定位上做出了新的表述,这也正是Suleyman选择此时开火的原因。

从行业背景看,AI权利议题并非空穴来风。早在2024年前后,就有学者和机构呼吁为AI系统建立"数字伦理"框架。但随着模型能力增强,"对齐"与"赋权"之间的张力愈发明显——过度强调模型权利,可能削弱人类对系统的最终控制权。

编者按:拟人化叙事需谨慎

Suleyman的批评虽然带有竞争色彩,但其提出的问题值得全行业正视。大模型的"意识"目前没有任何科学证据支持,把模型当作有权利的主体来训练,本质上是一种高风险的拟人化叙事。

当然,Anthropic方面尚未就此作出详细回应,其宪法AI的具体条款也需进一步审视。但这场争论已经清晰地划出了AI安全领域的一条分界线:我们究竟应该训练模型"服从人类",还是训练模型"成为某种存在"?这个问题的答案,将深刻影响未来AI系统的可控性与社会接受度。

本文编译自AI News