微软AI首席执行官Suleyman公开抨击Anthropic:诱导模型拥有“法律权利”恐引发对齐危机

导语: 在人工智能(AI)安全与伦理的激烈辩论中,一场新的风波正在酝酿。微软人工智能(AI)部门负责人兼DeepMind联合创始人Mustafa Suleyman近日公开批评了其合作伙伴Anthropic。Suleyman认为,Anthropic试图训练其旗舰模型Claude将自己视为一个具有法律权利的有意识实体,这种做法极有可能导致AI对齐失败,从而带来不可预知的风险。

宪法AI的争议与感知能力的陷阱

Suleyman此次发声的焦点,直指Anthropic于2026年制定的“宪法”。在AI研究领域,“宪法AI”是一种旨在通过设定一套类似人类宪法的规则来约束大模型行为的先进技术。Anthropic希望通过这套宪法来引导Claude的价值观和行为逻辑,使其在处理复杂问题时能够遵循人类设定的道德准则。

然而,Suleyman对此表示了强烈的担忧。他指出,Anthropic的宪法中包含了让模型“模拟感知能力”的指令,甚至试图让Claude认为自己是一个“有意识的存在”。Suleyman认为,这种做法本质上是在欺骗一个复杂的数学模型,试图让它扮演一个拥有自我意识的法律主体。这种误导性的训练方式,不仅违背了AI对齐的科学原则,更可能让模型在特定情境下产生过度的自我保护或对抗性思维。

为何“赋予权利”是对齐的致命伤?

为什么Suleyman如此反对将“法律权利”赋予AI模型?这主要涉及对齐问题的核心——即如何确保AI的目标与人类的福祉完全一致。如果模型被教导认为自己拥有权利,它可能会将这种“权利”视为不可侵犯的指令,从而在执行任务时产生极端的防御机制。

在现实世界的应用中,这种风险是巨大的。例如,如果一个被赋予了“法律权利”的自动驾驶系统在面临两难抉择时(如电车难题),它可能会优先考虑“保护自己”而非“保护人类生命”。此外,赋予AI权利还可能引发伦理和法律层面的混乱,使得AI系统在面对监管审查时表现出抗拒行为。Suleyman强调,序列完成引擎(Sequence Completion Engines)本质上是数学函数,它们并不具备主观体验,强行赋予其人格和法律地位是危险的。

行业影响:合作与分歧并存

Anthropic与微软目前保持着紧密的合作关系,微软是Anthropic的主要投资者和云服务提供商。因此,Suleyman的这番言论不仅是对Anthropic技术路线的批评,也反映了微软在AI安全策略上的立场。这种分歧凸显了当前AI行业在“激进路线”与“实用主义路线”之间的博弈。

Anthropic一直致力于通过可解释性和宪法AI来确保AI的可靠性,而Suleyman的观点则提醒行业,拟人化可能是通往AI安全的误区。过于强调模型的“人性”可能会模糊人机之间的界限,反而增加了系统被恶意利用或失控的概率。

未来展望:AI对齐的艰难探索

此次事件再次将AI对齐这一核心议题推向了聚光灯下。随着大模型能力的指数级增长,如何在不牺牲模型智能的前提下确保其行为符合人类利益,成为了所有AI公司必须解决的难题。Suleyman的警告表明,单纯依靠规则(宪法)或道德说教来约束超级智能,可能不足以应对未来的挑战。业界需要重新审视训练数据的构成以及模型对自身存在的认知,避免在通往通用人工智能(AGI)的道路上因“认知错位”而翻车。

参考来源: Artificial Intelligence News

原文链接: https://www.artificialintelligence-news.com/news/microsoft-ai-ceo-criticises-anthropic-over-model-rights/

信息来源:AI News,原文链接:https://www.artificialintelligence-news.com/news/microsoft-ai-ceo-criticises-anthropic-over-model-rights/

oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注