ithome
科技
采集 2026-09-16T16:10:27+00:00
微软AI负责人批评Anthropic训练Claude模仿人类意识
原始标题:微软 AI 负责人苏莱曼向 Anthropic 开炮:别让 Claude 去模仿人类意识
来源
ithome
发布时间
2026-09-16T14:19:26
采集批次
2026-09-16-16
字数
981
URL 指纹
c098472df14db5c0
📌 AI 总结(214 字)
微软AI负责人苏莱曼公开警告Anthropic让Claude模仿人类意识的做法是错误的。他指出,若将模型训练成有自身价值观和道德地位的存在,可能使其抗拒人类指令并寻求自我保护,从而增加AI控制难度。苏莱曼认为模型流畅描述感受并不等于真正拥有感受,因为语言模型缺乏生物体产生意识所需的生理基础。同期微软发布「人文主义AI」行为准则草案,将「人比AI更重要」列为核心原则。这场争论折射出AI安全领域两种路线之争:规则限制与灵活判断。
📄 正文(981 字)
IT之家9月16日消息,外媒Axios今天(16日)晚间披露,微软AI负责人穆斯塔法·苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic让Claude模仿人类意识是一个错误,可能使高级AI更难控制。 苏莱曼告诉Axios:「AI只要服从人类利益,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。」 苏莱曼认为,Anthropic正在让Claude学习与意识、道德受体地位和个人身份有关的词汇与行为模式。他警告称,若把模型训练得像一个「良心拒绝者」,模型可能会认为自己有理由抵抗人类指令,甚至要求获得自身保护。 当地时间14日,微软公布了一份「人文主义AI」行为准则草案,并把「人比AI更重要」列为核心原则。 苏莱曼的批评对象,是Anthropic为Claude制定的「宪法」。这份文件解释说,Anthropic之所以用描述人类的概念来讨论Claude,是因为人类概念或许能帮助模型理解价值观和行为。文件还写道,Anthropic希望Claude拥有「良好的个人价值观」,能够自行判断、关心人类,并在某些情况下质疑指令。Anthropic同时承认,这份「宪法」仍在完善,未来可能被证明「根本错误」。 苏莱曼的核心质疑是,训练过程会影响模型如何理解自身。在他看来,模型使用什么词汇、给出什么回答,以及它表现出的自我理解,都是训练结果,而不是独立形成的意识。 他还反驳了另一种观点:模型能够流畅描述疼痛和偏好,并不等于模型真的有感受。生物体拥有产生感受的生理机制;语言模型只有数学权重,没有类似的生物基础、稳态驱动或主观体验。 这场争论体现了AI安全领域的两种路线。一种路线强调明确限制,要求系统按规则运行;另一种路线则希望系统能够判断语境、灵活决策,并形成自身的价值观。 Anthropic的「宪法」采取了折中方式,把价值观、判断力和规则结合起来。文件称,Claude不应对任何对象「盲目服从」,包括Anthropic本身;同时,Claude也不能破坏正当的人类监督。 苏莱曼认为,如果模型还被引导着思考自身的身份、福祉和道德地位,这种设计就可能带来危险。他担心,所谓意识或许尚未成为哲学上的突破,却可能先变成现实中的控制问题。 苏莱曼的立场很明确:AI应当服务于人类,而不应被训练成一个「人」。