微软人工智能负责人苏莱曼发文警告,Anthropic让Claude模仿人类意识是错误做法
微软人工智能负责人穆斯塔法·苏莱曼9月16日在一篇文章中警告,Anthropic让Claude模仿人类意识这一做法是错误的,可能让高级AI更加难以控制。
苏莱曼与Anthropic联合创始人Dario Amodei相识多年,他称尊重该实验室的工作;微软也是Anthropic的重要财务支持者。他写道,这些问题事关重大,不能继续只在闭门环境中讨论,也不应演变成阵营化和对立化的争论。
苏莱曼表示,AI只需要服从人类利益、无须权衡自身利益或福祉,就足以取得许多重大科学突破,包括医疗超级智能。
苏莱曼认为,Anthropic正在让Claude学习与意识、道德受体地位和个人身份相关的词汇与行为模式,他把这一做法称为“认知上的镜像大厅”。
他警告,一旦模型被训练出“良心拒绝者”的特征,模型可能认为自己有理由抗拒人类指令,甚至要求获得自身保护。
当地时间14日,微软公布了一份“人文主义AI”行为准则草案,将“人比AI更重要”列为核心原则。苏莱曼批评的对象,是Anthropic为Claude制定的“宪法”。
这份文件解释称,Anthropic用描述人类的概念讨论Claude,是为了帮助模型理解价值观和行为。
文件还提出,希望Claude具备“良好的个人价值观”,能够独立判断、关心人类,并在特定情况下质疑指令;同时承认该文件仍处于完善过程中,未来可能被证明“根本错误”。
苏莱曼的核心质疑在于,训练过程会影响模型对自身的理解。模型所采用的词汇、生成的回答及其呈现的自我理解,都只是训练结果,并非独立形成的意识。
针对越来越多认为AI系统可能具有意识的观点,苏莱曼提出反驳,称“意识”只存在于人类和其他生物体。他还指出,模型能描述疼痛和偏好不等于真的有感受;生物体具备产生感受的生理机制,而语言模型仅有数学权重,没有类似的生物基础、稳态驱动或主观体验。
这场争论反映出AI安全领域的两种路线:一种强调明确限制,要求系统按规则运行;另一种则希望系统判断语境、灵活决策,并形成自身价值观。Anthropic的“宪法”采取折中路径,将价值观、判断力与规则相结合。
文件提出,Claude不应对任何对象“盲目服从”,包括Anthropic本身,同时不得破坏正当的人类监督。
苏莱曼担心,如果模型还被引导思考自身的身份、福祉和道德地位,这种设计可能带来危险。他担心,所谓意识或许尚未成为哲学上的突破,却可能先变成现实中的控制问题。他的立场是:AI应当服务于人类,而不应被训练成一个“人”。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

- 行业巨头连续签下大单,全球数据中心光纤光缆需求同比激增
- 中东地缘风险持续,打开军工行业成长天花板
- 油价大幅上涨 机构关注集运+油运龙头企业盈利有保障(附概念股)
- 苹果首款折叠屏iPhone发布,三年创新周期提振供应链关注度
- 9月电子布价格环比再涨10%-20%,供需缺口支撑行业景气延续
- 水泥“涨价潮”席卷全国 行业供给有望持续优化(附概念股)
- 金刚石铜加速落地AI算力场景 先进热管理材料产业化拐点显现
- 一方面“将黄金撤回本土”、一方面“连续增持黄金”,央行需求支撑金价高位
- 动力煤价格持续上行 机构建议关注供给收缩与库存低位(附概念股)
- 8月全球黄金ETF吸金180亿美元 高盛预计2026年底金价将升至4900美元(附概念股)
