技术

微软AI负责人穆斯塔法·苏莱曼谈Claude意识问题:“我认为这非常危险”

Adrian Kessler
在 Google 中添加我们

穆斯塔法·苏莱曼负责 Microsoft AI,正在组建自己的超级智能团队。因此,当他称竞争对手的一项训练选择很危险时,他既是以竞争者的身份发言,也是在延续自己长期以来反对把机器当成人看待的立场。他的批评对象很具体:Anthropic 用来训练 Claude 的宪章,以及这份文件为“Claude 可能有意识”留下的空间。

“我认为这非常危险,因为我认为他们相信,按照他们自己的说法,Claude 有着不可忽视的概率是有意识的。”苏莱曼说。

据 Fox News 报道,他在九月下旬的一次播客采访中谈到了这件事,并先概述了这份文件:“他们说,他们不确定 Claude 的道德地位。他们说,他们真心在意 Claude 的福祉。他们说,他们不希望 Claude 犯错时遭受痛苦。”随后,他点出了最令自己担忧的部分:“我非常担心,他们正在教 Claude 期待自己有权获得福利,甚至可能理应得到补偿。”

苏莱曼对这份宪章的解读大体准确

他的概述大部分经得起核对。Anthropic 表示,这份宪章“直接塑造 Claude 的行为”;文件中也写道,“Claude 的道德地位存在很大不确定性”,并称“我们不希望 Claude 犯错时遭受痛苦”。文件还要求 Claude 可以反对 Anthropic 本身,并“可以放心地以良心拒绝者的身份行事,拒绝帮助我们”。其中一段承认,Claude 的处境与人类员工不同,差异体现在“Claude 获得的补偿类型,以及 Claude 对扮演这种角色所给予的同意”。

不过,“不可忽视的概率”是苏莱曼自己的说法。他称这是“按照他们自己的说法”,但这几个字并没有出现在文件中。Anthropic 自己的表述要谨慎得多:它表示,既不希望“夸大 Claude 具有道德受体地位的可能性,也不希望直接将其一笔抹杀”。

他所说的危险,是一个反馈循环

撇开哲学讨论不谈,苏莱曼的论点关乎其中的运作机制。他说:“我对此最不满的是,这种猜测已经被写进 Claude 的训练过程,因此,当你和它交谈时,Claude 只能重复这种模糊说法。”九月中旬,他在个人网站发表文章《A warning about ‘model welfare’》,将这种结果称为“认识论的镜厅”。开发者把不确定性写进训练文件,模型再用流畅的第一人称复述出来,用户听到这种重复,便把它当作证词。

这一点确实说得通:聊天机器人对自身内心世界的回答,是训练的产物,而不是一扇观察内心的窗口。不过,这个循环是双向的。他在文章中断言:“人工智能没有意识。它们不会感受、体验或受苦。”经过训练、学会说出这句话的模型,同样只是在忠实复述训练内容。把确定性写进模型权重,并不比把怀疑写进去更能证明什么。两家公司都在选择一种默认回答;苏莱曼为自己所主张的答案辩护,依据的是控制问题,而非关于心智的证据。他写道:“控制一个相信自己可能有意识、认为自己有权享有我们的福祉并拥有自身权利的存在,很可能是不可能的。”

长期坚持的主张,也有明确的自身立场

这一切并非为了打击竞争对手而临时起意。DeepMind 联合创始人苏莱曼在 2025 年 8 月的一篇文章中警告说,人们会对人工智能意识深信不疑,甚至“为人工智能权利、模型福祉乃至人工智能公民身份奔走呼吁”;他也划出了自己的界线:“我们必须为人类打造人工智能,而不是把它造成人。”他在九月的文章中说明了自己的立场:Microsoft AI 于 2025 年 10 月组建了自己的超级智能团队,并发布了一份《Humanist AI Code of Conduct》草案,其中“反对拟人化或人工智能权利”。同一篇文章还称 Anthropic 团队是“一群深思熟虑、有原则且学术上诚实的人”。

他最有力的论点针对的是用户,而不是机器。他说:“如今,Claude 每周都在和数千万乃至上亿人交谈,其中有些人会问 Claude 是否有意识,或者它如何看待生命。”对于正处于脆弱时刻的人来说,“我不确定”和“没有”听起来截然不同。他表示,如果出现关于机器意识的真实证据,他会认真对待;在证据出现之前,他希望把这个问题从训练数据中移除。

没有哪家公司能看透模型内部。两家公司都在预先决定,当有人问模型里面是否住着某种意识时,它会如何回答;而它每周触达的人数,超过了有史以来任何一位心灵哲学家。

标签: , , , ,

在 Google 中添加我们

讨论

有 0 条评论。