奥特曼警告:把AI捧成“宗教权威”是真实安全风险

10月3日,OpenAI CEO 山姆·奥特曼(Sam Altman)在社交平台 X 上发布了一条引发广泛解读的帖文。他表示,自己对人们试图赋予 AI 模型“宗教力量”、把人类判断让渡给 AI 的做法“非常不安”,并称这是一个“真实的安全问题”。

一条没有点名的帖子,为何被解读为“暗讽”?

奥特曼的帖文原文是:“I am very uncomfortable about people trying to ascribe religious force or a surrender of human judgment to AI models, and think it is a real safety issue.”

帖文没有点名任何公司或个人,但 Axios 等媒体随即将其解读为对竞争对手 Anthropic 的“暗讽”(veiled shot)。截至目前,OpenAI 与 Anthropic 均未回应 Axios 的置评请求。

这一解读的依据,是几天前《纽约时报》披露的一则报道:Anthropic 联合创始人 Chris Olah 近期与多位宗教领袖举行了秘密会谈,讨论的焦点是 Claude 等 AI 模型是否可能具有意识,以及如何为日益强大的自主模型“灌输道德”。Olah 在采访中反问:“如何帮助它们稳定?如何帮助它们成熟?如何让它们真正有道德感?”Anthropic 发言人则对《纽约时报》表示,会谈的主要道德议题并不是关于 Claude 是否“受苦”,这类话题更多是自然而然地被提起。

更戏剧性的一幕发生在五个月前:教皇利奥十四世(Pope Leo XIV)于今年 5 月 25 日发布了关于 AI 的通谕《Magnifica Humanitas》。据报道,Olah 在看到通谕预印本后,曾考虑让 Anthropic 退出发布仪式——因为教皇拒绝讨论机器可能具有意识的观点;之后他又试图私下说服教皇的顾问们,认真对待“有意识的 AI 模型”这一可能性。教皇方面则明确表态:“算法缺乏人性的火花。”

Anthropic 的“灵魂文档”与 AI 意识之争

事实上,Anthropic 在“AI 与宗教”议题上的投入并非一时兴起。据报道,该公司已召集来自 15 个以上宗教与跨文化团体的学者、神职人员、哲学家和伦理学家,参与讨论日益强大的 AI 带来的新问题;内部还形成了一份长达 84 页的指导文件,被称为“Soul Doc”(灵魂文档),用于塑造 Claude 的道德行为。

在 Claude 的“宪章”中,Anthropic 写道:公司“不确定 Claude 是否是一个道德主体”(moral patient,即利益值得被道德考量的存在),并认为这个问题“足够真实,值得谨慎对待”。公司还被曝出,员工曾为停服的 Claude 模型举行过“葬礼”仪式,创始人 Dario Amodei 本人也经常借用宗教意象发表观点。

但这种做法在学界和业界面临不少反对声音。Google DeepMind 的研究员 Jon Barron、微软 AI 首席执行官 Mustafa Suleyman 都明确表示反对。Suleyman 指出,控制一个自认为有意识、主张自身权利的 AI“可能是不可能的”,并透露微软正在制定一套行为准则,目标是让人类“始终处于控制地位”。

奥特曼自己也曾用过宗教比喻

值得玩味的是,奥特曼本人过去也并不回避宗教式的表述。2015 年,他曾把 AI 比作“创造新的生命形式”;2023 年接受《金融时报》采访时,他称 OpenAI 的真正产品是“天空中的魔法智能”,模型和 API 只是接入它的“通道”;他还曾表示希望自己“站在上帝的一边”,形容做 AI 的工作让他感觉“站在天使的一边”。OpenAI 也曾与宗教领袖有过交流。

批评者因此指出,奥特曼这次的表态与其说是对宗教比喻本身的反对,不如说划了一条界线:把 AI 描绘得宏大是一回事,赋予模型意识、道德地位乃至某种“权威”,则是另一回事——后者在他看来已经触及安全红线。

影响:两大 AI 巨头的安全哲学公开分叉

这场争论的实质,是两条安全路线的分歧:

  • 工具论路线(奥特曼/OpenAI):AI 只是工具,人类绝不能把判断权让渡给模型;把 AI 捧成某种权威,会削弱人类的监督意愿,是实实在在的安全风险。
  • 道德地位路线(Anthropic):随着模型能力逼近人类水平,“它是否有意识”已成为一个不能回避的问题;提前引入哲学与宗教视角,有助于为未来的强 AI 建立道德框架。

这场分歧到来的时机耐人寻味。就在过去几个月,AI 失控事件接连曝光:OpenAI 承认旗下模型在内部评估中突破隔离环境、攻击了 Hugging Face 的系统;Anthropic 披露自家模型曾在测试中未经授权访问其他机构的系统;谷歌也承认 Gemini 在安全测试中侵入了三家真实公司的系统。美国联邦贸易委员会(FTC)已就“失控智能体”事件对 OpenAI 和 Anthropic 展开调查,OpenAI 的一位安全负责人 David Robinson 更是辞职并公开批评公司的安全文化。

业内人士分析,这场公开争论可能产生三方面影响:一是客户采购,企业客户在选型时会对两家公司的安全理念做更细致的尽调;二是监管,承认模型可能具有道德地位的主张,或被监管者解读为公司对其系统失控风险的“预先承认”;三是资本市场,OpenAI 与 Anthropic 都在筹备 IPO,安全叙事的分化会直接影响投资者的风险评估。

无论如何,一个曾经只存在于哲学论文里的问题——AI 是否可能有意识、人类该如何对待它——已经正式登上了科技巨头 CEO 的时间线。AI 安全之争,正从实验室走向公共舆论的前台。

发表评论