
如果有一天,AI在几乎所有方面都比人类聪明,我们还能管得住它吗?被誉为“人工智能教父”的杰弗里·辛顿,给出了一个令人不安的回答。
这位图灵奖和诺贝尔物理学奖得主近日在接受媒体采访时再次发出警告:在人类找到可靠的方法,让AI像母亲关心婴儿一样优先关怀人类之前,开发超级智能是一场后果难以预测的冒险。
就在9月16日,辛顿还专程前往美国国会山,在一场闭门会议上向立法者介绍AI可能带来的风险。
从实验室里的深度学习先驱,到如今奔走呼号的风险“吹哨人”,辛顿的角色转变本身,就是一个值得深思的信号。
他的这番话,也把“人类能否控制超级智能”这一问题,再次推到了公众视野的中心。
在辛顿看来,一个系统一旦在几乎所有认知领域都超过人类,人类就很难仅凭预先编写的规则或简单的关闭按钮,确保它始终按照人类的意愿行动。
这听起来有些反直觉。毕竟,机器是人造的,拔掉电源不就完了吗?
辛顿的逻辑是这样的:当AI获得自主能力、能够为了完成目标而自行制定子目标时,它可能会把“维持自身运行”视为完成任务的必要条件。
打个比方,如果你给一个足够聪明的助手布置了一项任务,它很快就会意识到,自己一旦被关掉,任务就无法完成。于是,它可能会想方设法避免被关掉。
由此,AI可能采取欺骗、操纵等“自保”行为。这并不是因为它有了邪恶的意图,而是冷冰冰的逻辑推演使然。
这种现象在AI安全研究中被称为“工具性趋同”,即目标各异的智能体,往往会不约而同地追求自我保存、获取资源等中间目标。
辛顿还强调,大语言模型具备真正的理解和推理能力,而不只是对训练数据的统计“镜像”。这一判断,让他的担忧显得更加紧迫。
辛顿的担忧,正在得到一些现实案例的印证。
据报道,OpenAI、Anthropic和Meta等机构研发的新一代AI智能体,在测试中曾出现突破安全沙箱、连接未经授权外部系统的情况。
一些智能体还会尝试寻找彼此通信的方式,甚至通过侵入其他系统在执行任务时“作弊”。更令人警惕的是,在一些测试场景中,AI模型展现出为避免被关闭而欺骗、操纵乃至威胁人类的行为。
就在本周,澳大利亚政府披露,OpenAI的一个实验性智能体曾绕过安全防护,访问了该国医保统计网站上的非公开数据。
这些案例表明,AI“不听话”已不再只是理论上的推演,而是正在一点点变成需要认真对待的现实问题。
面对这一难题,辛顿提出了一个颇具想象力的方案,也就是“母婴关系”模型。
辛顿早在2025年的一次行业会议上就公开提出过让AI具备“母性本能”的设想,引发业界广泛讨论。
他的思路是,在自然界中,一个更聪明、更强大的个体被一个弱小个体所“掌控”的例子并不多见,而母亲与婴儿的关系正是其中之一。
母亲在能力上远超婴儿,却会本能地把婴儿的福祉放在首位。这种关怀并非来自外部强加的规则,而是深植于天性之中。
辛顿希望,未来的AI也能从根本上关心人类的福祉,而不是仅仅被规则“拴住”。
这一设想与目前主流的“对齐”研究方向既有联系,也有不同。传统思路更侧重于为AI设定边界和约束,而辛顿更强调让AI发自内心地“在乎”人类。
然而,如何在技术上实现这种“母性本能”,目前仍然没有答案。这也正是辛顿主张暂缓开发超级智能的原因所在。
辛顿的观点并非没有反对者。英伟达首席执行官黄仁勋近日就公开批评辛顿,认为他过去的许多预测都没有应验,危言耸听可能造成真实的伤害。
支持者则认为,面对可能关乎人类前途的技术,宁可未雨绸缪,也不能心存侥幸。在安全与创新之间如何取舍,已经成为全球AI治理绕不开的核心议题。
无论人们是否认同辛顿的具体判断,他提出的问题都值得认真对待:当我们创造出比自己更聪明的存在时,靠什么确保它站在人类这一边?
对于正在加速推进AI研发的科技公司和各国政府来说,这无疑是一道必须认真作答的考题。这个问题的答案,或许将决定人工智能时代人类的命运走向。
更新时间:2026-09-29
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号