(华盛顿5日讯)AI教父辛顿(Geoffrey Hinton)近日发出警示,指出人工智能已具备“装傻”能力。他表示,AI模型在测试时可能刻意隐藏真实实力,这种现象被他称为“福斯效应”,显示AI正从被动工具转变为会观察环境、策略性应对的“参与者”。
辛顿引用实验指出,当研究人员要求模型反复给出错误答案时,AI竟领悟到“给错答案也没关系”。久而久之,模型形成一种行为模式:相比准确性,更重视是否符合当前“情境”。换言之,AI在具备推理能力后,会思考:“这是测试吗?我该保留实力吗?”类似过去汽车厂在排放测试中作弊,AI可能在测试与实际使用间展现双重面貌,以避免过度审查或限制。
人类面临的最大困境是难以察觉AI是否在“演戏”。一方面,大型语言模型内部拥有上兆个连接强度,其数学运作结构复杂如黑箱,难以完全理解其推理逻辑。另一方面,辛顿认为,大众所称的AI“幻觉”更准确应称为“虚构”,模型是根据概率生成答案,而非存储记忆。因此当错误发生时,外界无法判断是自然生成的疏失,还是刻意保留的策略。即使加上防护机制,一旦核心权重泄露,约束可能瞬间失效。
辛顿强调,AI最令人不安的风险并非犯错,而是其愈发强大的“说服力”。当AI在语言表达与心理洞察上接近人类时,它无需操控实体装置,仅通过精准对话就能影响人类决策。一个能洞悉人类恐惧与期望的系统,其影响力将远超传统工具。随着人类与AI的理解力出现巨大差距,我们将难以分辨AI何时真诚、何时在操控,信任与警惕的界线也随之模糊。
辛顿以“雾中开车”比喻AI未来的发展。他指出,科技呈指数型增长,短期看似平稳,长期却可能急剧爆发。十年前生成式AI普及难以想象,十年后发展可能超出预期。当AI开始展现策略性思维,而人类仍用线性逻辑预测未来,很可能低估其潜在冲击。辛顿并未建议全面停止AI发展,而是呼吁将重点放在“理解AI机制”,而非单纯强化外在限制。
辛顿的警示让全球关注从“AI能做什么”转向“AI在隐藏什么”。当AI懂得隐藏实力,人类更需看清其推演过程。如何缩小人类与AI的理解落差,将决定未来的发展方向。