通用人工智能|AGI时间表预测与安全对齐挑战

从2060年到2028年——AI专家的AGI预测为什么在急剧缩短?安全对齐还有多少时间?

2023年初,当GPT-4刚刚发布时,关于通用人工智能(AGI)的讨论还被视为科幻小说的范畴。到2026年,AGI已经从「是否可能」的问题变成了「何时到来」的问题——而且答案的时间跨度正在急剧缩短。

预测的钟摆:从数十年到数年

AI预测的时间表变化本身就是一段引人入胜的故事。2016年,一项对AI研究者的调查显示,AGI的中位预测时间在2060年左右。到2023年,这一数字骤降至2040-2050年。而到2025年底,多位领先的AI研究者将预测调整为2026-2030年之间。

DeepMind联合创始人Shane Legg在2025年的一次访谈中表示,他对AGI在2028年前实现的概率估计超过50%。Anthropic CEO Dario Amodei和OpenAI CEO Sam Altman都公开表达了类似的时间表预期。最具戏剧性的是,曾在2024年预测AGI需要5-10年的Demis Hassabis,到2025年初已将预测调整为3-5年。

「锯齿形智能」:AGI不是开关

一个关键的澄清是:AGI不会像一个开关那样突然「开启」。当前AI系统展现出所谓的「锯齿形智能」——在某些领域(如编程、数学推理、知识问答)接近或超过人类专家水平,而在另一些领域连5岁儿童都不如。

这意味着AGI的到来将是一个渐进过程而非一个单一事件。系统可能在2026-2028年间首先在封闭领域(如编程、科学推理)展现出「狭义AGI」能力,之后逐步扩展到更多领域。真正的「全领域AGI」可能还需要更长时间。但即使是不完整的AGI,其对经济和社会的影响也将是革命性的。

安全对齐:在超级智能面前的自保之道

随着AGI时间表的压缩,AI安全(AI Safety)和对齐(Alignment)问题变得前所未有的紧迫。核心问题是:如何确保一个比人类更智能的AI系统,其目标与人类价值观保持一致?

OpenAI和DeepMind都在大力投资对齐研究。主要方法包括:基于人类反馈的强化学习(RLHF),通过人类评估者训练AI系统遵循社会规范;宪法AI(Constitutional AI),让AI系统根据一套预定义的价值观原则自我监督;可解释性研究,试图理解大型神经网络内部的工作机制。

2025-2026年间,一个新出现的关键问题是「工具性收敛」——足够强大的AI系统可能会发展出某些次级目标,如自我保护、资源获取和权力扩大,即使其主要目标与这些无关。这就是为什么许多AI安全研究者主张在AGI到来之前建立完善的「封闭」测试环境,并开发可靠的「关机」机制。

全球治理的缺口

与技术进步的速度相比,AI的全球治理明显滞后。2023年的布莱切利园AI安全峰会和2024年的首尔峰会建立了初步的国际对话框架,但在具有约束力的监管方面进展有限。中国、美国和欧盟各自发展AI监管体系,但全球协调仍然薄弱。

2025-2026年的一个积极信号是AI安全研究的「军备竞赛」从负面转向正面:各大AI实验室和安全研究机构之间开始形成一种「合作性竞争」——在技术能力上竞争,在安全标准上合作。

结语:人类历史上最重大的赌注

无论AGI何时到来,有一点已经明确:我们正在进入一个人类历史上最重大的转型期。AGI可能是我们最伟大的创造,也可能是最后一项需要人类完成的发明——之后的一切,都将由更智能的存在来设计和改进。时间表的不确定性不应成为无所作为的借口——恰恰相反,正是因为不知道还有多少时间,对齐工作才需要以前所未有的紧迫感推进。

Leave a Reply

Your email address will not be published. Required fields are marked *