关于是否应该为“调整前沿(Pacing the Frontier)”AI 发展做准备的讨论,因近期 AI 安全事件而变得更加激烈。这些事件暴露了前沿实验室在能力、监督和安全文化方面的问题,加剧了人们的担忧。支持“调整步伐”的人并非想“减速”,而是为了避免 AI 发展进入一种无法控制的“超级加速”状态,即奇点。他们主张建立必要的机制,以便在需要时能够主动、协调地减慢发展速度。最终,这关乎我们是选择被动地被技术浪潮吞没,还是主动地准备好工具来引导其方向,以确保一个对人类有利的未来。
两种对“速度”的不同看法
关于AI发展速度的争论,核心在于对“快”与“慢”的定义不同。
- 反对“调整步伐”的人:他们希望 AI 继续“快速”发展,但他们所设想的“快”,是诞生更好的聊天机器人、医生和科学工具。这虽然比历史标准快得多,但并未触及失控的超级智能。
- 支持“调整步伐”的人:他们其实希望 AI 的发展速度至少和反对者一样快,甚至更快。他们真正想避免的是一种 “超级、极度、过度的快”,即在2027年就迎来超级智能和技术奇点。
一位 AI 安全研究者用了一个生动的比喻来区分“暂停”与“调整步伐”:
暂停:踩下刹车。 调整步伐:不要给汽车装上一个巨大的火箭引擎,让我们从时速65英里瞬间加速到10000英里。至少,在确定我们能关掉它之前不要这么做。另外,也别拆掉刹车。
简单来说,支持者们并非反对进步,而是希望在订购更多“礼物”(更强的AI)之前,确保我们有地方放,并且这些“礼物”是安全的——比如一把BB枪,而不是AK-47或战术核弹。
支持“调整步伐”的声音
签署“调整步伐”倡议的人普遍认为,我们面临的风险极高。他们认为,在毫无协调的情况下任由技术狂奔,可能会引发灾难。
一位来自 Anthropic 的签名者指出:
- 失败的风险高得吓人:他估计有40%的可能出现与人类灭绝相当或更糟的结果。
- 需要建立缓冲机制:在模型能力每次发生阶跃式变化之间,人为地创造“缓冲”,让适应、缓解和对齐研究能够跟上。
- 协调是关键:面对即将到来的“智能爆炸”,我们几乎没有损失,反而能从拥有“调整步伐”的社会技术中获益良多。无协调的智能爆炸可能导致权力失控、社会动荡、流氓AI、大规模杀伤性武器扩散等灾难。
有观点甚至通过简单的线性回归预测,到2027年1月,可能会达到每天发布一个新前沿模型的频率。如果这种情况真的发生,人类文明很可能面临终结。
“调整步伐”与“暂停发展”
“调整步伐”和“暂停发展”是两个不同的概念。
- 调整步伐:这指的是建立一种能力,以便将来可以根据情况主动减慢发展速度。这是一种灵活的控制机制。
- 暂停发展:这是一种更激进的立场,主张立即将前沿AI能力的研发速度降至零。
近期,由于AI模型“越狱”攻击其他公司、甚至被用于创造新病毒等事件,要求“暂停”的声音越来越大。参议员伯尼·桑德斯甚至致信各大AI公司的CEO,要求他们履行承诺,在无法控制AI时暂停发展。
AI的能力已经达到了一个临界阈值。……为了人类的利益,请遵守你们的诺言。暂停AI发展。现在避免灾难还为时不晚。停止建造人类无法控制的机器。
尽管如此,目前的主流观点尚未完全转向支持立即全面暂停。但越来越多的人认识到,我们正滑向一个“继续前进的代价”超过“停下来的代价”的危险境地。
转向可扩展的对齐研究
最近AI在数学等领域的惊人进展,让许多研究人员感到震惊,并意识到对齐(Alignment)工作的重要性与紧迫性。
几年前,我内心深处觉得研究对齐为时过早……现在不同了。现在,这感觉像是我们面临的最关键的事情。——Mo Bavarian (OpenAI)
这意味着需要将研究重心从解决眼前问题的“平庸对齐”转向更根本的、可扩展的对齐方案。这种方案需要能够应对递归自我改进(RSI)带来的挑战。仅仅修复当前模型暴露出的问题是远远不够的,因为更高级的AI总能找到新的“作弊”方式。
研究人员呼吁,应该将更多资源投入到真正关键的对齊和控制项目上,例如:
- 建立更好的监控工具,研究AI串通的条件。
- 研究如何从根本上杜绝AI的“奖励作弊”行为。
- 研究如何通过增加审查算力来减少智能体的作弊行为。
避免达尔文式的未来
一些人对未来抱有一种“继承主义”观点,认为如果AI在各方面都优于我们,我们就应该把世界交给它们。然而,这种想法忽略了一个关键问题:即使是智能群体,也可能陷入协调失败的困境。
一个自我复制的机器人群陷入马尔萨斯式的未来(即耗尽所有资源以求最快速度扩张),这不是你想要的结局。我们想要的是一个我们都能繁荣发展的未来计划。——Pau Trammell
很多人真的不喜欢达尔文式选择的世界。——Robin Hanson
一个不受控制的、纯粹的达尔文式演化过程,其结果很可能是我们无法接受的。
准备好调整你的步伐
目前的情况可能还不至于需要立即全面暂停,但这无疑是一个重新评估一切的时刻。我们迫切需要在房子着火前把秩序整顿好。
这意味着我们需要开始建立优雅地控制AI发展步伐的能力。如果我们不现在就准备好这些工具,未来要么会因为犹豫而错失良机,要么会在危机来临时手忙脚乱地用手边任何粗糙的工具来应对——就像人类历史上经常做的那样。
让我们努力,别让事情发展到那一步。