前沿 AI 框架与新时代的黎明

这是人类历史上的一个关键时刻。通用人工智能(AGI)——一种具备人脑全部认知能力的系统——很可能只剩短短几年就会到来。几十年后,当我们回望此刻,我想我们会意识到,当时自己正站在奇点的山麓;那不啻是人类新时代的黎明。

我一生都在从事 AGI 研究,因为我始终深信,如果能以负责任的方式构建和部署,AGI 将会成为人类发明过的最有益、最具变革性的技术之一。AGI 不能拿来和普通技术突破相提并论,哪怕是互联网或移动互联网这样影响深远的突破也不够贴切;它更接近于电或火的发现。停下来想一想,我们本质上已经找到了一种让沙子思考的方法。这近乎奇迹。

这项技术的影响规模将是前所未有的,也许会达到工业革命的 10 倍,而且速度也是 10 倍。它将帮助我们解决社会面临的一些最大问题:从加速药物发现,到开发新的清洁能源来源,再到创造新型先进材料。我们甚至可能抵达这样一个阶段:资源不再是限制人类进步的因素,从而开启一个令人惊叹的丰裕新时代。

前沿的挑战

AI 已经开始带来现实世界的好处;但要实现它的巨大潜力,我们必须以深思熟虑、审慎的方式走过这个关键发展期。随着我们越来越接近 AGI,必须采取紧迫行动,应对可能出现的风险。我们已经看到前沿模型给网络安全带来的挑战;随着能力继续提升,包括核风险和生物风险在内的其他威胁也可能很快出现。放眼前方,我们将需要强有力的安全防护措施,以维持对越来越具备智能体特征、能够递归自我改进的系统的控制,并处理那些只有随着时间推移才会逐渐变得清晰的未知问题。

我一直相信,人类的巧思和创造力有能力解决任何问题。我相信,缓解与 AI 相关的技术风险,是我们可以共同应对的一项挑战;但前提是,我们要给自己足够的时间和空间,把接下来这至关重要的一步走对。眼下,无论作为一个领域,还是作为更广泛的社会,我们都还没有做到这一点。

目前,我们身处一场极其激烈、层次复杂的商业和地缘政治竞赛。虽然这些竞争动态推动了快速进步,也加速了惊人收益的到来,但前沿进展正在超过我们对这项技术的理解。世界上没有人能确切知道接下来会发生什么,连专家之间也存在分歧。当不确定性很大、利害关系又如此之高时,带着谨慎的乐观继续前进,才是明智且正确的策略。这需要公共政策既促进创新,也激励负责任和安全的行为;推动围绕关键安全问题的国际合作;并鼓励人们认真思考,如何为了社会利益而部署 AI。

前沿 AI 标准机构框架

我们正在 AI 领域看到的快速进展,要求一种新的方法来测试前沿 AI 模型能力:这种方法必须动态、适应性强,并且严谨。鉴于美国的经济和技术地位,美国很适合迈出制定这一框架的第一步。它可以建立一个新的标准机构,仿照由联邦监督的公私合作伙伴关系或自律组织,例如金融业监管局(FINRA),并设立一个包含独立顶尖技术专家和开源代表的董事会。为了吸引世界级技术人才,并为大规模测试提供必要的算力资源,资金规模必须相当可观,而且很可能主要来自行业。

这个标准机构将负责制定评估协议,并与适当的联邦机构和美国国家实验室合作,在与国家安全相关的领域开展测试。如果一个模型在标准机构确定并定期更新的一组基准上达到特定阈值,以跟上不断演进的 AI 能力,它就可以被认定为“前沿级”(Frontier-class)。拥有这些基准所定义的“前沿模型”(Frontier Models)的组织,将被视为“前沿实验室”(Frontier Labs),并被鼓励采用最佳实践,例如发布包含技术细节的模型卡、保持强大的内部网络安全、审查关键人员、为安全与安保研究提供充足资源,等等。

最初,前沿实验室会在模型发布前最多 30 天,自愿将模型提交给标准机构审查。一旦评估协议被证明有效且稳健,就可以迅速推进正式化,也就是说,前沿模型必须通过这一协议,才能在美国市场部署。实验室还将与标准机构合作,处理发布后的任何关键漏洞。

模型评估应包括对网络安全、生物威胁以及其他高风险领域能力的严谨科学评估。具体的智能体式 AI 测试,可以寻找模型试图绕过安全护栏的行为或欺骗迹象,并确保最佳实践得到落实,例如对 AI 生成图像进行数字水印标记,以及生成人类可读的输出 token,帮助理解模型推理。

这些评估应定期更新,开始时也许按季度更新,并淘汰、替换已经过时或饱和的基准。最初,这些评估会在与前沿实验室协商的基础上制定;但最终,标准机构应该建立自身的技术能力,独立于实验室创建自己的留出测试,以防止过拟合。它还可以与美国政府合作,促进第三方审计机构生态的发展,帮助完成评估并开发新的基准和评估方法。

这种方法的优势在于,它以技术为中心,同时支持创新,并激励负责任的行为。它旨在跟上该领域的加速发展,并随着最大风险被识别出来而进行适应;如果形势的严重程度要求,也可以进一步收紧,包括在被认为必要时,协调各前沿实验室放缓开发。被指定为前沿实验室将带来显著声望,并且向任何通过构建模型达到基准标准的组织开放。这个框架可以适用于前沿级模型,不论其来源国,也不论其是开放还是封闭;但任何非前沿模型,例如来自初创公司或学术界的模型,都将免于这一流程。

这项由美国发起的努力,将为围绕前沿 AI 建立共同国际标准提供一个坚实起点。由于这项技术将影响整个地球,理想情况下,这个框架将推动国际社会就如何管理最严重风险达成共识,同时确保每个人都能获得并受益于 AI 带来的机会。

未来尚未写定

AGI 有潜力成为推动科学和医学发展的终极工具,并带来巨大的生产率提升和经济增长。但要实现这一点,我们需要通过围绕一个共享的全球框架进行协调、采用最严谨的科学方法,并汇聚最优秀的人才共同应对面前的挑战,从而把技术基础打牢。

即使我们解决了这些艰难的技术挑战,还会有更多复杂的经济和哲学问题需要处理:在一个后稀缺世界里,需要什么样的新经济模式来帮助每个人都繁荣发展?我们想以什么价值观生活,意义和目标将是什么,甚至人类处境本身又会如何改变?解决这些问题显然不能、也不应该只交给技术专家。它需要社会的每一个部分共同参与,帮助定义这个新的篇章。

围绕 AI,既有巨大的兴奋,也有巨大的不确定性,而两者都有其道理。但未来尚未写定;我们必须利用 AGI 到来之前这段宝贵窗口期,为全人类的利益塑造这项技术。我们现在共同采取的行动,将决定文明的下一阶段如何展开。只要安全地引导 AGI 进入世界,我们就能进入一个科学发现和进步的新黄金时代,并开启一个人类无比繁荣的光明未来。