在一系列关于人工智能风险的警告声中,Anthropic 公司的 CEO Dario Amodei 提出了一项具体计划,旨在放缓前沿 AI 的研发步伐。该计划包括引入第三方评估员、协调行业安全标准以及寻求全球合作,并已获得 OpenAI CEO Sam Altman 等行业领袖的初步支持。尽管此举被一些人批评为分散注意力或寻求监管垄断,但 Amodei 坚持认为,为了安全地实现 AI 的巨大潜力,采取谨慎和深思熟虑的策略至关重要。
为何要放慢脚步?
近期,AI 行业内部对技术发展速度的担忧日益加剧。促使 Amodei 提出放缓步伐的主要原因有两个:
- AI 发展速度惊人: 最近几个月,AI 的能力“一直在以惊人的速度进步”,特别是其“构建下一代 AI”的能力越来越强。
- 安全事件敲响警钟: OpenAI-HuggingFace 的黑客攻击事件暴露了现有技术的安全漏洞。
这些担忧也得到了前 Anthropic 研究员 Jacob Coxon 的呼应,他因担心公司“在拿我们的生命赌博”而辞职。
“我们必须减缓提升 AI 模型能力的步伐。进展看起来仍会很快,我们必须明智地利用我们争取到的时间。”
放缓 AI 研发的三大策略
Amodei 概述了三个具体的策略来“控制前沿发展的节奏”,其中 Anthropic 承诺单方面实施第一项。
1. 引入“嵌入式评估员”
这个想法是从第三方组织(如 METR)邀请评估员入驻 AI 公司。
- 职责: 核实公司是否遵守其安全承诺,并确保安全事件得到及时报告。这类似于金融业中派驻银行的监管人员。
- 执行方式: Anthropic 单方面承诺这样做,并呼吁政府要求其他前沿公司效仿。评估员将获得公司徽章、办公桌和笔记本电脑,并拥有与内部风险评估团队相当的访问权限。
- 行业响应: OpenAI 的 Sam Altman 也表示这是一个“好主意”,并承诺 OpenAI 将采取同样措施。
2. 协调共同的安全标准
Amodei 呼吁“民主国家内”的领先 AI 公司进行协调,共同制定安全标准和限制 AI 无节制发展的速度。
- 面临的挑战: 公司之间担心这种协调可能引发反垄断审查。
- 解决方案: Amodei 建议美国政府可以从中调解或为安全相关的对话提供豁免,从而消除法律障碍。
- 应对中国竞争: 对于放缓发展可能导致中国超越的担忧,Amodei 认为,通过限制对华出售高端芯片和打击模型窃取等手段,可以在未来 3-5 年内“显著扩大美国的领先优势”。
3. 寻求全球范围的协调
最后一步是尝试与包括中国在内的专制政府进行协调。
- 合作目标: 尽管承认与中国合作存在“明显的局限性”,但 Amodei 认为仍有机会达成共识。
- 具体内容: 合作可能集中在“禁止某些狭隘且明显危险的 AI 用途”,例如利用 AI 生产生物武器。
争议与批评
Amodei 的提议并非没有争议。一些批评者认为,这些关于世界末日的 AI 警告是一种策略性分心,旨在转移公众对 AI 当前已经造成的实际伤害(如偏见、虚假信息等)的注意力。
- 缺乏具体证据: 记者 Brian Merchant 指出,他尚未看到“一份可信的、分步的文档,说明 AI 究竟如何从自我改进走向杀死全人类”。
- “监管俘获”的嫌疑: 还有人认为,这类由行业巨头提出的监管建议,最终可能只会服务于 Anthropic 和 OpenAI 自身,形成事实上的行业垄断,阻碍小型竞争者的发展。
尽管如此,Amodei 强调,他仍然相信“AI 可以极大地改善人类生活质量”,但前提是“我们必须以正确的方式构建这项技术”。他认为,当前的争议本质上是一场“信任危机”,而谨慎行事正是为了重建信任,确保最终能实现 AI 的巨大益处。