Synth Daily

Y Combinator 总裁陈嘉兴发出呼吁:希望美国开源 AI 实验室也能“蒸馏”前沿模型

Y Combinator 总裁陈嘉兴(Garry Tan)认为,不应阻止中国 AI 实验室通过“蒸馏”技术从美国前沿模型中学习,他甚至主张美国本土的开源 AI 实验室也应采用同样的方法。他认为,AI 公司无权限制用户如何使用模型的输出,并且鉴于这些前沿模型本身是利用海量公共数据训练而成,其成果更应被视为一种公共产品。对他而言,真正的风险并非 AI 失控,而是一个强大的公司垄断整个 AI 领域,因此通过鼓励“蒸馏”来扶持一个强大的开源 AI 生态系统至关重要。

关于 AI“蒸馏”的争议

“蒸馏”(Distillation)是一种 AI 训练技术,指一个模型通过大量调用另一个模型来学习其工作和推理方式。近期,这一做法引发了激烈争论。

  • Anthropic 的指控: 该公司称,有中国实验室在进行“非法的蒸馏攻击”,通过隐藏身份、欺诈和盗用凭证等方式,未经许可地从其模型中提取知识。其首席执行官呼吁监管机构介入打击。
  • 陈嘉兴的反驳: 作为硅谷顶级创业孵化器的负责人,他明确表示不赞同。他认为监管不应干预,甚至鼓励美国也建立自己的“蒸馏机制”。

“我什么都不会做。我们可以主张,应该建立一个美国的蒸馏机制。”

他的意思是,希望美国的小型、开源 AI 实验室能够对美国本土的前沿模型进行“蒸馏”,从而建立一个不依赖于中国的、更强大的美国开源模型选项。

为什么应允许“蒸馏”

陈嘉兴的观点主要基于两大核心论点,他主张的并非非法窃取,而是通过正当途径自由地进行“蒸馏”。

  • 用户自由: 他认为,AI 公司过度限制用户如何处理其模型输出,是一种越界行为。
  • 公平原则: 前沿 AI 实验室在训练模型时,本身就吸纳了包括受版权保护材料在内的大量人类知识,并且并未征求所有权人的许可。因此,这些成果不应被严格的服务条款完全锁定。

“控制用户和客户如何使用闭源模型的 API 调用感觉限制性太强了。政府可以发挥作用,将这样一个事实常态化:即访问那些基于广泛公共数据训练出来的智能,其本身也应更像一种公共产品,而不是被限制性服务条款锁起来的东西。”

真正需要担心的“末日情景”

对陈嘉兴而言,AI 领域最可怕的未来不是技术失控,而是权力的过度集中。

他希望在推动创新的前沿实验室和提供自由度的开源模型之间找到一个平衡点。前者需要可行的商业模式,而后者则确保了普通人能够自由地访问和使用 AI 技术。

  • 真正的噩梦: 只有一个公司拥有最好的资本、最顶尖的研究人员,并最终形成一家独大的局面。
  • 健康的生态: 一个由前沿模型和开源模型共同组成的、充满竞争的强大生态系统,可以有效防止垄断的出现。