Anthropic主张测评而非禁令,OpenAI与谷歌支持开放权重
Anthropic不希望禁止开放权重AI模型。首席执行官达里奥·阿莫迪在经历了一周的批评声浪后,今日明确表态:他提议对所有具备足够能力的模型,在发布前必须强制进行安全测试。问题在于,目前没有人界定"足够能力"从何处起算,而这一界定将直接决定未来的开放权重模型是否仍能公开获取。
阿莫迪在公开信中写道:"Anthropic从未主张禁止开放权重模型。"他将不具备危险能力的模型称为"公共产品",认为此类模型除运行所需算力外不产生任何额外成本。
他的提案包含三个方面:一是收紧对先进芯片及芯片制造设备的出口管制;二是打击工业规模的模型蒸馏行为;三是要求所有具备足够能力的模型在发布前须通过安全评估。
前两项针对华盛顿政策层面,第三项则将影响准备发布模型的开发者。
阿莫迪表示,安全测试的理念已接近行业共识,并指出特朗普政府已朝这一方向推进,且近期行业提案建议无论模型来源或许可类型,均须接受测试,同时对能力较弱的模型——例如来自初创公司和学术界的模型——给予豁免。然而,这一豁免条款至关重要:初创公司的界定本身就难以厘清。一旦某些模型获得豁免而另一些不得豁免,该政策本质上就变成了以另一种名义划定的能力门槛。
那么,这条线究竟画在哪里?目前没有人给出答案。
这封公开信也未说明由谁来设定具体数值,由谁来执行测试。模型能力可通过基准测试结果、训练算力或针对特定风险类别的评分等指标来衡量,而所选指标将直接决定模型类型的划分方式。换言之,谁来选定指标,谁就在为每一个公开权重的实验室设定发布节奏。
这是一个快速演变的议题。目前,"开放权重与美国AI领导力"联署信已有50位签署方,OpenAI和谷歌加入了微软、英伟达、Meta、AMD、思科、Cloudflare、GitHub和Ollama的行列。Anthropic和亚马逊则是引人注目的缺席者。
本周一,英伟达宣布成立"开放安全AI联盟",发起成员超过35家,包括微软、IBM、Hugging Face、Palantir、红帽、CrowdStrike以及Linux基金会。Anthropic未列其中。英伟达的主张是:防御方需要开放的前沿模型来调查安全事件,并援引近期案例——封闭工具阻碍了对Hugging Face某事件的取证分析,最终由Hugging Face借助开放权重模型完成了相关调查。
值得肯定的是,阿莫迪直接回应了最显而易见的批评。他表示,美国若实施禁令,主要效果不过是保护国内AI公司免受竞争,对阻止恶意行为者收效甚微。"这只会保护美国AI公司不受竞争威胁,但那从来不是我的目标。"此言不虚。不过,Anthropic本身并不发布开放权重模型,这番表态因此难免显得底气不足。
阿莫迪承认,安全测试"需要在全球层面推行,这意味着就连中国共产党也需要认可",并认为这或许可以实现。这可能是整个议题中最悬而未决的问题。出口管制和反蒸馏措施都是华盛顿可以单边推行的政策,而全球性的能力测试机制则截然不同。对开放权重模型影响最为直接的这一提案,依赖于尚不存在(甚至可能永远不会存在)的广泛国际协议。
Q&A
Q1:达里奥·阿莫迪对开放权重模型的具体提案是什么?
A:阿莫迪提出三项措施:收紧先进芯片及制造设备的出口管制、打击工业规模的模型蒸馏行为,以及要求所有具备足够能力的模型在发布前强制通过安全评估。其中第三项直接影响开发者,但目前尚无人界定"足够能力"的具体标准,也未明确由谁来执行测试。
Q2:"开放权重与美国AI领导力"联署信有哪些主要签署方?
A:目前该联署信已有50位签署方,包括OpenAI、谷歌、微软、英伟达、Meta、AMD、思科、Cloudflare、GitHub和Ollama。值得注意的是,Anthropic和亚马逊是其中引人关注的缺席者。此外,英伟达还另行成立了"开放安全AI联盟",发起成员超过35家,同样不包括Anthropic。
Q3:为什么全球统一的AI能力测试机制很难实现?
A:全球统一的能力测试机制需要各国政府达成广泛国际协议,包括中国在内的主要国家均需认可并参与。与出口管制或反蒸馏措施不同,后两者是美国可单边实施的政策,而全球性测试体系依赖多边合作框架,目前这一框架尚不存在,未来能否建立也存在相当大的不确定性。
