Anthropic CEO 提出开源 AI 模型应用测试框架而不是激进禁令。涉及开源 AI 治理的政策立场。
很高兴你来到这里。每周一至周五,我们都会为你送上 TNS 最优质的内容,帮助你掌握最新动态,始终保持最佳状态。
请查收确认邮件,你可以在其中调整偏好设置,甚至加入更多群组。
在你喜欢的社交媒体平台上关注 TNS。
在 LinkedIn 上关注 TNS。
等待第一期 TNS newsletter 期间,不妨看看最新的精选文章和热门报道。
Anthropic 并不希望禁止开放权重 AI 模型。在经历一周的批评后,CEO Dario Amodei 今天明确表达了这一立场。相反,他提议,任何达到足够能力水平的模型在发布前都必须接受强制性安全测试。问题在于,目前没人定义“足够能力”究竟从哪里开始,而这将决定未来的下一批开放权重模型能否继续公开提供。
“Anthropic 从未主张禁止开放权重模型。”Amodei 在这封信中写道。他称,不具备危险能力的模型是“一种公共产品”,除了运行模型所需的算力外,不会产生任何成本。
他的提议包含三个部分:加强对先进芯片和芯片制造设备的出口管制,打击工业规模的模型蒸馏,并要求每个达到足够能力水平的模型在发布前接受安全评估。
前两项针对的是华盛顿的政策制定者。第三项则会影响正在准备发布模型的开发者。
Amodei 称,强制测试的构想已接近成为共识。他指出,特朗普政府已经朝这个方向行动,近期的行业提案也要求,无论模型来自哪里、采用何种许可证,都必须进行测试,“同时完全豁免能力较弱的模型,例如来自初创公司和学术界的模型”。不过,这项豁免至关重要;同样,“初创公司”这个概念本身也很难准确界定。一旦某些模型可以获得豁免,而另一些不行,这项政策实际上就成了另一种形式的能力门槛。
那么,这条界线究竟划在哪里?没人给出答案。
这封信没有说明由谁设定具体数值,也没有说明由谁执行测试。模型能力可以通过 benchmark 结果、训练算力,或者按照已定义风险类别评估得到的分数等指标来衡量。而选择哪项指标,将直接决定哪些类型的模型受到影响。无论由谁选择指标,实际上也等于由其决定所有发布权重的实验室何时能够发布模型。
事态仍在快速发展。截至目前,“Open Weights and American AI Leadership”联署信已有 50 个签署方。OpenAI 和 Google 已加入 Microsoft、Nvidia、Meta、AMD、Cisco、Cloudflare、GitHub 和 Ollama 的行列。Anthropic 和 Amazon 仍是两个引人注目的未签署者。
周一,Nvidia 发起了 Open Secure AI Alliance,创始成员超过 35 家,其中包括 Microsoft、IBM、Hugging Face、Palantir、Red Hat、CrowdStrike 和 Linux Foundation。Anthropic 并不在其中。Nvidia 的观点是,防御人员需要开放的前沿模型来调查安全事件。它援引了近期发生的一起案例:在调查 Hugging Face 的一场安全事件时,闭源工具阻碍了取证工作,因此 Hugging Face 转而使用开放权重模型完成分析。
值得肯定的是,Amodei 直接回应了最显而易见的批评。他表示,美国实施禁令,大体上只会保护本土 AI 公司免受竞争,却几乎无法阻止恶意行为者。“这会保护美国 AI 公司免受竞争,但这从来都不是我的目标。”这个说法合情合理。但同样不可否认的是,Anthropic 本身并不发布开放权重模型,因此这番表态多少显得有些空洞。
Amodei 承认,这类测试“需要在全球范围内实施,这意味着即便是中共也必须参与其中”,而他认为这或许能够实现。这可能是整个事件中最大的未解问题。出口管制和反蒸馏措施都是华盛顿可以单方面实施的政策,但全球性的模型能力测试制度则完全不同。对开放权重模型影响最直接的这项提议,有赖于目前尚不存在的广泛国际协议——而这样的协议也可能永远不会出现。