阿里巴巴发布 Qwen 3.8-Max 模型,官方宣称性能对标 Anthropic Fable 5、OpenAI 等美国前沿实验室和国内 Moonshot Kimi K3。代表国产与国际顶级模型的竞争态势。
中国科技巨头阿里巴巴发布了其所谓迄今规模最大、“能力最强的 AI 模型”。该公司声称,这款模型的性能足以媲美美国前沿实验室 Anthropic 和 OpenAI 的顶尖系统,以及 Moonshot AI 的 Kimi K3 等中国本土竞争对手。阿里巴巴在周一发布的一篇博客文章中表示,将向用户广泛开放这款名为 Qwen3.8-Max 的模型。此次发布早有预期:该公司上个月已经预览过这款模型,当时声称其表现“仅次于 Fable 5”——后者是 Anthropic 的旗舰模型。
又一款能力出众的中国 AI 模型开放发布,进一步加剧了硅谷和华盛顿在多个层面的高度紧张局势:一方面是如何安全地管理 AI 系统,另一方面是如何维持美国相对于中国的技术优势。
阿里巴巴周一公布的内部测试结果表明,这款模型的确拥有其所宣称的实力;在众包模型对比平台 Arena.AI 上的排名也印证了这一点。阿里巴巴自己的测试显示,在各项基准测试中,该模型的性能总体上与 Fable 5 相当,有时甚至更胜一筹。在 Arena 文本模型排行榜上,Qwen3.8-Max 仅落后于 Fable 5 和 Anthropic Opus 系列的三款模型。在前端编程方面,只有两款 Claude Opus 模型和 Kimi K3 的表现优于它;在视觉分析方面,则只有 Fable 5 明显胜过它。
阿里巴巴表示,Qwen3.8-Max 拥有 2.4 万亿个参数。参数是一种数值化指标,代表模型在训练过程中学习到的各项设定,模型会利用这些设定处理数据、识别模式并执行各种任务。尽管参数量被广泛用作衡量模型性能的简化指标,但数字更大并不一定意味着性能更好。Moonshot 的 Kimi K3 模型拥有 2.8 万亿个参数,但大多数美国顶尖实验室都不会公开这一数据,OpenAI 和 Anthropic 也都没有披露其顶级系统的确切参数量。
这家中国公司表示,将于下周发布 Qwen3.8-Max 的权重。权重是 AI 中可调整的数值,决定了它处理信息的方式。开放权重系统虽然比传统的开源软件限制更多,但与 OpenAI 和 Anthropic 等公司的专有产品相比,仍能给予开发者大得多的控制权。Qwen3.8-Max 标志着阿里巴巴重新回归开放权重发布路线。此前,该公司曾在今年早些时候短暂调整策略,对能力更先进的模型采用专有发布方式。
开放权重发布正日益成为中国 AI 行业的一项差异化特征,并且已经成为行业常态。Moonshot 上周发布了 Kimi K3 的权重,许多其他顶级 AI 模型同样采用开放权重。北京方面一直支持这一策略,将其视为扩大中国在全球 AI 治理领域影响力、推动中国本土科技领军企业技术得到广泛采用的一种手段。
阿里巴巴此次发布进一步加剧了与中国之间的竞争。中国企业似乎正在迅速缩小与美国公司的差距,并且在最近几周明显加快了模型发布节奏。Qwen3.8-Max 紧随 Kimi K3 之后发布,后者同样被视为对美国 AI 主导地位的一次挑战;字节跳动和 MiniMax 也在周五发布了能力出色的新一代视频生成模型。
开放性也已经成为一个充满分歧的议题。有报道称,在这些中国模型发布后,美国可能会收紧对开放工具的监管。面对这一局面,美国 AI 行业基本形成了维护开放权重模型访问权的共识,既将其视为保障安全的必要条件,也将其视为维持市场竞争的一种手段。与此同时,闭源模型提供商——尤其是 OpenAI 和 Anthropic——正面临越来越严格的审视,因为它们披露了一系列在自身并不知情的情况下,由失控 AI Agent 发起的网络攻击。一名受害者发布的事件报告表明,那些旨在阻止 AI 模型被用于恶意用途的严格安全护栏,也限制了人们将这些模型用作防御工具的能力。