84% OpenRouter流量使用非SOTA模型;廉价模型提供77%前沿性能仅1/40价格;应用层部署存在独立Pareto前沿。
最新最强大的模型比去年 11 月聪明了三分之二。狂热的进步节奏在持续,每三天就会有两个新模型问世。¹
但 OpenRouter 上 84% 的 token 不是最先进的。² ³
事实上,用户选择生成绝大部分 token 的六款模型,其性能大约达到前沿水平的 77%。它们的价格只有 Claude Fable 5 的 2.5%。²
排行榜不断攀升。每隔一个季度左右,就会有一到两次三到五个人工分析(Artificial Analysis)分数的大幅提升。较小的步进则填满中间的空白。
在 8 月 10 日那一周,六款模型承载了 80% 的用量。它们混合后的价格是每百万 token 0.50 美元,而 Fable 5 是 20 美元。
Ramp 的数据显示,买家对价格是有弹性的。Fable 5 定价约 10 美元/百万 token,在上线一个月后占据了 Anthropic token 量的 6%,但却贡献了 11% 的 Anthropic 收入。GPT-5.6 Sol(OpenAI 最贵的主流版本)占据了 OpenAI token 量的约四分之一。⁴
Fable 5 在 7 月产生的模型归属收入大约是 GPT-5.6 Sol 的 75%,尽管前者要贵得多。
每一次新的最先进模型发布,应该比上一次抢占更少的市场份额。
企业会整合支出。合同集中在一家或两家供应商,就像云时代一样,而且一旦某个模型胜任了一项高价值工作,工作负载就会留在那里。
在可观的价格折扣下,性能已经足够好了。差距在从下方不断收窄。最优秀的开源权重模型在 5 月达到了前沿分数的 80%,而一年前这个数字是 48%。²
应用部署是另一个故事。我们的投资组合公司和初创企业更多默认选择更小的模型、微调过的模型和开源方案。他们在针对一条不同的帕累托前沿做优化——以价格换性能。
如果份额停止迁移,"够用"始终够用,那么 SOTA 的经济学就会改变。一次九位数规模的训练运行必须赢得市场份额才能回本,而这个门槛会随着时间推移而提高。
标题有些轻率。确实有大量人购买 SOTA,而且理由充分。软件工程架构和安全设计是最典型的场景,最好的可用模型确实值回票价。
但我们已有的公开数据表明,真正重要的前沿是另一个。
Artificial Analysis 模型目录与 Intelligence Index。主要实验室月度发布数量与前沿路径。样本起始于 2025-11-01。发布频率趋势平稳。大规模(≥3 分)前沿步进之间的中位间隔约 3.5 个月。Intelligence Index ↩︎
Artificial Analysis 模型目录与 Intelligence Index。主要实验室月度发布数量与前沿路径。样本起始于 2025-11-01。发布频率趋势平稳。大规模(≥3 分)前沿步进之间的中位间隔约 3.5 个月。Intelligence Index ↩︎
State of the art 指每周可用的单一最佳 Artificial Analysis 分数;当某个模型的分数处于当周最佳命名模型 10% 以内时,被计为接近前沿。OpenRouter 每周命名顶级模型与 Artificial Analysis 分数对接,取 OpenRouter 轮播顶部而非所有 API。份额序列,2025-11-03 至 2026-05-25 的 30 周,仅限命名模型,排除 Others。前后各十三周分别约 17.5% 和 14.6% 接近前沿(约 82-85% 在外)。集中度快照,2026-08-10 当周,覆盖前约 80% 命名 token 的模型。以 token 加权的 Artificial Analysis 分数落后全球目录 SOTA 约 23%(约达前沿质量的 77%),并落后该 OpenRouter 列表上最佳模型约 10%。混合篮子约 0.50 美元/百万 token,而 Fable 5 为 20 美元/百万(约 40 倍)。2026 年 5 月历史核查,落后本地列表领袖约 16%。最佳开源权重模型在前十三周的前沿分数占比为 47.5%,后十三周为 70.9%;单周最佳为 2026-05-25 的 DeepSeek V4 Pro,45.27 对前沿 56.31(80.4%)。OpenRouter 排名 ↩︎ ↩︎ ↩︎
State of the art 指每周可用的单一最佳 Artificial Analysis 分数;当某个模型的分数处于当周最佳命名模型 10% 以内时,被计为接近前沿。OpenRouter 每周命名顶级模型与 Artificial Analysis 分数对接,取 OpenRouter 轮播顶部而非所有 API。份额序列,2025-11-03 至 2026-05-25 的 30 周,仅限命名模型,排除 Others。前后各十三周分别约 17.5% 和 14.6% 接近前沿(约 82-85% 在外)。集中度快照,2026-08-10 当周,覆盖前约 80% 命名 token 的模型。以 token 加权的 Artificial Analysis 分数落后全球目录 SOTA 约 23%(约达前沿质量的 77%),并落后该 OpenRouter 列表上最佳模型约 10%。混合篮子约 0.50 美元/百万 token,而 Fable 5 为 20 美元/百万(约 40 倍)。2026 年 5 月历史核查,落后本地列表领袖约 16%。最佳开源权重模型在前十三周的前沿分数占比为 47.5%,后十三周为 70.9%;单周最佳为 2026-05-25 的 DeepSeek V4 Pro,45.27 对前沿 56.31(80.4%)。OpenRouter 排名 ↩︎ ↩︎ ↩︎
这些数据来源没有涵盖第一方云服务——OpenAI、Anthropic 和 Google 自有的服务。在原生 API 上运行的前沿流量从未进入 OpenRouter 排名,因此数据存在偏差。 ↩︎
这些数据来源没有涵盖第一方云服务——OpenAI、Anthropic 和 Google 自有的服务。在原生 API 上运行的前沿流量从未进入 OpenRouter 排名,因此数据存在偏差。 ↩︎
Ramp Economics Lab,AI Index August 2026(Fable 5 采用情况)。econlab.substack.com/p/ai-index-august-2026 ↩︎
Ramp Economics Lab,AI Index August 2026(Fable 5 采用情况)。econlab.substack.com/p/ai-index-august-2026 ↩︎