前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
返回 AI 情报前线
All News · 全部资讯4019
  • AI功能建造成本低,运行成本才是隐藏大头
  • 阿里Qwen3.8-Max发布:首个Max级开源模型,支持OpenAI+Anthropic双协议
  • 无标签场景下用变质测试捕获 LLM 错误输出
  • 用规格约束智能体编码全流程
  • 模型准确为何仍救不了文档AI项目
  • 支付重试中的幂等与失败分级
  • 微软推出生产级Agent运行时
  • Spring AI对话成本控制实战
  • AWS智能体全栈架构实践
  • 智能体按需切换 V8 与 Linux 运行时
  • 用AI生成FFmpeg命令的可靠方法
  • 一个刻意收窄边界的RAG库
  • Claude Opus 5主打编程与推理升级
  • Cloudflare开源智能体虚拟工作区
  • 用Python构建MCP服务完整指南
  • 用A2A协议开放网站能力
  • 用LanceDB构建低延迟编码记忆
  • 消费级显卡部署开源智能体实战
  • Lean 内核漏洞击穿 AI 数学证明
  • CoCo 扩展机制与团队共享指南
  • 阿里发布2.4万亿参数Qwen3.8-Max
  • 用向量聚类捕捉社媒早期趋势
  • Agent 部署正暴露信任边界缺陷
  • Zapier Connectors:让AI Agent免费可靠连接外部应用
  • 用Dragonfly加速大规模模型分发
  • Agent记忆系统如何生长与遗忘
  • 迁移 AgentCore 前重算成本模型
  • 用 Bedrock Nova 驱动 Claude Code
  • YC开源多人协作Agent运行框架QM
  • Eve Agent新增沙箱浏览器能力
  • Vercel推出技能包分享平台skills.sh
  • Qwen 3.8 Max 与 27B 开放权重
  • GenOffice 开源 AI 办公套件
  • Appwrite 构建 MCP 服务的取舍
  • OCR 为何无法还原真正的文档
  • AI 读取 PDF 为何频繁误判
  • 浏览器端多语音合成为何卡在86%
  • 多智能体投票式代码审查实践
  • 把团队Prompt当作代码资产管理
  • 非确定性 LLM 功能如何可靠测试
  • 构建安全的 Notion MCP 工作流
  • 用 CI 管控模型名称与 Token 预算
  • 途虎统一 AI 存储架构实践
  • 用 JSON 固化 AI 界面的得与失
  • Agent 失灵可能只是配额变了
  • 为 LangChain 搜索链路补齐审计记录
  • 欧盟 AI 内容标注规则进入执行期
  • 本地优先的开源 AI 语音工作台
  • 用统一代理接入多种终端编程智能体
  • OpenSearch 原生接入 MCP
  • 把调用图写入代码向量是否有效
  • 已加载 51 / 4019
9.0
重磅
AI SCORE
模型发布2026-08-04 13:31

阿里发布2.4万亿参数Qwen3.8-Max

dev.to · AI#Qwen#多模态#开源
Editor brief · 编辑速览

Qwen3.8-Max采用总参数2.4万亿、激活参数950亿的MoE架构,支持百万上下文及文本、图像和视频输入。模型API降价约20%,并计划首次开放Qwen旗舰级Max模型权重。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

阿里巴巴发布了拥有 2.4 万亿参数的 Qwen3.8-Max。标题强调的是“史上最大”,但真正值得关注的是:它的开放权重将在下周发布。

具体规格如下:采用 MoE 架构,总参数量 2.4T,激活参数量 95B;支持 100 万 token 上下文,以及文本、图像和视频。API 定价为每百万输入 token 2 美元、每百万输出 token 6 美元,比 3.7 版本便宜约 20%。它目前在 Frontend Code Arena 排名第 4,与 Claude Opus 5 相差约 1 分;据称,在 Terminal-Bench 上,它以大约 2% 的优势超过 Fable 5。阿里巴巴表示,该模型曾独立运行一个真实项目长达 16 天,其间完成了 265 次 commit 和 127 个 PR。

三件事叠加在了一起

1. 史上最大的开放模型即将出现

目前开放权重模型的纪录保持者是 DeepSeek V4 Pro,参数量为 1.6T,而 Qwen3.8-Max 达到了 2.4T。这也是 Qwen 首次开放 Max 级别的模型。过去,他们通常会开放中等规模的模型,同时将旗舰模型保留在 API 之后。这是一个战略决策,而非技术决策。

2. 三天前那项预测得到了印证

在《经济学人》7 月 29 日发布的采访中,Musk 认为,中国实验室仅凭相对有限的算力就已经抵达前沿,因此一旦获得大量算力,它们很可能会取得领先。当时这还只是一项推论。如今有报道称,阿里巴巴完全依靠国产基础设施部署了这个 2.4T 模型。我不知道他所说的“光刻技术比人们想象中更接近”是否正确。但一套国产技术栈能够在生产环境中承载前沿规模的 MoE,至少意味着这项制约因素的影响又下降了一个级别。

3. 价格战换了一种打法

上周,DeepSeek 将每百万输入 token 的价格降到了 0.14 美元。本周,Qwen 的价格则是输入 2 美元、输出 6 美元。两者看起来背道而驰,但其实采用的是两种不同的进攻方式。DeepSeek 以一个低到无需考虑的价格争夺规模;Qwen 则让最强级别的模型也能自行托管。对企业来说,后者的冲击可能更大,因为一旦旗舰模型的权重可以下载,采购时要问的问题就不再是“我们应该购买谁家的 API”,而会变成“哪些工作负载值得由我们自己托管”。这将带来一个完全不同的谈判地位。

作为一个因为运营 gateway 而每天关注 token 价格的人,我的看法是:

最大并不是重点,开放才是。当排行榜顶端的模型只相差 1 分时,“必须使用闭源模型”这一前提便开始松动。本周是 Qwen,上周是 DeepSeek,再前一周则是 OpenAI 降价 80%。没有哪个模型能够一直保持最佳。真正的价值从来不在于选对某一个模型,而在于拥有一个位于模型之下的抽象层,替你权衡成本与能力。

本文基于阿里巴巴发布的 Qwen3.8-Max 及公开报道;benchmark 和定价数据来自官方信息。Musk 的引述来自《经济学人》2026 年 7 月 29 日发布的完整采访。

如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
CoCo 扩展机制与团队共享指南
下一篇
用向量聚类捕捉社媒早期趋势