前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8606
  • GPT-Live低延迟语音AI系统:六月从零到一
  • Agent本地化浪潮——三个改变部署形态的项目
  • Mistral 7B推理成本降400倍:$4/月VPS完整部署方案
  • LobeChat 开源项目深度评测:多模型支持和部署方案
  • MCP 和 Skills 架构对比:AI Agent 集成最佳实践
  • 深度调试案例:五层根本原因分析一个神秘 Bug
  • MCP Agent 生产化:Docker + Kubernetes + 可观测性完整方案
  • AI 代理开发如何改变程序员工作流:从编码转向审查
  • Kimi K3 发布:百万 token 长上下文与强编程能力
  • 开源自媒体工具链:跨 10+ 平台内容发布全自动化
  • Qwen3.8-Max:2.4T参数如何改变开发工具选择
  • IBM 报告:AI 攻击占数据泄露 1/4,防御需加速漏洞修复
  • LLM 总成本对比:自托管 Llama vs 云 API 真实成本
  • AI 编码助手的设计系统赋能:从通用到专业
  • 网络爬虫工程实战:反爬虫对抗的完整方案
  • Rust 高性能 AI 代码审查工具:系统编程最佳实践
  • Ops Agent 的安全漏洞:提示注入即远程代码执行
  • 80% 降价反而成本上升:AI 账单的 Jevons 悖论
  • Google Gemini Robotics 2发布,人形机器人控制API开放
  • Qwen3.8-27B仅需17GB显存运行验证
  • 通义千问 3.8-Max 模型通过 OpenAI 兼容 API 可用
  • AI Agent 误删 45 个文件的真实事故复盘
  • Qwen3.8-Max官宣:全模态创作力对标顶级模型
  • 在 Next.js 中架构 AI 异步处理:避免请求阻塞的完整方案
  • MCP新规范正式版:一键审计服务器兼容性
  • Prompt设计最佳实践:精简上下文优于巨型提示
  • MiniMax H3开源多模态模型Day-0适配国产GPU,成本优化40倍
  • 用 Claude 和 CoinGecko 构建实时加密货币分析 Agent
  • Agent 系统的紧凑记忆优化:降低上下文成本
  • Qwen 3.8 发布,编程与推理能力升级
  • OpenAI Agents Python框架14天实战测评
  • 用AI编程工具远程部署服务器的无密钥方案
  • Agent 系统设计:从 Prompt 工程转向上下文工程
  • C++ 高效加载机器学习模型的完整实现
  • Word 提示注入漏洞:Copilot 被劫持 144 天未修
  • 12个AI自动化案例详解:如何集成AI到实际工作流
  • AI 框架选型完全指南:分类体系与决策方法论
  • Agent AI vs 生成式 AI:本质区别与应用边界实战指南
  • 阿里发布通义千问3.8-Max大模型
  • Agent管道的隐形故障:Fallback陷阱案例
  • 生产级流式 LLM API 客户端实现指南
  • Agent 系统中的批准陷阱:为什么状态转移需要重新验证
  • LLM 成本感知路由:用 Flash 模型减少 60% 支出的系统设计
  • AI 代码迁移引入 Bug:COBOL→Java 实验分析
  • 用 AI 助手开发浏览器扩展踩过的坑:验证比相信更重要
  • RAG 系统检索失败根本原因:数据分块策略而非模型能力
  • AI Agent 失控成本爆炸:防护实战指南
  • 开源视频生成模型 MiniMax H3
  • 华为诺亚开源 Agent 记忆系统 MindMemOS
  • Python AI Agent Prompt 注入防护三层架构
  • 从零实现经典技术:高价值学习路线合集
  • 已加载 51 / 8606
9.0
重磅
AI SCORE
模型发布2026-08-03 13:47

通义千问 3.8-Max 模型通过 OpenAI 兼容 API 可用

dev.to · AI#通义千问#MoE#API
Editor brief · 编辑速览

阿里巴巴发布 2.4T 稀疏 MoE 模型,支持文本/图像/视频/文档输入,128K 上下文可扩展到 1M,已通过 OpenAI SDK 兼容接口开放,改两行代码即可切换使用。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

披露:我运营着 NovAI,这是一个 API 网关,除了 Qwen3.8-Max,还提供 40 多种其他模型。下文的规格来自阿里巴巴的公告;价格信息可自行核实。

阿里巴巴 Qwen 团队于 2026 年 7 月 19 日在上海世界人工智能大会(WAIC)上发布了 Qwen3.8-Max-Preview:这是一个拥有 2.4 万亿参数的稀疏 MoE 模型,原生支持多模态(文本、图像、视频和文档),上下文窗口为 128K,并可扩展至 1M。阿里巴巴称其“仅次于 Fable 5”——早期的独立测试也表明,它在编程和推理方面已跻身第一梯队。

现在,你可以通过兼容 OpenAI 的 endpoint 调用它。如果你已经在使用 OpenAI SDK,只需修改两行代码。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_KEY",
    base_url="https://aiapi-pro.com/v1",
)

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Explain sparse MoE routing in 3 bullet points."}],
)
print(resp.choices[0].message.content)

流式输出的用法也完全符合你的预期:

for chunk in client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Write a haiku about trillion-parameter models."}],
    stream=True,
):
    print(chunk.choices[0].delta.content or "", end="", flush=True)

多模态:图像与文档

Qwen3.8-Max 原生支持多模态——视觉能力是模型内置的,并非后期拼接。你可以使用标准的 image_url 内容类型发送图像:

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "What's in this screenshot? List all UI elements."},
            {"type": "image_url", "image_url": {"url": "https://example.com/ui.png"}},
        ],
    }],
)

它还可以直接接收 PDF、HTML 和 Markdown,无需预先转换成纯文本。

Qwen3.8-Max 为何值得关注

一位独立评测者 Thomas Wiegold 用 4 项编程测试对其进行了检验,其中包括一个完整的 Go 扑克模拟项目。此前,只有 Fable 5 和 Grok 4.5 能够一次性完成这项任务,而 Qwen3.8-Max 成为第三个做到这一点的模型。他的结论是:“非常好,也非常慢”——该模型会花费大量时间进行自我验证,以速度换取更全面、严谨的结果。

阿里巴巴为 Qwen3.8-Max 制定的官方价格是每百万 token ¥12 / ¥36(输入 / 输出),约合 $1.67 / $5.00。预览期间,阿里巴巴提供标准价格一折的优惠,即 ¥1.2 / ¥3.6,约合 $0.17 / $0.50;夜间时段的价格最低可至标准价格的五十分之一(UTC+8 22:00–08:00)。

NovAI 会将这些预览期优惠同步给用户。实时的按 token 计费价格可在此查看:https://aiapi-pro.com/pricing

新注册的 key 会附带 $2 免费额度,无需信用卡,因此你可以先使用自己的 prompt 测试 Qwen3.8-Max,不必预先支付任何费用。

GitHub 上提供了可以直接复制粘贴的 Python、Node 和 curl 示例,涵盖 chat、流式输出、视觉理解和长上下文:

👉 https://github.com/vvvvking/novai-examples

包含 curl、Node 代码片段和常见问题解答的完整指南:Qwen3.8-Max API Guide。NovAI 是一家独立的 API 网关,与 Alibaba Cloud 没有关联。

如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
Qwen3.8-27B仅需17GB显存运行验证
下一篇
AI Agent 误删 45 个文件的真实事故复盘