前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9278
  • Claude Opus 5 基准登顶,开发者却怀念 Opus 4.8
  • Composio超量定价涨16倍真相:凭证托管成隐形收费项
  • GitHub Spec-Kit:规范优先开发,用可执行规格直接生成代码
  • MCP 缓存安全漏洞:私有结果可能跨用户泄露
  • 用 Rust 徒手实现栈式虚拟机:44 条指令、双后端与零成本安全类型
  • 微软 Copilot Notebooks 支持 Markdown,强化 AI 资料分析
  • Deltix:AI驱动自动化测试平台
  • 多 Agent 输出重复太吵?用输出去重器解决
  • AI Agent 为何需要向量数据库作为记忆层
  • DeepSeek V4 Pro 上线国家超算互联网,Harness 智能体框架开源
  • 智谱GLM-5.3发布:开源编程能力最强模型
  • 智谱 GLM-5.3 编程能力最强开源模型发布,Qwen3.8-27B 同日开源
  • 英伟达量产全球首款 200G/lane 硅光交换机,功耗降为 1/5
  • 别分类,直接「幻觉」标签:LLM标签推荐新思路
  • Anthropic推出Claude文本水印检测API
  • RPA与工作流自动化深度对比:如何构建持久自动化
  • Google Sheets推AI画布,可用自然语言构建交互应用
  • n8n替代方案横评:企业级自托管AI自动化平台
  • 苹果AI策略区域分化或致iOS应用在中国行为不同
  • CoT Prompting 实战指南:何时用、怎么用
  • 阿里Qwen3.8:消费级硬件即可跑出Opus 4.6级性能
  • 什么是AI上下文架构?为什么不建议自建?
  • 阿里Qwen 3.8开源:27B参数上下文达26万token
  • OpenAI推出Computer History:Mac操作记录转为ChatGPT可搜索记忆
  • Grok 4.6 登陆 GitHub Copilot,专为 Agent 编码设计
  • 提升 Claude Code 使用效率的实战指南
  • 换用新模型前,先用历史失败用例回归测试
  • Qwen3.8-27B vs Qwen3.6-27B:架构完全相同,性能提升全赖训练
  • 编程Agent能读git log,却读不到你试错的四次失败
  • AI集成层大规模密钥泄露:Composio等平台暴露数千凭证
  • NVIDIA Nemotron 3.5 Lightning:解决Agent执行层成本与能力矛盾
  • 研究打脸:前沿模型还无法自主做科研
  • AI代理真正学会记住的四层记忆系统
  • Amazon Nova Forge 多轮强化学习奖励函数设计指南
  • GitHub推出覆盖全SDLC的Agent应用
  • AI by Hand:Hacker News热捧的AI辅助手工工具
  • SageMaker 联手 Bedrock AgentCore 构建多Agent工作流指南
  • 两阶段语义检索 + 结构化引用:游戏答案类 RAG 架构设计
  • 语音转文字 + 模型网关:知识库流水线的 API 设计实践
  • Meta发布Glimmer开源模型,Zuckerberg阐述开放AI理念
  • Google用同态加密让私有AI变为实用技术
  • Qwen3.8-27B 开源:家用显卡可跑,可商用
  • 大吞吐量 LLM 工单分类的成本控制五法
  • 阿里开源 OpenSandbox:AI Agent 安全沙箱,两天斩获 1.27 万星
  • AI 记忆不必是数据库:试试 Markdown + Git 方案
  • AI 功能开发中的信任边界设计原则
  • GLM-5.3编码能力跃升:基座未变,提升从何而来
  • AI 编程模型评测实战框架:从真实开发任务出发的选型方法
  • 阿里开源 Qwen3.8-27B:编程办公场景超越 Qwen3.7-Plus,推理资源可调控
  • AI生成的Shell命令需像MR一样审查
  • 中国医生用GPT-5.6-Sol 16小时证明22年数学难题
  • 已加载 51 / 9278
8.0
热点
AI SCORE
模型发布2026-08-15 02:10

阿里Qwen3.8:消费级硬件即可跑出Opus 4.6级性能

The New Stack#Qwen#开源#本地部署
Editor brief · 编辑速览

阿里开源Qwen3.8,24万亿参数模型,承诺在个人电脑上达到Opus 4.6级别性能,主打本地和Agent应用场景。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

很高兴你来到这里。你可以期待所有优质的 TNS 内容将在周一至周五送达,让你紧跟新闻动态、保持领先位置。

请查收收件箱中的确认邮件,你可以调整偏好设置,甚至加入其他社群组。

在你喜欢的社交媒体平台上关注 TNS。

在 LinkedIn 上成为 TNS 关注者。

在等待第一封 TNS Newsletter 时,看看最新的精选和热门文章。

阿里巴巴近日开源了其 2.4 万亿参数 Qwen3.8 模型的权重。这是一个规模庞大的模型,其基准测试成绩让它直接对标美国实验室的闭源前沿模型。但或许更值得关注的是,阿里巴巴在上周五还以 Apache 2.0 许可证发布了 Qwen 3.8 的 270 亿参数稠密版本。

例如,这款模型你可以在配置较高的 MacBook Pro 或 Mac Studio 上本地运行——而且可能值得这样做,因为根据阿里巴巴的基准测试,该模型的性能与 Anthropic 的 Opus 4.6 在 Max 模式下运行处于同一水平。

在相当多的基准测试中,它甚至超越了 Anthropic 的前旗舰模型——该模型在 2 月发布时是六个月前的最先进的水平,尤其在某些计算机使用、编程和知识工作测试中表现更佳。

再加上该模型还具备视觉能力——包括视频——这使其成为本地使用的诱人选择(假设你有支持它的硬件)。

一如既往,需要注意的是,基准测试并不总是能衡量模型在现实世界中的表现,对于 Agent 用途来说,运行的工具链可能和模型本身一样重要。例如,早期报告表明该模型倾向于过度思考。

同时,看起来阿里巴巴的基准测试描述的是原始检查点,而非大多数本地用户会运行的量化版本。量化虽然可以让模型在消费级硬件上变得实用,但总是存在质量权衡。

不过总的来说,对于一款可以本地运行的模型来说,这些结果令人印象深刻。

Credit: Alibaba.

阿里巴巴指出,该模型在编程和知识工作任务上显著超越上一代 Qwen 3.7-Plus,一些性能提升相当惊人,包括在 DeepSWE Agent 编程基准上从 14.2 分跃升至 42.2 分。

Credit: Alibaba.

阿里巴巴还将该模型与 Meta 的 Muse Glimmer-30B 进行了比较,后者是近期发布的同量级本地模型。Qwen3.8-27B 在阿里巴巴同时报告成绩的每一项测试中都领先。

看起来,Glimmer 这个名字取得很贴切。

本地运行 Qwen 3.8 27B 所需的硬件

当然,速度是另一个问题。截至目前,阿里巴巴尚未发布更小的 Qwen3.8 27B 混合专家版本兄弟模型。这类模型可以为每个 token 激活更少的参数,运行速度比 27B 稠密版本更快。例如,阿里巴巴此前为 Qwen 3.6-35B 模型做过这样的优化。

未量化的 Qwen3.8-27B 仓库大小为 55.6GB,这还不包括推理运行时和上下文缓存。大多数人不会运行这个版本。

对 Mac 用户来说的好消息是,社区已经为 Apple Silicon 创建了 MLX 转换版本。4-bit 版本约为 16.1GB,而 8-bit 版本为 29.5GB。这使得配备 32GB 统一内存的 Mac 成为以适度上下文长度运行 4-bit 版本的一个合理平台。如果你有 48GB 或 64GB 内存,显然可以为更高精度或更长提示提供更多空间。

该模型默认支持 262,000 个 token 的上下文,通过使用 YaRN 方法可以扩展到 100 万 token(阿里巴巴将为其托管的生产版本这样做)。但这并不意味着你可以在桌面上使用完整的上下文窗口(随着提示增长,键值缓存会消耗更多内存)。

Original source

本文由 AI 翻译整理自 The New Stack,原文版权归原作者所有。

阅读英文原文
上一篇
CoT Prompting 实战指南:何时用、怎么用
下一篇
什么是AI上下文架构?为什么不建议自建?