前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8634
  • Superpowers:Agent 开发的完整方法论框架
  • OpenCodeReview:支持多 LLM 的混合架构代码审查
  • OpenWork:开源 AI 工作流分享应用
  • 微软 VibeVoice:压缩至 1.5GB 的实时语音识别引擎
  • Agent2Agent 协议周年:自主 Agent 安全协作框架
  • Jules:AI 编码 Agent 的度量框架
  • ADK Go 2.0:图基工作流引擎与多 Agent 编排
  • MaxText 弹性训练:秒级故障恢复
  • Gemini 企业版新增并行网络搜索 Grounding
  • Conductor 演进:自然对话式的 Spec 驱动开发
  • A2A 协议实战:Python 与 Go Agent 跨语言协作
  • Genkit 新增 Agents API:简化对话 AI 开发
  • LiteRT.js:Google 浏览器端 AI 推理运行时
  • Tunix:解决 TPU 闲置的高吞吐量 Agent 训练库
  • Ray 在 TPU 上的分布式 AI 工作流优化
  • Agent 资源发现规范:工具/技能/Agent 查询标准
  • A2UI + MCP:声明式 UI 与自定义 Agent UI 架构对比
  • 编码 Agent 质量飞轮:自动化评估五阶段流程
  • 千问 3.5 MoE 在 TPU 上的系统优化实战
  • 模块化 Prompt 转译:让系统指令可复用可验证
  • 微软弃追超大模型,转向廉价专用模型
  • MCP 服务发现注册表的安全保证
  • 理解 LLM 无状态性与 Agent 内存设计
  • Agent 内存系统的隐形 bug:时间漂移
  • 视觉 Agent 的可复现测试:宝可梦游戏案例
  • LangChain 初阶教程:内存与中间件
  • 5 大协议主导 Agent 商务交互
  • 何时需要给 Agent 设置权限边界
  • Microsoft 365 Copilot 破 3000 万付费座位
  • 美国 FCC 禁止进口中国机器人和逆变器
  • OpenJDK 发布生成式 AI 使用临时政策指南
  • Grafana 开源 Go LLM SDK,支持流式与工具调用
  • GCC 编译器社区发布生成式 AI 使用政策
  • 本体论复兴:如何让 AI Agent 行为可控
  • 监管以儿童保护名义施压开源 AI 项目
  • LLM 根本缺陷:为何完全安全防护不可能
  • 腾讯开源 AngelSpec:LLM 推理加速框架
  • OpenAI发布GPT-5.6,性价比大幅提升
  • Agent-Manager:统一管理多个 AI 编程助手的终端工具
  • OpenAI 争议声明 GPT-5.6 超越 Opus
  • Claude Code 团队:过度约束让 AI 工具失效
  • 硬件厂商放弃参数堆叠,转向芯片推理优化
  • VS Code 7月更新强化Copilot:Agent与代码审查
  • 李飞飞 World Labs 开始训练机器人模型
  • Token Saver:将 Claude PDF 成本降低 99% 的 MCP 工具
  • 分布式算力新架构:性能翻倍成本砍半
  • AlphaFold 团队重组,诺奖得主投靠 Anthropic
  • 字节清华联合融资重构企业软件工程
  • 从 Prompt 到 Loop 再到 Graph:AI 工程范式演进
  • WorkBuddy重大升级,国内效率AI工具再迭代
  • 开源 MoonEP:MoE 分布式训练通信库
  • 已加载 51 / 8634
7.0
热点
AI SCORE
行业动态2026-07-30 21:11

微软弃追超大模型,转向廉价专用模型

The Decoder#微软#模型成本
Editor brief · 编辑速览

微软 AI CEO 披露战略转变:放弃追赶通用大模型,专注成本低廉的专用模型,性能与成本比明显优于对手。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

微软 AI 战略:押注廉价专业模型而非前沿通用大模型

微软 AI 将 token 效率作为竞争重点,倾向于使用小型专业模型而非通用前沿模型。AI CEO Mustafa Suleyman 表示,行业必须在顶级性能和成本之间权衡。微软没有采用单一的通用模型,而是为特定领域训练小型紧凑模型。该公司最新的网络安全模型 MAI-Cyber-1-Flash 在 CyberGym 基准测试中超过 Anthropic 的 Mythos 12 个百分点,成本仅为后者的一半,Suleyman 表示。但这个结果需要 MDASH 系统的支持,该系统可以协调多个模型,并将困难任务路由到 OpenAI 的推理模型。微软还表示,与 GPT-Image-2 相比,MAI-Image-2.5-Flash 将 GPU 成本降低了最多 84%。

Suleyman 还希望建立可互换的模型,使微软不依赖于某一个模型系列。小型 MAI 模型能否部分取代 OpenAI 并匹配其性能仍然值得怀疑。

竞争正从单个模型转向支撑系统,即路由任务和提供上下文的软件。编排器将大部分工作发送给成本更低的专业模型,为困难情况保留前沿模型。Anthropic 在 Claude Fable 5 中采用了这种方法,而 Sakana 围绕这一方法构建了 Fugu。

无炒作的 AI 新闻 — 由人工策划

订阅 THE DECODER,享受无广告阅读、每周 AI 通讯、我们独家"AI Radar"前沿报告(一年六次)、完整档案访问权限以及评论区访问权限。

Original source

本文由 AI 翻译整理自 The Decoder,原文版权归原作者所有。

阅读英文原文
上一篇
模块化 Prompt 转译:让系统指令可复用可验证
下一篇
MCP 服务发现注册表的安全保证