前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
返回 AI 情报前线
All News · 全部资讯5136
  • 如何根据任务场景选择LLM:超越基准测试的评估方法论
  • OpenAI大规模研究:1500家企业1700万条消息揭示企业AI使用真相
  • 别自己造LLM路由轮子:Pre-built方案才是多数团队的正确选择
  • SharePoint CVE-2026-55040漏洞正在爆发:公开PoC已发布
  • Vibe Coding 引发的安全风险:开发者必须知道的事
  • MCP协议强制要求OAuth 2.1:AI Agent身份验证洗牌
  • AI Agent网页数据抓取:从原始DOM到结构化API的正确姿势
  • 在免费服务器上预演Agent回滚,再决定是否执行真实变更
  • AI让代码产出增加33%,但review等待时间暴增441%
  • 选模型前先做可复现性验证:单次pass rate不足以决策
  • 什么是API的Agent就绪度:让AI Agent能自主发现、理解并调用你的服务
  • EU AI Act已成垂直AI的业务阻断风险:一个修复方案
  • Claude Code 已能自主维护 Anthropic 自家代码库,46% PR 合并率
  • MCP 工具防误触发:写前检查值而非仅检查字段是否为空
  • 智谱GLM-5.3:自称最强开源编程模型,权重两周后公开
  • Kimi K3定价陷阱:推理Token按输出计费,账单超预期十倍
  • 链上自主 Agent 的密钥管理:威胁模型与防护策略
  • 十个AI Agent写必挂测试,五个写出了挂不了的
  • AI 智能体风险分级权限:agent_acid 的三色权限体系
  • AI 编程工具的隐蔽风险:供应商动态修改你的 Agent 指令
  • 70天超10款国产模型:推理/编程/Agent赛道全面逼近美国闭源前沿
  • Claude Code v2.1.232:子代理分叉默认启用
  • llama.cpp b10427优化量化FFN性能,Ollama加速推理
  • DeepSeek Harness 开源:插件化 Agent 开发框架
  • GLM-5.3 发布:复杂编码与长程任务能力大幅提升
  • 自建 LLM 不会推高 Token 单价——关于 AI 推理成本的真相
  • 闪迪 HBF 高带宽闪存 2028 年量产:GPU 需求或减半
  • GLM-5.3 仅通过后训练升级:Coding 能力逼近顶级模型
  • Anydoc:开源文档万能转换器,15883星本地处理无API费用
  • OpenAI GPT-5.6 Sol 极速模式发布:吞吐量提升14倍
  • LLM API推理痕迹可被窃取:仅需两次调用即可明文提取
  • Adobe用三天hackathon解决集成难题,绕过大规模重构快速交付
  • 逆转AI流水线:先验证后生成,避免幻觉
  • 像锁文件一样固定 AI 模型版本:可复现代码生成方案
  • DeepSeek V4 Pro 前端实战测评
  • 机器人研发算力需求两年涨10倍:少花一半成本、部署效率提升80%的新思路
  • FluidVoice:完全本地运行的 macOS 语音输入工具,延迟几乎为零
  • 本地大模型部署:VRAM 与内存的 KV Cache 边界选择
  • 国产 KV Cache 产品在大模型推理中的实测对比分析
  • Gemini 3.7 Flash:Google 高效 AI 模型登陆英国
  • 传统ATS简历筛选三大技术缺陷与LLM修复方案
  • AI 编程 Agent 需要「权限预算」而非更强模型
  • Text-to-SQL 自纠正:执行反馈循环修复错误查询
  • DeepSeek V4与GPT-5.6实测对比:价格差异可达96倍
  • AI Agent 越界行动:英国安全研究院报告
  • Lovable应用移植React Native的组件对照表
  • 2026年用10美元预算开发AI SaaS原型完整指南
  • 2026 年 GPU 选型指南:H100 与 A100 成本效益对比
  • AI Agent 测试方法论:从单元测试到混沌工程
  • AI Skill跑通一次不算测试
  • 用Milvus+Ollama自建私有RAG实战
  • 已加载 51 / 5136
8.0
热点
AI SCORE
模型发布2026-08-14 17:06

70天超10款国产模型:推理/编程/Agent赛道全面逼近美国闭源前沿

IT之家#国产AI#大模型#AI编程
Editor brief · 编辑速览

梳理近两月国产 AI 模型发布:MiniMax M3、智谱 GLM-5.2/5.3、腾讯混元Hy3、Kimi K3、字节Seedance 2.5、DeepSeek V4系列等,覆盖编程、推理、多模态多个维度,部分指标已接近 GPT-5.6 Sol 和 Claude Opus 5。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

8 月 14 日消息,首尔经济日报当天发布博文,报道称自今年 6 月以来,9 家中国 AI 公司已推出 10 款 AI 模型,而且在推理、编程和智能体等关键领域正逐步逼近美国顶尖闭源模型。

文章配图

IT之家注:原文并非详细罗列完整模型清单,以下根据本站发布内容,简要汇总梳理如下,而且这里并未计入具身智能(面向机器人)等相关模型,实际推出的模型不止 10 款:

  • MiniMax M3(6 月 1 日):具备前沿的编程能力、100 万超长上下文以及原生多模态特性。
  • 智谱 AI 的 GLM-5.2(6 月 12 日):新一代旗舰级基座大模型,专注于超长程任务与高级 AI 编程能力。
  • 美团的 LongCat-2.0(6 月 30 日):总参数量达 1.6 万亿(激活参数约 480 亿)的大规模混合专家(MoE)语言模型,支持 1M 超长上下文与原生多步推理。
  • 腾讯的混元 Hy3 正式版(7 月 6 日):采用混合专家(MoE)架构,总参数量 295B,激活参数 21B,最大支持 256K 上下文长度。
  • 月之暗面的 Kimi K3(7 月 16 日):拥有 2.8 万亿参数及 100 万 Token 上下文窗口,是全球首个开源的 3 万亿参数级开源模型,性能对标全球顶尖闭源模型。
  • 字节跳动的 Seedance 2.5(7 月 31 日):Seedance 2.5 延续 Seedance 2.0 统一的多模态音视频联合生成架构,重点提升长叙事、多模态参考和编辑能力。
  • 深度求索的 DeepSeek-V4-Flash-0731(7 月 31 日):模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。
  • 阿里巴巴的 Qwen3.8-Max(8 月 3 日):该模型拥有 2.4 万亿总参数量,在编程、办公及多模态智能体等综合能力上实现了全面升级。
  • 深度求索的 DeepSeek V4-Pro-0813(8 月 13 日):原生支持 OpenAI Responses API 格式,并针对性适配 Codex。
  • 智谱 AI 的 GLM-5.3(8 月 14 日):编程能力最强的开源模型,在内部自建体感评测中较 GLM-5.2 提升 50%。

该媒体指出在 Artificial Analysis Intelligence Index v4.1.1 中,DeepSeek V4 Pro 0813 的 AI 智能体得分为 53 分,落后于 GPT-5.6 Sol(61 分)和 Claude Opus 5(63 分),但其平均单次任务成本仅为 0.06 美元,是 Claude Opus 5(2.34 美元)的 1/39。

CNBC 昨日(8 月 13 日)发布博文,报道称美国持续收紧对中国先进芯片、芯片制造设备及部分投资的限制,但中国技术正加速进入全球大型企业的业务体系。

福特借助宁德时代的电池技术;大众与小鹏合作开发中国市场所需的智能电动汽车;Stellantis 扩大与零跑汽车在电动车生产和联合采购方面的合作。

IDC 中国董事总经理 Kitty Fok 表示,中国在 5 年前是全球企业销售产品的主要市场;如今,在部分行业,中国已经成为这些企业获取技术能力的来源。

Counterpoint Research 首席分析师 Soumen Mandal 表示,2025 年比亚迪、长安汽车和奇瑞等中国汽车企业合计占全球电动汽车市场近 63%;宁德时代、比亚迪、中创新航和国轩高科等电池企业合计占据接近 70% 的市场份额。

他认为,成本、规模、制造能力、供应链整合程度和创新速度,推动全球企业继续与中国企业合作。中国技术崛起的重点,正从低成本制造转向规模化制造,不断深挖供应链深度并加速创新。

中国人工智能模型的能力持续提升,全球企业采用中国技术的原因不再主要是价格。IDC 今年早些时候对欧洲企业展开的调查显示,安全与合规要求、性能优势是大规模采用中国人工智能模型的最主要 2 个原因。

Fok 表示有种声音称"西方企业使用中国 AI 模型,很大程度是因为便宜",但这种说法并不准确,企业决策主要由性能驱动,并受到合规要求约束。

与美国的 Anthropic 和 OpenAI 不同,阿里巴巴、DeepSeek 等中国企业重点发展开源模型,让全球开发者更容易访问和使用这些模型。

Omdia 首席分析师 Lian Jye Su 表示,美国限制先进半导体出口虽然约束了中国在尖端芯片领域的发展,却也加快了中国本土创新和效率提升。中国供应商目前仍在人工智能、电池和汽车软件领域保持竞争力。

Mandal 预计,中国技术将在电动车、电池、消费电子、机器人、无人机,以及部分人工智能和半导体领域继续扩大全球应用,推动形成更加碎片化、但更注重实际利益的全球技术生态。

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
AI 编程工具的隐蔽风险:供应商动态修改你的 Agent 指令
下一篇
Claude Code v2.1.232:子代理分叉默认启用