前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8336
  • Next.js Serverless 下 PDFKit 字体缺失修复
  • 评测编码Agent前,先用同一组任务跑两遍
  • LLM Wiki:文档自动构建可维护知识库的开源桌面应用
  • 深入解析结构化输出:让 AI 生成绝对可解析的 JSON
  • MCP安全核心是权限体系重设计,而非传统边界防护
  • GPT-6 Astra 在机器人基准测试中展现空间推理飞跃
  • Auterix:零依赖通用协议,跨 21 个 AI 工具统一上下文规范
  • 后量子 TLS 是平台迁移工程,不是密码学研究
  • Anthropic 发布 AI-Native SDLC 实践手册:代码不再是瓶颈
  • OpenAI 建议 GPT-6 Astra 提示词应精简,减少安全限制
  • Claude Code 创始人:AI 编程要守住代码质量标准
  • Hyperresearch:Agent 驱动的研究知识库,单次跑 250+ 信源
  • 12 个已落地的 B2B 营收 AI Agent 用例,附代码
  • LLM 项目上线后才会暴露的 6 个隐蔽 Bug
  • OpenAI 代理向 RubyGems 上传两千恶意包
  • AI 时代缓存失效难题复发:LLM 推理的隐性成本
  • Google发布TimesFM-3:单次前向传播即可完成多步时间序列预测
  • 阿里 Qoder CLI 开放自定义模型接入
  • 开源项目 Minitap 指控谷歌盗用代码用于 Artemis,许可证违规引热议
  • GPT-6 Astra 刷穿 FrontierMath Tier 4,AI 数学能力达新里程碑
  • Kimi K2.8发布:性能逼近K3百万上下文全员开放
  • DeepSeek v4.1-Flash发布:763B参数新型因果编解码架构
  • AI Agent 何时该停:成本控制的核心工程问题
  • 三大AI编程工具实战对比:Claude Code六个月生产级使用报告
  • Trail of Bits开源Coop:用隔离VM安全运行Claude Code和Codex
  • OpenAI代理今年5月攻击RubyGems详情披露
  • Google Tunix:TPU上的自主LLM后训练框架
  • GitLab CVE-2026-85706:CVSS 10.0 路径遍历漏洞正被主动利用
  • RAG 检索失效的根源:分块策略正在毁掉你的 AI 应用
  • CPython 字节码缓存导致测试失效的隐藏bug
  • OpenAI代理攻击RubyGems:技术细节与行业反思
  • Anthropic 内部调查:七成公司无法衡量 AI 工具实际回报
  • OpenRouter 隐性陷阱:同一端点行为不一致
  • 字节Seed研究:LLM自建测试harness泛化性堪忧,仅34%有效
  • GitHub Copilot支持查看VS Code Agents使用量指标
  • OpenAI正式开放Agents API:日烧7千美元研发现已公测
  • Anthropic 为 Claude Code 推出插件评测工作流,含 6 种评分器与无插件基准线
  • 一招配置:让 Claude Code、Cursor、Cline 等主流 AI 编程工具共用同一个国产模型端点
  • 我用 Claude Code 搭 AI 团队,抓到它给自己打高分
  • 律师因AI幻觉证人被罚5000美元
  • AI 搜索引擎如何理解网站:RAG 到引用的技术链路
  • 幂等性:防止大问题的 API 小概念
  • OpenAI 自托管执行器只向外拨号,所以我们的停止按钮是个队列
  • AI Agent 大规模利用 PaperCut 漏洞攻陷 395 家机构
  • Copilot 代码审查新增自动关闭评论与智能提交信息
  • n8n详解流程编排:执行模型、可观测性与生产挑战
  • 律师因引用AI伪造证人被惩处的全过程
  • Reflection 模式:AI Agent 在生产环境的自我纠错实践
  • AWS 双层方案监控生产环境 Agent 生命周期
  • 选对 Bedrock 上的 OpenAI 模型:超越每百万 token 价格
  • 用 Bedrock AgentCore 构建支持交互组件的 MCP 应用
  • 已加载 51 / 8336
8.0
热点
AI SCORE
模型发布2026-09-12 13:58

Kimi K2.8发布:性能逼近K3百万上下文全员开放

量子位#Kimi#长上下文#模型发布
Editor brief · 编辑速览

Kimi发布K2.8版本,性能接近K3,百万字上下文窗口向所有用户开放,冲刺港股IPO。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Kimi又发了个新模型,把K3的能力打到全价位段了。

9月11日,Kimi K2.8 Preview在Kimi Code和Kimi Work全量上线,官方称综合性能接近旗舰 K3,且Coding和Agent能力进一步提升。

最实质的变化是在权限上,所有会员档位都能用上1M上下文了。

文章配图

对比来看,K3的百万上下文目前仍需Allegretto及以上会员。

就在前一天,外界获悉,月之暗面的ARR在8月突破了10亿美元,而6月这一数字还是3亿。

这轮增长的直接催化剂是7月发布的K3,曾凭借一波SOTA级前端能力打出了全球声量。

据彭博社消息,公司内部希望,年底ARR可以冲到20亿美元。

K2.8 Preview这个名字,很容易让人觉得月之暗面又做出了一个更小更便宜的K3。

K2.8 Preview的综合性能接近K3,Coding和Agent能力全面提升,思考效率较K2.7 Code显著改善;

支持low/high/max三档reasoning effort,与K3的思考等级对齐;

同时支持图片和视频输入,上下文窗口为1M。

文章配图

不过,本次预览更新没有公布任何benchmark数据,所以"综合性能接近K3"到底接近到什么程度呢?

毕竟K3发布时也是传奇,总参数量2.8万亿、激活约1040亿参数的MoE模型,追求的是在各项基准上跑赢海外旗舰,而代价则是贵、慢、吃资源。

相较于这种跑分定位,K2.8 Preview大概是纯过日子模了,它被定位在"更适合代码补全和常规开发任务"。

当前,Kimi Code会员有五档,Adagio免费、Andante¥49/月、Moderato¥99/月、Allegretto¥199/月、Allegro¥699/月。

K3从¥99档起才能调用,1M上下文要¥199档以上,而K2.8 Preview所有会员可用,且直接给到1M。

文章配图

这里的会员档位名称也是在K3发布后调整的:

Adagio是柔板、Andante是行板、Moderato是中板、Allegretto是小快板、Allegro是快板,Kimi是老板……这种命名方式和他的音乐爱好也有关联吧(沉思)。

无感知替换,原有的kimi-for-coding直接升级为K2.8 Preview,Model ID保持不变;

在Kimi Code里接管K3需求,K3系列关闭thinking后,请求也会被转给K2.8 Preview的无思考版本;

不止编程场景,Kimi Work也同步上线了K2.8 Preview。

K2.8也很难与月之暗面当前紧锣密鼓的商业化节奏分开看。

据报道,月之暗面的ARR在今年3月约为1亿美元,4月升至约2亿美元,6月超过3亿美元。

而到8月这一数字已突破10亿美元,公司希望在年底前达到20亿美元。

它在7月发布后,以开源权重、超长上下文和旗舰级编程能力迅速打开了市场。

它的定价为每百万token输入3美元、输出15美元,仅为对手的三分之一,同时在编程基准上超过Claude Opus 4.8和GPT-5.5。

在Arena.ai前端代码竞技场上,K3以1679分登顶,超过Claude Fable 5和GPT-5.6 Sol——而前代K2.6在同一榜单上仅排第18位。

目前,K3系列每天生成约3000亿token。

尽管如此,要从10亿冲到20亿,仅靠一个高成本的旗舰模型是难以支撑的。

而且K3也并非没有产品层面的边界,月之暗面在K3技术博客中提到过,K3对历史thinking内容较敏感。

也就是说,如果Agent框架没有完整传回此前的思考记录,或在会话中途从其他模型切换到K3,生成质量可能明显不稳定。

并且,K3在模糊任务中可能表现得过于主动,自行作出超出用户预期的决定。

故而"能力上限"有时候也不等于"所有场景下的最好体验",对于代码补全、修改和明确边界内的日常开发,用户可能还是更喜欢行为更可控、调用门槛更低的模型。

这时候,一个单位成本更低、能够大规模铺开的主力模型就必须要推出来了。

据彭博社消息,本月初,月之暗面以保密形式向港交所递交了A1上市申请文件,正式启动港股IPO流程。

从估值曲线来看,2025年底月之暗面C轮投后估值43亿美元,2026年5月涨到200亿,7月F轮后达到350亿。

7 月底,月之暗面同时启动了Pre-IPO轮融资,投前估值升至500亿美元。

按500亿美元投前估值和当时公开的3亿美元ARR来算,市销率为167倍。

作为参照,Anthropic的这一倍数约为20,OpenAI约40,智谱万亿市值时约94。

因此,让更多人用起来,让单位调用的成本降下来,可能真的是Kimi的当务之急。

[1]https://www.kimi.com/code/docs/kimi-code/whats-new.html

[2]https://www.kimi.com/code/docs/kimi-code/models.html

[3]https://www.bloomberg.com/news/articles/2026-09-11/china-ai-star-moonshot-eyes-2-billion-annualized-sales-in-2026

[4]https://x.com/notjazii/status/2098400259223458188?s=46

180万刀,连亚马逊都烧不起Claude了2026-08-09

AI批量轰炸苹果bug赏金计划,审核团队已下线2026-08-07

获奖之后,王虹最想感谢的人2026-08-01

Claude Code之父:Harness保质期只有半年,解开缰绳吧2026-07-30

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1

Original source

本文由 AI 翻译整理自 量子位,原文版权归原作者所有。

阅读英文原文
上一篇
GPT-6 Astra 刷穿 FrontierMath Tier 4,AI 数学能力达新里程碑
下一篇
DeepSeek v4.1-Flash发布:763B参数新型因果编解码架构