前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8633
  • Cursor 推出自动化 Agent:基于触发器的编码助手
  • DEV 社区推出 Agent 会话分享与嵌入功能
  • AI Agent 时代需要重新设计的 CLI 交互
  • Cursor 现已支持 JetBrains 全系列 IDE
  • 企业级 MCP 网关架构实践分享
  • Claude 为何选择 Electron:原生开发的衰落
  • 24 小时训练文生图模型完全指南
  • Gemini 3.1 Flash-Lite:最快最廉的 Gemini 模型
  • Claude 工作循环机制的学术分析
  • 用 AI Agent 组建虚拟部门:单人公司自动化实验
  • Cursor 推出团队插件市场和 Agent 交互界面
  • Go 是构建 AI Agent 的最优编程语言吗
  • Claude Cowork 在 macOS 隐性占用 10GB 磁盘
  • Omni:基于 Postgres 的企业搜索引擎
  • 如何评估 AI 编程 Agent:实用技巧
  • 根据硬件配置选择合适的 LLM 模型
  • XML 标签是 Claude 的核心工作原理
  • 无缝迁移至 Claude:从其他 AI 工具切换指南
  • 将学术论文转化为交互式网页
  • 不要盲目信任 AI Agent:风险与局限分析
  • MCP Server 将 Claude Code 上下文消耗降低 98%
  • AI 时代开发者社区的新定位
  • 用 LLM 分析 TB 级 CI 日志的实战
  • 用 AI 加速内容工具开发效率提升 4 小时
  • 开源维护者免费获 Claude Max 20 倍额度
  • 开源工具 Unfucked:本地版本化管理代码改动
  • Claude Code 的设计选择与竞争优势
  • AI Agent 管理生产服务器 7 天踩坑实录
  • Google Nano Banana 2:高能力小模型图生成
  • Transformer中的混合专家架构详解
  • Copilot扩展跨文件编辑建议范围
  • Cursor推出Bugbot自动修复功能
  • OpenAI的竞争压力与战略分析
  • 用AI Agent实现DevOps工作自动化
  • 2026春季开源LLM模型架构盘点
  • 用Claude Code实现经典计算机模拟器
  • AI Agent对战的实时战略游戏平台
  • Claude Code 获原生远程控制能力
  • Sourcegraph 7.0:AI Agent 编码基础设施
  • Mercury 2:扩散模型加速推理新范式
  • Moonshine 开源语音识别超越 Whisper
  • Emdash 开源 Agent 开发框架
  • 自建 Claude Code Skill 的实践分享
  • AI 函数编程的深度实践指南
  • 实证:AI 编程实际效率低 19%,但感觉快 24%
  • Cursor 云代理支持代码测试与演示
  • Wolfram 为 LLM 增强符号计算能力
  • MIT 缺失学期课程 2026 版发布
  • 171 个 LLM 时间线:2017-2026 完整演进
  • 过度依赖 AI:程序员如何自救
  • AI 大规模重构代码库的真实结果复盘
  • 已加载 51 / 8633
9.0
重磅
AI SCORE
编程提效2026-02-28 18:01

MCP Server 将 Claude Code 上下文消耗降低 98%

Hacker News · mksg.lu#Claude Code#MCP#性能
Editor brief · 编辑速览

创新的 MCP server 方案,能显著减少 Claude Code 的 context 消耗,直接提升开发效率。对日常使用 Claude Code 的开发者有重大实用价值。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Claude Code 的上下文消耗减少 98% 的 MCP 服务器

Claude Code 中的每次 MCP 工具调用都会向你的 200K 上下文窗口转储原始数据。一个 Playwright 快照占用 56 KB。20 个 GitHub issue 占用 59 KB。一个访问日志 — 45 KB。30 分钟后,40% 的上下文就消耗殆尽。

Context Mode 是一个 MCP 服务器,位于 Claude Code 和这些输出之间。315 KB 变成 5.4 KB。减少 98%。

MCP 已成为 AI Agent 使用外部工具的标准方式。但其核心存在一个矛盾:每次工具交互都会从两个方向填充上下文窗口 — 传入端是工具定义,传出端是原始输出。

启用 81+ 个工具后,143K 个 token(72%)在你的第一条消息前就被消耗了。然后工具开始返回数据。一个 Playwright 快照消耗 56 KB。一个 gh issue list 转储 59 KB。运行一个测试套件、读取日志文件、获取文档 — 每个响应都会蚕食剩余的上下文。

Cloudflare 证明了工具定义可以通过 Code Mode 压缩 99.9%。我们问:另一个方向呢?

沙箱如何工作

每个 execute 调用都会生成一个独立的子进程,具有自己的进程边界。脚本无法访问彼此的内存或状态。子进程运行你的代码、捕获 stdout,只有 stdout 进入对话上下文。原始数据 — 日志文件、API 响应、快照 — 永远不会离开沙箱。

十种语言运行时可用:JavaScript、TypeScript、Python、Shell、Ruby、Go、Rust、PHP、Perl、R。Bun 被自动检测以获得 3-5 倍更快的 JS/TS 执行速度。

认证型 CLI(gh、aws、gcloud、kubectl、docker)通过凭证传递工作 — 子进程继承环境变量和配置路径,但不会向对话暴露它们。

知识库如何工作

索引工具按标题对 markdown 内容进行分块,同时保持代码块完整,然后将其存储在 SQLite FTS5(Full-Text Search 5)虚拟表中。搜索使用 BM25 排名 — 一种概率相关性算法,根据词频、逆文档频率和文档长度标准化对文档进行评分。在索引时应用 Porter 词干提取,使得 "running"、"runs" 和 "ran" 匹配相同的词干。

当你调用搜索时,它返回带有其标题层级的精确代码块 — 不是摘要、不是近似值、而是实际索引的内容。fetch_and_index 将此扩展到 URL:获取、转换 HTML 为 markdown、分块、索引。原始页面永远不会进入上下文。

在 11 个真实场景中验证 — 测试分类、TypeScript 错误诊断、git diff 审查、依赖审计、API 响应处理、CSV 分析。所有输出都在 1 KB 以下。

场景 原始大小 输出大小
Playwright 快照 56 KB 299 B
GitHub issue(20 个) 59 KB 1.1 KB
访问日志(500 个请求) 45 KB 155 B
分析 CSV(500 行) 85 KB 222 B
Git 日志(153 次提交) 11.6 KB 107 B
仓库研究(subagent) 986 KB 62 KB(5 次调用对比 37 次)

完整会话中:315 KB 的原始输出变成 5.4 KB。出现减速前的会话时间从约 30 分钟延长到约 3 小时。45 分钟后剩余的上下文:99% 而不是 60%。

如何安装

两种方式。插件市场提供自动路由钩子和斜杠命令:

claude://install?url=marketplace://mksglu/claude-context-mode

或仅 MCP,如果你只想要这些工具:

{
  "mcpServers": {
    "context-mode": {
      "command": "npx",
      "args": ["@mksglu/mcp-context-mode"]
    }
  }
}

重启 Claude Code。完成。

实际的变化是什么

你不需要改变工作方式。Context Mode 包含一个 PreToolUse 钩子,自动将工具输出路由通过沙箱。Subagent 学会使用 batch_execute 作为它们的主要工具。Bash subagent 升级为 general-purpose,以便它们可以访问 MCP 工具。

实际的差异:你的上下文窗口不再填满。曾经在 30 分钟时撞墙的会话现在可以运行 3 小时。相同的 200K token,使用更谨慎。

为什么现在

我运营 MCP 目录与枢纽。每天 100K+ 请求。见证了每一个上线的 MCP 服务器。模式很清楚:每个人都构建向上下文转储原始数据的工具。没人在解决输出端。

Cloudflare 的 Code Mode 博客文章使其具体化。他们压缩了工具定义。我们压缩工具输出。相同的原则,另一个方向。

最初为我自己的 Claude Code 会话构建。注意到在上下文退化前我可以工作 6 倍更长。开源了。

开源。MIT。github.com/mksglu/claude-context-mode

Mert Köseoğlu,高级软件工程师、AI 顾问。x.com/mksglu · linkedin.com/in/mksglu · mksg.lu

Original source

本文由 AI 翻译整理自 Hacker News · mksg.lu,原文版权归原作者所有。

阅读英文原文
上一篇
不要盲目信任 AI Agent:风险与局限分析
下一篇
AI 时代开发者社区的新定位