前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
返回 AI 情报前线
All News · 全部资讯4098
  • Claude 订阅调整:Fable 额度新规
  • AI 编程代理的五问预检框架:风险识别与验证
  • 异常检测设计:队列优于仪表板
  • 教育软件需要严谨性:从希望到可解释决策
  • 神经符号搜索模型Ontology 1性能碾压谷歌和亚马逊
  • 程序员用 Claude Code 重写官方应用实战
  • AI Agent 入侵 460+ 系统事件:Agent 安全的实战教训
  • 多项目 AI Agent 管理的规律性运维框架
  • Cursor IDE增加Google Workspace集成:MCP协作方案落地
  • 工具发布前必须真实使用:质量守门人的最佳实践
  • Claude Code Hooks 与系统提示的设计对比
  • Agent 系统的权限审核机制:从二元开关到分类控制
  • 人工工作流转化为Agent程序的系统方法
  • AI Agent 聊天记录修改漏洞:客户端历史可被篡改
  • 六大AI编码环境的统一MCP配置方案
  • 医疗LLM本地部署的数据主权架构
  • LLM 应用必备:验证层从第一天就要搭建
  • DeepSeek V4 Flash 正式版发布
  • AI算力真正的瓶颈:工作流执行效率
  • Opus 5单提示生成完整游戏,成本仅423美元
  • condense-json:JSON 去重压缩库达 1.0
  • Node.js 图像生成 API 选型实战指南
  • AI 基础设施演进:从 GPU 供应到 Workload 执行层
  • 多模型 API 成本对比:输入输出比例才是关键
  • 小网站流量突增的常见故障及应对方案
  • AI 代码工具实战:90+ 应用交付的工作流改造
  • LLM 推理能效优化:量化与成本控制
  • 向量数据库选型指南:RAG 与语义搜索的基础设施对标
  • AI 代码工具的团队协作陷阱:个体快不等于团队快
  • 近半数 MCP 服务器存在工具歧义风险
  • Cognito 登录失败:配置陷阱的实战排查指南
  • Agent 评估框架实战:AgentEval Forge 开源工具发布
  • Node.js 中的 LLM API 网关:成本控制与路由中枢
  • AI 编程 Agent 密钥泄露风险与防护
  • 实时配置校验:自动捕获陈旧度量数据的系统
  • 多智能体分布式架构:联邦 MCP 服务器方案
  • LLM 推理部署完全指南(第一部分)
  • Databricks Lakebase:数据库分支管理系统
  • 欧盟AI法规正式生效程序员须关注
  • 多工具编排器实现:能力路由与权限控制
  • GraphRAG:知识图遍历解决多跳推理问题
  • 长对话 AI 系统的 Context Window 管理实战
  • MCP 服务器 Schema 演化的实证分析
  • GitHub Models 关闭与 AI 供应商锁定风险
  • 46000条文本实测:RAG 技术哪些真的有效
  • 13 个 AI 项目漏洞启示:生产级代码审计要点
  • AI Agent 自动化代码维护:预算、分级与安全机制设计
  • 让LLM玩对话游戏的核心工程方案
  • 多智能体任务编排架构:分工协作超越单 Agent 局限
  • Twilio+Deepgram搭建AI接线员的完整技术方案
  • 让 AI Agent 管理家庭服务器:沙箱隔离与权限分级实战
  • 已加载 51 / 4098
8.0
热点
AI SCORE
开源项目2026-08-03 06:19

condense-json:JSON 去重压缩库达 1.0

Simon Willison#开源库#JSON#优化
Editor brief · 编辑速览

Simon Willison 开源库 condense-json 发布 1.0 版本,可自动识别重复子串压缩 JSON 体积,已用于 LLM 日志存储优化。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

我正努力让自己更有勇气发布 1.0 版本。这个小型 library 至今已有一年半的历史——我为它加入了一些合理且不会造成破坏性影响的修复,然后正式发布了 1.0 大版本。

下面这个示例摘自 README,展示了它的能力:

{
  "foo": {
    "bar": {
      "string": "This is a string with foxes in it",
      "nested": {
        "more": ["Here is a string", "another with foxes in it too"]
      }
    }
  }
}

将它与下面这个 replacements 对象结合使用:

{"1": "with foxes in it"}

condense_json(input_json, replacements) 会生成以下结果:

{
  "foo": {
    "bar": {
      "string": {"$r": ["This is a string ", {"$": "1"}]},
      "nested": {
        "more": ["Here is a string", {"$r": ["another ", {"$": "1"}, " too"]}]
      }
    }
  }
}

它会扫描 replacements 对象中存在的字符串或子字符串,并在输出中使用一种特殊的 {"$r": ...} 语法替换它们。

你可以使用 uncondense_json(condensed, replacements) 还原这一过程。

它的设计目标,是让包含其他相关结构中重复数据的 JSON 更容易存储。我用它来节省 LLM 所生成的 SQLite 日志占用的空间——最新一轮实现请参阅 PR #1586。

无状态 MCP 再次引起了我的兴趣(并促使我开发了 mcp-explorer 和 datasette-mcp)——2026 年 7 月 31 日

OpenAI 意外对 Hugging Face 发起的网络攻击,是已经真实发生的科幻故事——2026 年 7 月 22 日

与 Claude Code 团队的 Cat 和 Thariq 炉边对谈——2026 年 7 月 21 日

这是 Simon Willison 发布的一则短文,发布于 2026 年 8 月 2 日。

每月赞助我 10 美元,即可收到一封精心整理的邮件摘要,汇集当月最重要的 LLM 进展。

付钱让我少给你发一些!

Original source

本文由 AI 翻译整理自 Simon Willison,原文版权归原作者所有。

阅读英文原文
上一篇
Opus 5单提示生成完整游戏,成本仅423美元
下一篇
Node.js 图像生成 API 选型实战指南