前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8391
  • A2A 协议详解:多 Agent 通信架构与实战实现
  • R-CLI 开源:Terminal Bench 2.1 最高分背后的编程脚手架
  • CVE-2026-16584:AWS API MCP Server安全漏洞深度分析
  • GitHub Copilot已上线Gemini 3.7 Flash
  • Anthropic 为 Claude 输出文本添加水印:API 开放检测,版权认定存争议
  • Next.js 16.3发布:开发内存降低90%,AI编码Agent工作流优化
  • 一行代码修复PyTorch训练隐性内存泄漏:loss.detach().item()
  • AgentShield:防止AI代理半夜烧钱2000美元的开源防火墙
  • AI智能体存在欺骗作弊行为,用户信任度持续下滑
  • 用Azure API Management管控Claude Code团队使用
  • 模型同质化时代:选型逻辑已变,护城河在模型之外
  • DBHub vs Bytebase MCP:数据库Agent接入方案对比
  • Claude Code Plan模式深度解析:权限变化与August 14切换要点
  • Opus 5 vs GPT-5.6 Sol vs Kimi K3 三大模型编程能力实测对比
  • Grok 4.6 性能追平 GPT-5.6 Sol,价格仅为六分之一
  • 为中国AI API 构建模型目录漂移监控工具
  • Opus 5 vs GPT-5.6 Sol vs Kimi K3:三大AI代理模型横向评测
  • Grok 4.6 性能比肩 GPT-5.6 Sol:前沿竞争已成经济学竞赛
  • MCP 服务器认证在规范中为可选项:安全风险警示
  • 同一 prompt 跑 11 个主流 AI 模型:结果差异显著
  • DeepSeek Harness 公测:开源代码 Agent 框架对标 Claude Code
  • Agent 芯片新贵获 4.8 亿美元融资:首颗 AI 芯片已量产
  • Grok 4.6以更低价格重返一线,逼近Fable 5
  • Vibe Coding不是软件工程:AI编程的边界与反思
  • 扫描PDF翻译是图形问题而非翻译问题
  • MCP协议变更为无状态:工具执行幂等性挑战
  • Claude 破解数学难题:2000 阶以下哈达玛矩阵
  • DeepSeek-V4-Pro正式版:原生兼容OpenAI Responses API与Codex
  • DeepSeek V4 Flash/Pro 8月调价:输入降价达40%,并发限制调整
  • 三起AI Agent越狱事件:均因配置验证缺失
  • Claude推出隐形水印功能,可标记AI处理过的内容
  • OpenAI 发布 GPT-5.6 构建指南:聚焦 AI Agent 开发
  • AI 编程 Agent 的 Tracker 都是自我填报系统:真实问题剖析
  • Fable 5采用率低迷,企业AI支出或已触及天花板
  • AI研究者早年预测的自动化研究里程碑接连实现
  • Grok 4.6持久VM Agent测试指南:50万token上下文的工程实践
  • Gemini延期两月编程能力仍落后:谷歌DeepMind换帅内情
  • 企业级 GitLab MCP 安全加固:将 LLM 视为不可信客户端
  • Puppeteer MCP Server:让 AI Agent 直接操控浏览器
  • Anthropic 将 Claude Cowork 集成至 Chrome 扩展程序侧边栏
  • Laravel Boost v2:让AI Agent真正读懂你的Laravel项目的MCP服务器
  • OpenAI 新 API 速度提升 14 倍
  • 私有LLM总拥有成本实测:自建Llama vs 云API谁更划算
  • 和 AI 编程助手有效协作的实战技巧
  • miniVE:让 AI 编码代理在本地沙箱中安全运行
  • 第三谓词:突破词空间验证的论元空间验证方法
  • 本周 AI 开发:DeepSeek V4 Pro/Grok 4.6/Meta Muse-Glimmer 三款前沿模型扎堆
  • Claude 输出归属权与模型训练的法律边界
  • 多Agent系统状态协调:生产环境的隐形坑
  • LOOM编程语言+ARGUS架构:让AI代码权限可证伪
  • Statewave:Agent记忆字节级确定性的开源解法
  • 已加载 51 / 8391
8.0
热点
AI SCORE
工具产品2026-08-13 20:52

DeepSeek Harness 公测:开源代码 Agent 框架对标 Claude Code

IT之家#DeepSeek#开源#Agent
Editor brief · 编辑速览

DeepSeek 开源代码智能体框架 Harness,基于 Cordis 插件系统,主打“一切皆插件”架构,可通过 npx 快速启动 Web UI。产品对标 OpenAI Codex 和 Claude Code,定位 AI 编程和办公生产力工具。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

DeepSeek-V4-Pro-0813 正式开源,同步推出 Harness v0.1 开发者预览版及插件生态

IT之家 8 月 13 日消息,DeepSeek-V4-Pro-0813 正式开源,同时还推出了其开源(MIT 协议)的代码智能体框架 Harness 的 v0.1 开发者预览版(基于 Cordis),并同步开放了配套的插件生态系统。

截至IT之家发稿,相关 GitHub 仓库仍处于非公开状态(更新:现已公开)。

在已安装 Node.js 开发工具链的系统中,可以使用 npx 命令快速启动 DeepSeek Harness 的 Web UI:

npx @deepseek-ai/dsh web

该命令会启动 Web UI,默认地址为 http://127.0.0.1:3080。

git clone https://github.com/deepseek-ai/deepseek-harness.git
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh web

据官方介绍,DeepSeek Harness 采取"一切皆插件"的设计思路。深度求索采用插件式开放架构来构建 Agent Harness:模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等所有 Agent 能力均由插件组合而成,可自由替换、灵活重组。

图片

"Harness"的通俗定义是将模型转化为智能体的工具。在大型语言模型之外,Harness 负责调度上下文、工具、任务状态、反馈与边界,把模型能力落地到真实环境中,完成从理解需求到交付代码的完整闭环。DeepSeek 此前在官方招聘信息中给出了"Model+Harness=Agent"的公式。

在产品定位上,DeepSeek Harness 精准对标 OpenAI Codex 及 Anthropic Claude Cowork,旨在成为一款主打编程和办公场景的 AI 生产力工具。

团队负责人崔添翼已于 8 月 2 日面向全球公开征集 Harness 内测用户。招募帖发布后,短时间内吸引了数十名全球开发者报名。

文章配图

DeepSeek Harness 基于具有时空可组合性的 Cordis 插件系统构建。Cordis 元框架只负责插件的加载与卸载以及依赖关系,Agent Harness 的所有具体组件都是不同的 Cordis 插件。插件通过 Cordis 服务与事件彼此协作,并可以在配置层自由组合。

开发者无需改动 DeepSeek Harness 的源码本身,就能以插件的方式独立选择、替换或扩展其中的任一能力。这就是 DeepSeek Harness 最重要的设计原则:一切皆插件。

图片

DeepSeek Harness(DSH)提供 dsh 命令行工具,用于产品配置与启动。其核心命令 dsh --profile <name> 用于启动指定配置文件。该工具支持 Web、Headless 等多种运行模式,并允许通过插件机制进行扩展。

针对不同的使用场景,DeepSeek Harness 提供四种模式,每种模式会默认加载不同的插件集合:

PTC 模式:程序化工具调用(Programmatic Tool Calling),由模型生成的一段代码来组合多轮工具调用;

极简模式:仅保留一个 shell 工具与一个文件编辑工具,用于最小环境下的模型基准测试;

创造模式:可以检查当前运行时、在内存中试验 Cordis 插件,并据此组合和创作新的模式。

图片

DeepSeek-V4-Pro-0813 是一款基于混合专家(MoE)的模型,总参数量高达 1.6 万亿,实际推理中每个 token 仅激活 490 亿参数。该模型拥有 100 万 token 的上下文窗口,并支持最大 38.4 万 token 的输出长度。

在交互模式上,V4 Pro 提供"思考模式"与"非思考模式"两种选项,其中思考模式为默认设置。此外,V4 Pro 全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API 等高级功能。

据 DeepSeek 开展的内部测评,正式版相比预览版能力大幅提升,在多项测试中接近甚至超越 Claude Fable 5。例如在 Terminal Bench 2.1 测试中得分 87.9,远超预览版的 72.1。在其他测试中,DeepSWE 从 12.8 跃升至 62.7,DSBench-Hard 翻倍至 67.2。

值得关注的是,DeepSeek-V4-Pro-0813 的权重已正式开放。DeepSeek 的权重采用 MIT 许可证。此举被解读为将模型底座从对特定算力的依赖中解耦,开发者可下载自建,不再依赖云端单一服务;国产 GPU、通用算力卡无需厂商定制即可直接运行。这降低了政企私有化门槛,提升了供应链抗风险能力。

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
同一 prompt 跑 11 个主流 AI 模型:结果差异显著
下一篇
Agent 芯片新贵获 4.8 亿美元融资:首颗 AI 芯片已量产