# DeepSeek Harness 公测，对标 Claude Cowork 并开放插件生态

- 来源：IT之家（RSS）
- 发布时间：2026-08-13 20:52
- AIHOT 分数：75
- AIHOT 链接：https://aihot.virxact.com/items/cmsrjkbcd02tiro46cfjwidak
- 原文链接：https://www.ithome.com/0/989/446.htm

## AI 摘要

DeepSeek 开源 MIT 协议的代码智能体框架 Harness v0.1 开发者预览版，采用“一切皆插件”架构，对标 OpenAI Codex 与 Anthropic Claude Cowork。

## 正文

IT之家 8 月 13 日消息，DeepSeek-V4-Pro-0813 正式开源，同时还推出了其开源（MIT 协议）的代码智能体框架 Harness 的 v0.1 开发者预览版（基于 Cordis），并同步开放了配套的插件生态系统。

截至IT之家发稿，相关 GitHub 仓库仍处于非公开状态（更新：现已公开）。

在已安装 Node.js 开发工具链的系统中，可以使用 npx 命令快速启动 DeepSeek Harness 的 Web UI：

npx @deepseek-ai/dsh web

该命令会启动 Web UI，默认地址为 http://127.0.0.1:3080。

如需从仓库源码运行：

git clone https://github.com/deepseek-ai/deepseek-harness.git cd deepseek-harness pnpm install pnpm run build pnpm dsh web

据官方介绍，DeepSeek Harness 采取“一切皆插件”的设计思路。深度求索采用插件式开放架构来构建 Agent Harness：模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等所有 Agent 能力均由插件组合而成，可自由替换、灵活重组。

“Harness”的通俗定义是将模型转化为智能体的工具。在大型语言模型之外，Harness 负责调度上下文、工具、任务状态、反馈与边界，把模型能力落地到真实环境中，完成从理解需求到交付代码的完整闭环。DeepSeek 此前在官方招聘信息中给出了“Model+Harness=Agent”的公式。

在产品定位上，DeepSeek Harness 精准对标 OpenAI Codex 及 Anthropic Claude Cowork，旨在成为一款主打编程和办公场景的 AI 生产力工具。

团队负责人崔添翼已于 8 月 2 日面向全球公开征集 Harness 内测用户。招募帖发布后，短时间内吸引了数十名全球开发者报名。

DeepSeek Harness 基于具有时空可组合性的 Cordis 插件系统构建。Cordis 元框架只负责插件的加载与卸载以及依赖关系，Agent Harness 的所有具体组件都是不同的 Cordis 插件。插件通过 Cordis 服务与事件彼此协作，并可以在配置层自由组合。

开发者无需改动 DeepSeek Harness 的源码本身，就能以插件的方式独立选择、替换或扩展其中的任一能力。这就是 DeepSeek Harness 最重要的设计原则：一切皆插件。

DeepSeek Harness（DSH）提供 dsh 命令行工具，用于产品配置与启动。其核心命令 dsh --profile <name> 用于启动指定配置文件。该工具支持 Web、Headless 等多种运行模式，并允许通过插件机制进行扩展。

针对不同的使用场景，DeepSeek Harness 提供四种模式，每种模式会默认加载不同的插件集合：

标准模式：提供完整的工具组合；

PTC 模式：程序化工具调用（Programmatic Tool Calling），由模型生成的一段代码来组合多轮工具调用；

极简模式：仅保留一个 shell 工具与一个文件编辑工具，用于最小环境下的模型基准测试；

创造模式：可以检查当前运行时、在内存中试验 Cordis 插件，并据此组合和创作新的模式。

DeepSeek-V4-Pro-0813 是一款基于混合专家（MoE）的模型，总参数量高达 1.6 万亿，实际推理中每个 token 仅激活 490 亿参数。该模型拥有 100 万 token 的上下文窗口，并支持最大 38.4 万 token 的输出长度。

在交互模式上，V4 Pro 提供“思考模式”与“非思考模式”两种选项，其中思考模式为默认设置。此外，V4 Pro 全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API 等高级功能。

据 DeepSeek 开展的内部测评，正式版相比预览版能力大幅提升，在多项测试中接近甚至超越 Claude Fable 5。例如在 Terminal Bench 2.1 测试中得分 87.9，远超预览版的 72.1。在其他测试中，DeepSWE 从 12.8 跃升至 62.7，DSBench-Hard 翻倍至 67.2。

值得关注的是，DeepSeek-V4-Pro-0813 的权重已正式开放。DeepSeek 的权重采用 MIT 许可证。此举被解读为将模型底座从对特定算力的依赖中解耦，开发者可下载自建，不再依赖云端单一服务；国产 GPU、通用算力卡无需厂商定制即可直接运行。这降低了政企私有化门槛，提升了供应链抗风险能力。
