DeepSeek V4-Pro 与 Harness:从模型升级走向可组合的 Agent 基础层

DeepSeek 发布 V4-Pro 并预览 DeepSeek Harness,将可调 reasoning effort、Responses API、插件化 runtime 和可追踪执行记录放在同一个 agent stack 内。

DeepSeek 于 2026 年 8 月 13 日宣布 DeepSeek-V4-Pro GA Release,同日展示 DeepSeek Harness developer preview。两者放在一起看,比单纯推出一个新模型更有意思:V4-Pro 提供更强的 agent 能力,而 Harness 则处理模型如何理解环境、使用工具、持续工作和留下记录的基础问题。

V4-Pro 的更新包括 flexible reasoning effort。DeepSeek 将 low、high 和 max 分别对应简单工作、日常 Agent workflow 和复杂任务,让开发者按任务难度调整推理投入。V4-Pro 同时支持原生 OpenAI Responses API,官方表示已针对 Codex 优化并提供一键设置;模型名称维持不变,API 使用者可按现有文档接入。这些是 DeepSeek 的产品说明,并不等于所有 agent 任务都会自动得到同样提升。

API 价格也有新的排程设计。DeepSeek 表示 V4 系列推出后会引入 peak 和 off-peak rate,off-peak 价格比 peak 低 50%;新价格在 2026 年 8 月 16 日 16:00 UTC 起生效。对于长时间 agent 或批量工作来说,这把模型成本与执行时间表连在一起,企业可以考虑把非即时任务安排在低峰时段,但仍要确认服务可用性和完成时限。

DeepSeek Harness 的核心口号是「Everything is a plugin」。官方页面把 model、tools、skills、sessions、sandboxes、storage、loops、scheduling 和 UI 都视为可替换或可重新组合的 plugin。Cordis kernel 负责 plugin mounting、unmounting 和 dependencies,再由 services 和 events 让各能力互相协作。这个设计把 agent 从一个模型调用,拆成可以被观察、替换和测试的 runtime。

另一个重点是可追踪性。Harness 会把模型看到的 system prompts、reasoning、tool calls 和 results、subagent scheduling 以及 context injection 记录在 append-only session log;Trajectory view 可以按来源检查,并支持 resume、fork、search 和 replay。对于需要 debug、评估和审计的 agent workflow 来说,这比只保留最后答案更有用,因为失败可能发生在工具、上下文或排程,而不只在模型输出。

Harness 提供多种 runtime mode:Standard 包含完整工具集,Code mode 让模型用 Code Mode SDK 组合多轮工具调用,Minimal mode 只保留 shell 和文件编辑器,Creator mode 则用来检查 runtime、测试 Cordis plugin 和组合自定义 preset。开发者可以用 npx @deepseek-ai/dsh web 启动 Web UI,也可以从 GitHub 源代码安装。官方仍把它标示为 developer preview,并提醒会有 compatibility-breaking changes。

这次发布的实际讯号,是 agent 产品的竞争正在由「模型能否回答」转向「模型能否在可控 runtime 中工作」。V4-Pro 的 reasoning effort 和 Responses API 解决模型接入与任务分级,Harness 则把工具、记忆、sandbox、loop、排程和 trace 放到可组合层。部署时仍要自行检查 plugin 权限、敏感数据、重播记录的保护方式和升级相容性;developer preview 不能当作 production SLA。

MODULE.002 //

更多 Insights

分享网站、AI automation、数码营销、AI news 和 VMTS 公司新闻。