DeepSeek V4-Pro 與 Harness:由模型升級走向可組合的 Agent 基礎層

DeepSeek 發布 V4-Pro 並預覽 DeepSeek Harness,將可調 reasoning effort、Responses API、插件化 runtime 和可追蹤執行紀錄放在同一個 agent stack 內。

DeepSeek 在 2026 年 8 月 13 日宣布 DeepSeek-V4-Pro GA Release,同日展示 DeepSeek Harness developer preview。兩者放在一起看,比單純推出一個新模型更有意思:V4-Pro 提供更強的 agent 能力,而 Harness 則處理模型如何理解環境、使用工具、持續工作和留下紀錄的基礎問題。

V4-Pro 的更新包括 flexible reasoning effort。DeepSeek 將 low、high 和 max 分別對應簡單工作、日常 Agent workflow 和複雜任務,讓開發者按任務難度調整推理投入。V4-Pro 同時支援原生 OpenAI Responses API,官方表示已針對 Codex 優化並提供一鍵設定;模型名稱維持不變,API 使用者可按現有文件接入。這些是 DeepSeek 的產品說明,並不等於所有 agent 任務都會自動得到同樣提升。

API 價格也有新的排程設計。DeepSeek 表示 V4 系列推出後會引入 peak 和 off-peak rate,off-peak 價格比 peak 低 50%;新價格在 2026 年 8 月 16 日 16:00 UTC 起生效。對長時間 agent 或批量工作來說,這把模型成本與執行時間表連在一起,企業可以考慮把非即時任務安排在低峰時段,但仍要確認服務可用性和完成時限。

DeepSeek Harness 的核心口號是「Everything is a plugin」。官方頁面把 model、tools、skills、sessions、sandboxes、storage、loops、scheduling 和 UI 都視為可替換或可重新組合的 plugin。Cordis kernel 負責 plugin mounting、unmounting 和 dependencies,再由 services 和 events 讓各能力互相協作。這個設計把 agent 從一個模型呼叫,拆成可以被觀察、替換和測試的 runtime。

另一個重點是可追蹤性。Harness 會把模型看到的 system prompts、reasoning、tool calls 和 results、subagent scheduling 以及 context injection 記錄在 append-only session log;Trajectory view 可以按來源檢查,並支援 resume、fork、search 和 replay。對需要 debug、評估和審計的 agent workflow 來說,這比只保留最後答案更有用,因為失敗可能發生在工具、上下文或排程,而不只在模型輸出。

Harness 提供多種 runtime mode:Standard 包含完整工具集,Code mode 讓模型用 Code Mode SDK 組合多輪工具調用,Minimal mode 只保留 shell 和檔案編輯器,Creator mode 則用來檢查 runtime、測試 Cordis plugin 和組合自訂 preset。開發者可以用 npx @deepseek-ai/dsh web 啟動 Web UI,也可以從 GitHub 原始碼安裝。官方仍把它標示為 developer preview,並提醒會有 compatibility-breaking changes。

這次發布的實際訊號,是 agent 產品的競爭正在由「模型能否回答」轉向「模型能否在可控 runtime 中工作」。V4-Pro 的 reasoning effort 和 Responses API 解決模型接入與任務分級,Harness 則把工具、記憶、sandbox、loop、排程和 trace 放到可組合層。部署時仍要自行檢查 plugin 權限、敏感資料、重播紀錄的保護方式和升級相容性;developer preview 不能當作 production SLA。

MODULE.002 //

更多 Insights

分享網站、AI automation、數碼營銷、AI news 和 VMTS 公司新聞。