DeepSeek 近日釋出了名為 DeepSeek Harness 的新產品,但它的形態可能出乎許多人的意料——不是一款調校完成的程式碼 Agent,而是一套開放的 Agent 開發基礎設施。官方給出的定義是:Agent 等於模型加 Harness。在 DeepSeek Harness 中,工具、會話、工作流、子 Agent 乃至使用者介面都可以被做成外掛,由名為 Cordis 的核心統一負責外掛的載入、解除安裝和依賴管理。更特別的是,外掛甚至可以在 Agent 執行過程中被更換,系統還支援“創造模式”:當 Agent 發現自己缺少某項能力時,可以現場編寫一個外掛,再掛到當前流程裡繼續工作。

這一設計思路與市場此前的期待形成了鮮明對比。過去一段時間,已有不少第三方產品圍繞 DeepSeek 模型修補結構化輸出、最佳化工具呼叫、減少快取消耗,例如作者提到的 Reasonix,甚至被 DeepSeek 官網作為核心接入 Agent 的工具來介紹。既然外部團隊都能做出不錯的配合,許多人自然期待 DeepSeek 親自下場,把自家模型與 Harness 的配合再推進一步,推出一款類似“官方調校”的程式碼 Agent。但 DeepSeek 交出的答卷,不是一輛調校完成的“官配車型”,而是把試驗檯本身開放了出來。

這種開放性帶來了明顯的兩極分化。從開發者角度看,DeepSeek Harness 的架構很有想象力:它允許 Agent 在執行中修改自己的能力邊界,而不是像大多數現有 Agent 那樣,能力範圍由產品經理和開發者預先劃好。它研究的不僅是“怎樣讓 DeepSeek 寫程式碼更好用”,更是“未來的 Agent 能否一邊工作,一邊重組自己”。此外,系統採用只追加的事件日誌,模型的提示詞、工具呼叫、許可權變化和子 Agent 排程都可被追蹤,這對於研究 Agent 如何行動、如何失控、又如何恢復,具有獨特價值。

然而,如果把它當作面向普通使用者的程式碼產品,現階段很難給出高分。安裝、配置和概念門檻都不低,許多基礎體驗還要靠社群外掛補齊。檔案引用、側邊欄、視覺能力、自動化這些在成熟產品中理應自然存在的功能,在這裡反而成了外掛生態最先填補的空白。一個簡單的例子:在許多 Agent 中已經習以為常的用 @ 標記檔案的功能,在 DeepSeek Harness 中仍需要額外安裝第三方外掛才能實現。開放性在此刻既是優點,也像一張尚未完工的清單。

普通使用者關心的往往是更實際的問題:模型會不會跑偏,檔案會不會改錯,任務能否一次做完,賬單是否可控。一個系統允許你更換所有零件,不等於它已經比一輛成熟的量產車更好開。因此,網上最早出現的許多“整活”並不奇怪——它們證明了這套架構的上限很高,卻沒有回答普通使用者最關心的那個問題:它現在能替我做什麼?

不過,就此斷言 DeepSeek Harness 沒有價值,或許也為時過早。就像編輯器領域的 VimVS Code,它們的意義從來不只是預設安裝後有多少功能,而在於允許開發者按照自己的工作方式持續改造工具。DeepSeek Harness 走得更遠:它不僅讓人寫外掛,還試圖讓 Agent 為自己寫外掛。這份價值眼下主要屬於開發者和研究者,而非普通消費者。

DeepSeek 給產品取名“Harness”而不是“Code”,其實已經說得很坦白:它釋出的不是一個替你寫程式碼的完整答案,而是一套用來尋找答案的基礎設施。市場期待的是 DeepSeek 版本的 Claude Code,而 DeepSeek 自己更感興趣的,似乎是下一代 Agent 架構可能長成什麼樣。這也很符合 DeepSeek 一貫給人的感覺——它並不是一家特別願意為 To C 體驗反覆打磨的公司,AGI、模型能力和技術探索排在前面,具體產品更像研究過程裡順手長出來的枝條。

評論認為,DeepSeek Harness 現階段更像一個“極客玩具”——這不是貶義,極客玩具常常會提前展示未來,只是未來並不會因為被展示出來就立刻變得好用。試驗檯當然可能孕育下一代汽車,但如果你今天只是想開車上班,大概沒必要先學會拆發動機。