LLM 工程 · Agentic System · Harness Engineering

Articles

Harness Engineering 當 Agent Harness 沒有核心:DeepSeek 的 Everything is a Plugin DeepSeek Harness 把 agent loop、tool registry 全做成可替換的 plugin,35 行設定檔就組出 headless 版。拆解 patch 層疊加與 Capability Seam,對比 Claude Code 固定核心路線,回答一人團隊自建 agent 該借鑒哪邊。
17 分 2026-08-23
Harness Engineering 模型可見 ⟺ 已記錄:DeepSeek Harness 的 Runtime Invariant Debug agent 時答不出「模型當時看到什麼」?DeepSeek Harness 用一條 runtime 斷言強制 context 可從 session log 重建,壓縮、外溢、fork 共用同一套事件機制。企業 domain agent 要的可回溯、可控、穩定,這個設計各換到什麼。
17 分 2026-08-23
Harness Engineering 一半的 code 是 AI 寫的之後,品質靠什麼守:DeepSeek Harness 的工程門檻 AI 寫的 code 過半之後,重複決策、假綠燈測試、死碼堆積、文件腐爛會接踵而來。這篇從 DeepSeek Harness 的機器可驗證門檻整理三個視角:Agent Notes 決策記錄、驗證世界而非自我報告、coverage 當刪碼信號,並附上一人團隊成本最低的三個起步版本。
16 分 2026-08-23
Harness Engineering AI Agent 工具越多越選錯?從 N-class 分類看 Tool System 設計 工具數量是 AI agent 系統最容易被忽略的設計變數。研究顯示工具從 10 個增加到 100 個,top-1 準確率明顯下降。本文解析三個獨立崩潰機制,對照 DeerFlow、HermesAgent、OpenClaw 如何在架構層控制工具可見範圍,以及語意邊界設計與 tool selection eval 的延伸思考。
14 分 2026-05-18