Agentic Research

This article is not yet available in English. You are reading the Traditional Chinese original. The English edition will appear here once it is translated.

Browse articles that do have an English edition

AI 編程工具地圖:先認形態,再記名字

2026/09/3013 min readBryan Chan閱讀中文原文
TopicsAI ToolsCoding AgentIDECLILearning Path

Cursor、Trae、Claude Code、Codex、OpenClaw、Hermes Agent、DeepSeek Harness、WorkBuddy、豆包工作……名字多到記不住,而且每一家的官網都說自己「重新定義了開發」。這篇文章只做一件事:給你一張按形態劃分的地圖,讓你不用記名字也知道每個工具站在哪個位置、適合誰、代價是什麼。讀完你會知道自己的第一個工具該從哪一類挑。

名詞如果不熟,先回 詞彙層 把 AI Agent(代理)、Harness(執行環境/框架)、CLI(命令列介面) 三個詞讀完再回來;「AI Agent 到底是什麼」在 AI Agent 是什麼:從 ChatGPT 到會自己做事的 AI 裡有完整拆解。

工具血緣:先變的是形態編程類 AI 工具的四種形態,按時間排列:補全(在編輯器裡補下一行,人開車、它提示)、對話(一個聊天視窗,你貼程式碼進去把答案貼回來)、自主迴圈(它自己反覆做—看—再做,第一次真的「跑起來」)、常駐 Agent(住在終端機或一台機器上,能讀你的專案、能被排程、能接進通訊通道)。軸上的事件取自本站時間軸中已驗證的 harness 條目,每個都有來源。這張圖的用途是選工具:**同一形態的工具可以互相比,不同形態的不行,無論行銷詞多相似** —— 一個補全工具與一個常駐 Agent 都「會寫程式」,但差別在誰開車、以及什麼會出錯。所以先選形態、再在形態內比產品,本站的工具圖譜就是這樣組織的。先變的是形態,產品是跟著變的23 條已驗證的 harness 事件;畫出 8 條,每條都有來源補全FORM 1對話FORM 2自主迴圈FORM 3常駐 AgentFORM 42022-10-06
ReAct:推理與行動交織的循環
2022-10-17
LangChain 開源:Agent 成為函式庫抽象
2023-02-09
Toolformer:模型自學呼叫 API
2023-03-16
AutoGPT:第一波自主 Agent 熱潮
2024-11
Windsurf Editor:自稱第一個「agentic IDE」
2025-03-11
Responses API 與 Agents SDK:OpenAI 重做 Age
2025-06-13
Anthropic 公開多 Agent 研究系統的工程內幕
2026-08-13
DeepSeek Harness:一切皆插件的開源 Agent 運行時
FORM 1 · 補全在編輯器裡補下一行。人開車,它提示。1
1/5補全
第 1 步,共 5 步 補全
圖:從模型到三類工具的譜系。同一個 LLM 被不同的 harness 包成不同形態,控制權與可見度隨形態移動。

為什麼按形態分,而不是按廠商分

同一個模型,包進不同的程式裡,用起來是兩種完全不同的東西。包在編輯器裡,它邊打字邊幫你補全;包在終端機裡,它自己讀檔案、改程式、跑指令;包在常駐服務裡,它半夜替你盯著訊息和排程。

模型是馬,外面那層程式是韁繩和挽具——真正決定「你能帶它去哪、它跑偏時你看不看得出來」的,是外面那層,不是馬。這層程式有個正式名字,叫 Harness(執行環境/框架),這篇文章會用馬與挽具的比喻把它講透。

所以選工具的第一步不是比廠商,而是認形態。形態決定了三件事:

  1. 方向盤在誰手上——每一步你都要點頭,還是給個目標就放手。
  2. 你看見什麼——圖形介面的即時 diff,還是事後翻文字紀錄。
  3. 出錯時傷害多大——改錯一行程式碼,跟一個常駐服務帶著權限跑一整晚,不是一個量級的事。

按這三條線,市面上的工具分成三大類。

第一類:IDE 內建 —— AI 住進你的編輯器

代表:Cursor、Trae。

這一類的本體是一個程式碼編輯器,AI 是裝在編輯器裡面的能力。你打開專案、看著程式碼,AI 在旁邊做三件事:你打字時給你補全建議;你選一段程式碼叫它改;你開一個對話面板叫它跨檔案完成一個任務。

它給你什麼: 可見度最高的一類。每一次改動都以 diff(新舊對照)的形式畫在螢幕上,你逐塊接受或拒絕。方向盤基本在你手上——它建議,你點頭。對新手來說,這是犯錯成本最低的起點:最壞情況就是你看到一個不對的建議,按 Escape 拒絕。

它拿走你什麼: 你的注意力。IDE 形態的前提是「你坐在螢幕前」,它不適合那種交代完就走、幾小時後回來看結果的任務。自主性在這一類裡是逐步放開的:Cursor 的 Plan Mode 會先研究、先出計畫、等你批准才動手;Trae 甚至有一個獨立的 SOLO 模式,把整個任務交出去自動完成——但歸根究底,你還是那個在場的人。

具體長什麼樣: 你在 Cursor 裡按 Tab,它把你正想寫的半個函式補完,連下一處要改的位置都幫你跳過去;你按 Cmd+I(Windows 上是 Ctrl+I)打開 Agent 面板,說「把這個模組的報錯訊息改成中文」,它自己找出相關檔案、改好、把 diff 排在你面前等你審。

第二類:終端機 Agent —— AI 住進你的 shell

代表:Claude Code、Codex CLI、開源的 trae-agent。

這一類沒有編輯器視窗。你在 Terminal(終端機)(就是那個打字的黑框框)裡啟動它,用自然語言交代任務,然後它自己轉起來:讀檔案、改檔案、執行指令、看輸出、發現錯誤、再改——一個循環接一個循環,直到任務完成才停下來回報。

它給你什麼: 真正的長任務能力。「幫這個模組補上單元測試,讓測試全部通過」這種需要反覆試錯的工作,它自己跑完,你只在關鍵節點被打斷。它也最貼近開發者的真實工作環境:Git、測試、建置,全都在 shell 裡發生,它就住在裡面。

它拿走你什麼: 逐步的可見度。你不再看著每一次按鍵,而是事後審查它的紀錄和 diff——角色從「看著它寫」變成「審查它交了什麼」。這帶來兩個新的必修課:一是權限閘門,危險動作(刪檔案、跑未知指令)該不該先問你;二是 Sandbox(沙箱),把它的活動範圍圈起來。這兩個機制現在是這類工具的標配,但你要懂得怎麼設定。前提門檻也更高:看不懂得它要執行什麼指令,你的「同意」就沒有意義——所以這類工具建議先修 終端機與 CLI 生存指南。

具體長什麼樣: 你 cd 進專案、輸入 claude,說「把 README 裡的安裝步驟跟實際腳本核對一遍,不符的地方修掉」。螢幕上開始滾動它讀了哪些檔案、執行了什麼指令、改了哪幾行,中途它會停下來問你「要執行這個測試指令嗎?」,你按 y,它繼續。

第三類:編排平台與常駐運行時 —— 你組裝 Agent 本身

代表:OpenClaw、Hermes Agent、DeepSeek Harness;辦公向的 WorkBuddy 與 豆包工作。

前兩類的 AI 是「你開工時在、收工時停」的。第三類把它變成常駐的基礎設施:一個跑在你自己機器上的閘道(gateway)程序,接上你已經在用的通訊軟體——WhatsApp、Telegram、微信、飛書——你發訊息它就幹活,不發訊息它也能按排程自己幹活。Skills(可觸發的能力模塊)把重複流程固化下來,subagent 把大任務拆給多個分身並行。

這一類裡有三個不同的物種,初學者最容易混:

  • 個人助理框架(OpenClaw、Hermes Agent):重點是「無所不在」——同一個 Agent、同一份記憶,出現在你所有的聊天渠道裡。
  • Agent 運行時(DeepSeek Harness):重點是「地基」——把循環、會話、工具、沙箱這些零件包成現成的執行環境,你在上面蓋自己的 Agent。它同時提供終端機和 Web 兩種介面。
  • 辦公工作台(WorkBuddy、豆包工作):重點是「交付成果」——不寫程式的人用自然語言下任務,它拆解、並行、產出文件、簡報、表格。豆包工作甚至會操作一個虛擬桌面,像同事一樣在電腦環境裡幹活。

它給你什麼: 時間。它把你的分身留在機器裡持續運轉,這是前兩類做不到的。

它拿走你什麼: 最多的安全邊界。一個常駐、接訊息、帶著工具權限的服務,等於在你電腦上開了一扇門:陌生人發來的訊息是不受信輸入,社群寫的 skill 沒人幫你審計過,沙箱不配就等於工具直接跑在你的主機上。這一類工具的能力上限最高,翻車上限也最高——本站的 十天十六坑失敗記錄 寫的全是這類教訓。

三類放一起比

形態AI 住在哪方向盤你看見什麼適合的任務
IDE 內建(Cursor、Trae)你的編輯器基本在你手上即時 diff、逐塊審邊寫邊改、跨檔案重構
終端機 Agent(Claude Code、Codex)你的 shell給目標+關鍵點批准執行紀錄、事後審 diff補測試、修 bug、整庫遷移
編排平台(OpenClaw、Hermes、dsh、WorkBuddy、豆包工作)常駐閘道/虛擬桌面事前設定邊界,事中基本放手日誌、記憶、產出物排程自動化、多渠道助理、辦公交付

實務上,人們是混著用的

真實的工作流很少只用一類:

  • 日常寫程式用 IDE 內建,遇到「補完整個模組的測試」「跨十幾個檔案改介面」這種大活,切到終端機 Agent 讓它自己跑;
  • 跑通了之後,把重複的流程固化成常駐平台的 skill,讓它每週自動做;
  • 完全不寫程式的同事,直接從辦公工作台那一格進入這張地圖,前面兩類可以整個跳過。

還有一件事值得先知道:模型這層是可以換的。Cursor 裡可以選不同廠商的模型;OpenClaw 把模型和 agent harness 都做成可拔插的插件。所以「選工具」很大程度上是在選 harness 的工程品質與安全設計,而不是在賭哪家模型最強——這篇文章會講這個「外層程式」是怎麼一代代演化過來的。

新手的第一個工具怎麼挑

本站建議的學習順序,也是這張地圖的閱讀順序:

  1. 寫程式的人,從 Cursor 開始——犯錯成本最低,先建立「AI 改程式碼、我審 diff」的直覺;然後看 Trae 理解同形態的另一種選擇(含免費額度與 SOLO 模式);再進 Claude Code,第一次把方向盤部分交出去。
  2. 走穩之後再看 Codex(終端機+雲端兩條腿)、harness 概念與 DeepSeek Harness(開源運行時)、OpenClaw 與 Hermes Agent(常駐多渠道)。
  3. 不寫程式的人,直接讀 WorkBuddy 與 豆包工作,配上 AI Agent 是什麼:從 ChatGPT 到會自己做事的 AI 打底就夠了。

下一步