Agentic Research
首頁/學習/AI 編程工具地圖:先認形態,再記名字

AI 編程工具地圖:先認形態,再記名字

2026/09/3013 分鐘Bryan Chan最後更新 2026/09/30
這篇屬於學習主題AI ToolsCoding AgentIDECLI

Cursor、Trae、Claude Code、Codex、OpenClaw、Hermes Agent、DeepSeek Harness、WorkBuddy、豆包工作……名字多到記不住,而且每一家的官網都說自己「重新定義了開發」。這篇文章只做一件事:給你一張按形態劃分的地圖,讓你不用記名字也知道每個工具站在哪個位置、適合誰、代價是什麼。讀完你會知道自己的第一個工具該從哪一類挑。

名詞如果不熟,先回 詞彙層 把 AI Agent(代理)、Harness(執行環境/框架)、CLI(命令列介面) 三個詞讀完再回來;「AI Agent 到底是什麼」在 AI Agent 是什麼:從 ChatGPT 到會自己做事的 AI 裡有完整拆解。

為什麼按形態分,而不是按廠商分

同一個模型,包進不同的程式裡,用起來是兩種完全不同的東西。包在編輯器裡,它邊打字邊幫你補全;包在終端機裡,它自己讀檔案、改程式、跑指令;包在常駐服務裡,它半夜替你盯著訊息和排程。

模型是馬,外面那層程式是韁繩和挽具——真正決定「你能帶它去哪、它跑偏時你看不看得出來」的,是外面那層,不是馬。這層程式有個正式名字,叫 Harness(執行環境/框架),這篇文章會用馬與挽具的比喻把它講透。

所以選工具的第一步不是比廠商,而是認形態。形態決定了三件事:

  1. 方向盤在誰手上——每一步你都要點頭,還是給個目標就放手。
  2. 你看見什麼——圖形介面的即時 diff,還是事後翻文字紀錄。
  3. 出錯時傷害多大——改錯一行程式碼,跟一個常駐服務帶著權限跑一整晚,不是一個量級的事。

按這三條線,市面上的工具分成三大類。

第一類:IDE 內建 —— AI 住進你的編輯器

代表:Cursor、Trae。

這一類的本體是一個程式碼編輯器,AI 是裝在編輯器裡面的能力。你打開專案、看著程式碼,AI 在旁邊做三件事:你打字時給你補全建議;你選一段程式碼叫它改;你開一個對話面板叫它跨檔案完成一個任務。

它給你什麼: 可見度最高的一類。每一次改動都以 diff(新舊對照)的形式畫在螢幕上,你逐塊接受或拒絕。方向盤基本在你手上——它建議,你點頭。對新手來說,這是犯錯成本最低的起點:最壞情況就是你看到一個不對的建議,按 Escape 拒絕。

它拿走你什麼: 你的注意力。IDE 形態的前提是「你坐在螢幕前」,它不適合那種交代完就走、幾小時後回來看結果的任務。自主性在這一類裡是逐步放開的:Cursor 的 Plan Mode 會先研究、先出計畫、等你批准才動手;Trae 甚至有一個獨立的 SOLO 模式,把整個任務交出去自動完成——但歸根究底,你還是那個在場的人。

具體長什麼樣: 你在 Cursor 裡按 Tab,它把你正想寫的半個函式補完,連下一處要改的位置都幫你跳過去;你按 Cmd+I(Windows 上是 Ctrl+I)打開 Agent 面板,說「把這個模組的報錯訊息改成中文」,它自己找出相關檔案、改好、把 diff 排在你面前等你審。

第二類:終端機 Agent —— AI 住進你的 shell

代表:Claude Code、Codex CLI、開源的 trae-agent。

這一類沒有編輯器視窗。你在 Terminal(終端機)(就是那個打字的黑框框)裡啟動它,用自然語言交代任務,然後它自己轉起來:讀檔案、改檔案、執行指令、看輸出、發現錯誤、再改——一個循環接一個循環,直到任務完成才停下來回報。

它給你什麼: 真正的長任務能力。「幫這個模組補上單元測試,讓測試全部通過」這種需要反覆試錯的工作,它自己跑完,你只在關鍵節點被打斷。它也最貼近開發者的真實工作環境:Git、測試、建置,全都在 shell 裡發生,它就住在裡面。

它拿走你什麼: 逐步的可見度。你不再看著每一次按鍵,而是事後審查它的紀錄和 diff——角色從「看著它寫」變成「審查它交了什麼」。這帶來兩個新的必修課:一是權限閘門,危險動作(刪檔案、跑未知指令)該不該先問你;二是 Sandbox(沙箱),把它的活動範圍圈起來。這兩個機制現在是這類工具的標配,但你要懂得怎麼設定。前提門檻也更高:看不懂得它要執行什麼指令,你的「同意」就沒有意義——所以這類工具建議先修 終端機與 CLI 生存指南。

具體長什麼樣: 你 cd 進專案、輸入 claude,說「把 README 裡的安裝步驟跟實際腳本核對一遍,不符的地方修掉」。螢幕上開始滾動它讀了哪些檔案、執行了什麼指令、改了哪幾行,中途它會停下來問你「要執行這個測試指令嗎?」,你按 y,它繼續。

第三類:編排平台與常駐運行時 —— 你組裝 Agent 本身

代表:OpenClaw、Hermes Agent、DeepSeek Harness;辦公向的 WorkBuddy 與 豆包工作。

前兩類的 AI 是「你開工時在、收工時停」的。第三類把它變成常駐的基礎設施:一個跑在你自己機器上的閘道(gateway)程序,接上你已經在用的通訊軟體——WhatsApp、Telegram、微信、飛書——你發訊息它就幹活,不發訊息它也能按排程自己幹活。Skills(可觸發的能力模塊)把重複流程固化下來,subagent 把大任務拆給多個分身並行。

這一類裡有三個不同的物種,初學者最容易混:

  • 個人助理框架(OpenClaw、Hermes Agent):重點是「無所不在」——同一個 Agent、同一份記憶,出現在你所有的聊天渠道裡。
  • Agent 運行時(DeepSeek Harness):重點是「地基」——把循環、會話、工具、沙箱這些零件包成現成的執行環境,你在上面蓋自己的 Agent。它同時提供終端機和 Web 兩種介面。
  • 辦公工作台(WorkBuddy、豆包工作):重點是「交付成果」——不寫程式的人用自然語言下任務,它拆解、並行、產出文件、簡報、表格。豆包工作甚至會操作一個虛擬桌面,像同事一樣在電腦環境裡幹活。

它給你什麼: 時間。它把你的分身留在機器裡持續運轉,這是前兩類做不到的。

它拿走你什麼: 最多的安全邊界。一個常駐、接訊息、帶著工具權限的服務,等於在你電腦上開了一扇門:陌生人發來的訊息是不受信輸入,社群寫的 skill 沒人幫你審計過,沙箱不配就等於工具直接跑在你的主機上。這一類工具的能力上限最高,翻車上限也最高——本站的 十天十六坑失敗記錄 寫的全是這類教訓。

三類放一起比

形態AI 住在哪方向盤你看見什麼適合的任務
IDE 內建(Cursor、Trae)你的編輯器基本在你手上即時 diff、逐塊審邊寫邊改、跨檔案重構
終端機 Agent(Claude Code、Codex)你的 shell給目標+關鍵點批准執行紀錄、事後審 diff補測試、修 bug、整庫遷移
編排平台(OpenClaw、Hermes、dsh、WorkBuddy、豆包工作)常駐閘道/虛擬桌面事前設定邊界,事中基本放手日誌、記憶、產出物排程自動化、多渠道助理、辦公交付

實務上,人們是混著用的

真實的工作流很少只用一類:

  • 日常寫程式用 IDE 內建,遇到「補完整個模組的測試」「跨十幾個檔案改介面」這種大活,切到終端機 Agent 讓它自己跑;
  • 跑通了之後,把重複的流程固化成常駐平台的 skill,讓它每週自動做;
  • 完全不寫程式的同事,直接從辦公工作台那一格進入這張地圖,前面兩類可以整個跳過。

還有一件事值得先知道:模型這層是可以換的。Cursor 裡可以選不同廠商的模型;OpenClaw 把模型和 agent harness 都做成可拔插的插件。所以「選工具」很大程度上是在選 harness 的工程品質與安全設計,而不是在賭哪家模型最強——這篇文章會講這個「外層程式」是怎麼一代代演化過來的。

新手的第一個工具怎麼挑

本站建議的學習順序,也是這張地圖的閱讀順序:

  1. 寫程式的人,從 Cursor 開始——犯錯成本最低,先建立「AI 改程式碼、我審 diff」的直覺;然後看 Trae 理解同形態的另一種選擇(含免費額度與 SOLO 模式);再進 Claude Code,第一次把方向盤部分交出去。
  2. 走穩之後再看 Codex(終端機+雲端兩條腿)、harness 概念與 DeepSeek Harness(開源運行時)、OpenClaw 與 Hermes Agent(常駐多渠道)。
  3. 不寫程式的人,直接讀 WorkBuddy 與 豆包工作,配上 AI Agent 是什麼:從 ChatGPT 到會自己做事的 AI 打底就夠了。

下一步