Agentic Research

This article is not yet available in English. You are reading the Traditional Chinese original. The English edition will appear here once it is translated.

Browse articles that do have an English edition

你的第一個 AI 任務:怎麼下指令它才做得對

2026/09/307 min readBryan Chan閱讀中文原文
Topics入門PromptAI Agent

你裝好了工具,打開它,然後卡在第一個問題:要打什麼?

大多數人的第一個任務失敗,不是因為工具能力不夠,而是因為指令裡缺了三樣東西中的至少一樣。缺哪一樣,失敗的樣子就不一樣,而知道缺什麼比知道怎麼寫更重要。

三個要素

一個能成功的任務需要:

  1. 一個產出 —— 做完之後存在的那個東西。一個檔案?一段文字?一個清單?
  2. 一個輸入 —— 它要處理的原料在哪裡。具體路徑或具體內容。
  3. 一個去處 —— 產出要放在哪、以什麼形式給你。

三個都有,任務就能做。缺任何一個,它就得猜 —— 而它猜的方向通常跟你想的不一樣。

對比一下:

缺三個:幫我處理一下這个文件
缺兩個:幫我總結 report.pdf
缺一個:幫我總結 /Users/you/docs/report.pdf
完整  :讀 /Users/you/docs/report.pdf,用中文寫一份 300 字以內的摘要,
        分三段(結論、依據、風險),存成 /Users/you/docs/report-summary.md

第一句它只能問你「處理是什麼意思」。第二句它會總結,但你不知道它總結的是哪個檔案(如果目錄裡有兩個 report.pdf 它就猜了),也不知道要多長、要什麼格式。第四句它可以直接做完,而且你能驗證它做對了沒有。

三個真實例子

例一:把會議紀錄變成待辦

弱:幫我整理這个會議記錄
強:讀 notes-0930.txt,把里面所有「某人要做某事」的句子抽出來,
    做成一个 markdown 表格,三列:負責人、事項、期限(沒寫期限的填「未指定」)。
    存成 todos-0930.md。不要加你自己的建議。

「不要加你自己的建議」這句很重要。 不說的話,很多工具會在表格后面附一段「此外我注意到…」—— 那不是你要的,而且會讓你懷疑它有沒有認真讀原文。

例二:改一批檔案的名稱

弱:把這些文件重命名
強:把 downloads/ 里所有以 IMG_ 開頭的 .jpg 文件,
    重命名為 2026-09-旅行-001.jpg、2026-09-旅行-002.jpg…(按文件名順序編號)。
    先列出你打算怎么改,等我確認后再執行。

「先列出、等確認」是這一類任務必須的。 重命名是不可逆的(改回去要知道原名),而它可能理解錯你的編號規則。讓它先給計划,你花十秒看一眼,比事后恢復一百個文件名便宜得多。

這條規則適用于所有會改動或刪除東西的任務。

例三:從筆記草擬一封郵件

弱:寫封郵件
強:根據 meeting-notes.md 里的第三段(關于交付日期的部分),
    草擬一封給客戶的郵件,說明交付會延后兩周、原因是供應商物料延遲、
    新的日期是 10 月 28 日。語氣正式但不生硬,150 字以內。
    直接輸出郵件正文,不要解釋你做了什么。

「直接輸出正文,不要解釋」 省掉一大段「好的,我為您草擬了以下郵件:」。這類前后綴在你要復制粘貼出去的時候特别煩。

怎麼判斷該給它多少自由

兩個軸:

這個任務做錯的代價有多大?

  • 可以輕易重來(草擬文字、總結、分析)→ 給它自由,做錯了再說
  • 不好恢復(改檔名、刪檔案、發郵件、部署、花錢)→ 要求先給計劃、你確認後才執行

你自己知不知道要什麼?

  • 知道 → 說清楚產出格式,它照做
  • 不知道 → 先叫它給你三個選項,你選一個再讓它做

第二種情況很多人忽略。你不需要一開始就知道要什麼,但你需要在它動手之前知道。所以:

我想把這一堆截圖整理成一份報告,但我不確定該用什么結構。
先給我三種可能的組織方式,各用兩句話說明優缺點,不要動手做。

這一步幾乎不花時間,但能避免它按一個你沒同意的方向做完整份東西。

第一個任務應該選什麼

不要選你最想做的那個。 選一個滿足三個條件的:

  1. 做錯了沒有代價 —— 不改動、不刪除、不發送、不花錢
  2. 你自己能判斷對錯 —— 你看過原文,所以能看出它有沒有漏、有沒有編
  3. 小到能在五分鐘內驗證 —— 太長你會放棄檢查

例如「總結這份我自己寫過的文檔」就符合:你知道原文,所以能立刻發現它編了內容或漏了重點。

這一步的真正目的不是得到那份摘要,是校准你對它的信任。 你會發現它在哪類事情上可靠、在哪類事情上會編 —— 而這個認知只能靠自己驗證得到,看别人的評測沒用。

關于它會怎麼編,見 Hallucination(幻覺);關于為什麼「它自己說做完了」不算驗證,見 Agent 驗證架構。

它做錯了,怎麼辦

按這個順序,不要跳:

  1. 先判斷是哪一類錯。 是它沒讀懂你的指令(→ 你的指令缺了要素),還是它讀懂了但做不好(→ 換個方式或換個工具)?這兩者的解法完全不同。
  2. 如果是第一類,補上缺的要素,而不是重復同一句話。說「不對,重做」幾乎從來不改進結果,因為指令裡的信息量沒有增加。
  3. 把它的錯誤輸出貼回去,指出具體哪裡錯。 「你漏了第三段的日期」比「不完整」有效得多。
  4. 如果是第二類,縮小范圍。 一次做十件事失敗,就先做一件。

不要做的事:重復同一句話並加強語氣。「一定要」「必須」「這很重要」不會提高准確率,只會讓指令更長。有效的是增加具體信息,不是增加強調。

下一步