Agentic Research

Human-in-the-Loop(人在迴路)

又稱:人工確認 · 人工審核 · 人在迴路 · HITL

在流程裡刻意插入一個「停下來等人批准」的點:人看過、按了同意,Agent 才准繼續。

你會在什麼時候遇到它

當 Agent 開始做不可逆的事 —— 轉帳、發信、刪資料、上線部署 —— 你就需要它。兩個方向的失敗都存在:完全不放人,一次幻覺就可能造成收不回來的損失;到處都放人,自動化就死了,你變成全職按「同意」的工人。位置比數量重要。

打個比方

像銀行的雙重授權:小額轉帳櫃員自己處理,大額要主管覆簽。主管不會坐在每個櫃位後面 —— 那樣隊伍會排到門外;只有金額超過門檻,他才出場。

最小範例

該停的點(示意):
  · 不可逆動作前:rm -rf、DROP TABLE、git push --force
  · 花錢動作前:呼叫付費 API 超過預算門檻、下訂單
  · 對外發送前:郵件、訊息、發布文章
  · 權限升級前:從唯讀切到可寫、從沙箱切到主機

不該停的點:
  · 讀檔案、跑測試、grep —— 可逆且低成本的動作
  · 每個工具呼叫都問 → 用戶開始無腦按同意,確認失去意義

注意最後一行:審批疲勞是真實的失敗模式。當「同意」變成反射動作,這道防線就名存實亡 —— 所以人工確認點要少而準,放在錯誤代價最高的那一刀前面。

最常搞錯的地方

  • 把「有通知人」當成「有人工確認」。通知是事後知會,確認是事前攔截:動作做完了才發訊息,那不叫 human-in-the-loop,叫事故通報。
  • 以為加了人工確認就萬事大吉。如果人看到的是 Agent 自己寫的摘要,人只是在替 Agent 的敘述背書;高風險場景要給人看原始動作 —— 要執行什麼命令、發給誰、金額多少 —— 不是摘要。

相關詞條

下一步