Human-in-the-Loop(人在迴路)
又稱:人工確認 · 人工審核 · 人在迴路 · HITL
在流程裡刻意插入一個「停下來等人批准」的點:人看過、按了同意,Agent 才准繼續。
你會在什麼時候遇到它
當 Agent 開始做不可逆的事 —— 轉帳、發信、刪資料、上線部署 —— 你就需要它。兩個方向的失敗都存在:完全不放人,一次幻覺就可能造成收不回來的損失;到處都放人,自動化就死了,你變成全職按「同意」的工人。位置比數量重要。
打個比方
像銀行的雙重授權:小額轉帳櫃員自己處理,大額要主管覆簽。主管不會坐在每個櫃位後面 —— 那樣隊伍會排到門外;只有金額超過門檻,他才出場。
最小範例
該停的點(示意):
· 不可逆動作前:rm -rf、DROP TABLE、git push --force
· 花錢動作前:呼叫付費 API 超過預算門檻、下訂單
· 對外發送前:郵件、訊息、發布文章
· 權限升級前:從唯讀切到可寫、從沙箱切到主機
不該停的點:
· 讀檔案、跑測試、grep —— 可逆且低成本的動作
· 每個工具呼叫都問 → 用戶開始無腦按同意,確認失去意義注意最後一行:審批疲勞是真實的失敗模式。當「同意」變成反射動作,這道防線就名存實亡 —— 所以人工確認點要少而準,放在錯誤代價最高的那一刀前面。
最常搞錯的地方
- 把「有通知人」當成「有人工確認」。通知是事後知會,確認是事前攔截:動作做完了才發訊息,那不叫 human-in-the-loop,叫事故通報。
- 以為加了人工確認就萬事大吉。如果人看到的是 Agent 自己寫的摘要,人只是在替 Agent 的敘述背書;高風險場景要給人看原始動作 —— 要執行什麼命令、發給誰、金額多少 —— 不是摘要。
相關詞條
下一步
- AI 合規與風險邊界:企業導入的法務檢查表18 min
- 從偽造到驗證:Agent 驗證架構的信任建築學6 min