Agentic 工作流

AI Agent 術語一次搞懂:Agent、Tool、Harness、Loop、Guardrail、Orchestrator、Eval 白話定義

Agent、Tool、Harness、Loop、Guardrail、Orchestrator、Eval——這七個詞天天被混用,對規格時尤其致命:三方點頭,做出來的東西卻差十萬八千里。我們把最常被搞混的 AI Agent 術語一次攤開,用白話給出可直接引用的定義與判斷方法,附一張速查表,幫你在會議室裡真正對到同一件事。

작성자

Tenten AI 研究團隊

應用 AI

게시일

2026년 3월 13일

읽는 시간

6 分鐘

AI AgentAgentic 工作流術語詞彙表企業 AI 導入FDE 前線部署LLM 系統設計

開會時最尷尬的一刻,不是有人聽不懂,是每個人都以為自己聽懂了,但講的其實是不同的東西。上週我們跟一家金融客戶對規格,對方的 IT 主管說「我們想要一個 Agent」,產品端說「我們需要 Orchestrator」,而合作的軟體商口中的「Loop」其實是我們理解的「Harness」。三方點頭如搗蒜,散會後對出來的東西差了十萬八千里。

所以這篇我們把最常被混用的 7 個 AI Agent 術語攤開來,用白話一次講清楚。先給一句可以直接引用的定義:所謂 AI Agent,是一個能自己「判斷下一步、呼叫工具、看結果、再決定下一步」的大型語言模型系統,而不是被動等你下每一道指令的聊天機器人。其餘六個詞,都是在描述這個系統的不同零件與骨架。

AI Agent 術語速查表

術語白話定義一句話怎麼判斷
Agent會自己決定下一步、並實際去做的 AI。核心是「自主性」它會不會在你沒逐步指揮下,自己選擇動作?
ToolAgent 能呼叫的外部能力:查資料庫、寄信、開工單、算數拿掉它,Agent 就只能「用嘴講」而不能「動手做」
Harness包住模型的那層程式骨架,負責接工具、管記憶、串流程模型是引擎,Harness 是整台車的底盤
Loop「想 → 做 → 看結果 → 再想」反覆跑的循環,是 Agent 的心跳它做完一步會不會根據結果自己再走下一步?
Guardrail護欄:限制 Agent 不能做什麼、超線要攔下來它能不能真的刪掉正式資料庫?若不能,是誰擋的?
Orchestrator調度者:安排多個 Agent 或多個步驟誰先誰後、如何協作有沒有一個「總指揮」在分派任務給不同角色?
Eval評測:用一套題庫量化 Agent 到底做得對不對你怎麼證明改版後「有變好」而不是「感覺變好」?

拆開來,它們怎麼咬合

Agent 與 Tool 是最該分清的一對。很多人把「會聊天的 LLM」直接叫 Agent,其實少了關鍵一環:動手的能力。一個 Agent 之所以有用,是因為它能呼叫 Tool——查你的 CRM、開一張工單、真的把那封信寄出去。沒有 Tool,再聰明的模型也只是嘴上功夫。

Harness 是最少被外行提、卻最決定成敗的東西。它是包在模型外面的程式骨架:負責把 Tool 接上去、管住對話記憶、決定什麼時候該停、出錯時怎麼重試。模型像引擎,Harness 是整台車的底盤與變速箱。我們踩過的雷幾乎都不在模型本身,而在 Harness——記憶塞爆、工具回傳格式沒對齊、逾時沒處理,系統就當場翻車。

Loop 是 Agent 的心跳。它不是一問一答,而是「想一下 → 呼叫工具 → 看回傳結果 → 再想下一步」不斷循環,直到任務完成或撞到停止條件。Loop 設得太鬆,Agent 會鬼打牆繞不出來、把 token 燒光;設得太緊,它一遇到小卡關就放棄。這個節奏,是要現場調的。

Guardrail 是護欄。它規定 Agent 不准碰哪些資料、哪些動作要人來按確認、輸出踩到紅線就攔截。舉個具體的:一個能自動處理退款的 Agent,Guardrail 就是那條「單筆超過五千元一律轉人工」的線。沒有護欄的自主性,在正式環境不是能力,是責任事故。

Orchestrator 是當你不只一個 Agent 時才登場的調度者。客服 Agent、查帳 Agent、審核 Agent 各司其職,Orchestrator 決定誰先接手、誰的結果交給誰、卡住了怎麼轉。單一 Agent 的系統其實用不太到它——別為了聽起來厲害硬加一層。

Eval 是最容易被跳過、也最不該跳過的一個。它是一套題庫加一套評分,讓你能回答一個殘酷的問題:改版之後到底是真的變好,還是你「感覺」變好?沒有 Eval,你每次調 prompt 都在賭博。有了 Eval,你能拿數字說話。

為什麼分清楚這幾個字很重要

因為預算和責任是照這些邊界切的。當客戶說「Agent 不準」,問題可能出在 Tool 接錯、Loop 沒收斂、Guardrail 攔過頭,或根本沒有 Eval 所以沒人知道哪裡不準。把症狀對到正確的零件,才修得動。

這也是我們在客戶現場最花力氣的地方——不是把 Demo 跑漂亮,而是幫他們把 Harness、Loop、Guardrail、Eval 這些骨架搭紮實,讓 Agent 上線之後真的有人敢用、也用得下去。Demo 很美不算數,上線且有人在用,才算數。

AI 워크플로를,
당신의 업무 안으로

FDE·FDM으로 팀에 상주하며 현업이 매일 운영하는 AI 에이전트와 워크플로를 구축합니다. 분기가 아닌 몇 주 만에 가동.