AI Agent 是什麼?Chat、Work 與 Agent 有何差別?

用任務步驟、工具使用、外部動作與人工控制判斷該用 Chat、Work 還是 Agent,不把自主程度誤當能力高低。

AI Agent 不只是回答問題,而是能朝一個目標持續讀取狀態、規劃多個步驟、使用工具採取行動,再依結果調整。能力越接近外部行動,人就越需要設定權限、批准點、停止條件與審閱。

請 AI 解釋一份文件,和請它自己找資料、建立檔案、更新系統並通知別人,風險完全不同。兩者都可能使用對話介面,但後者已經把更多步驟與動作交出去。

Chat 主要幫你思考與回答

Chat 適合問答、腦力激盪、解釋與小段修改。通常是你問一次、AI 回一次,由你決定下一步。

例如:「把這段公開文字整理成三個重點。」只要結果留在對話裡,影響有限,也容易人工檢查。

Work 承接較長的多步交付物

OpenAI 目前將 Chat 定位為快速問答與日常協助,Work 則是為較長、多步工作與完成交付物設計的 agent;使用者可以查看進度、回答問題、改變方向與批准重要動作。OpenAI:ChatGPT Work and Codex

Work 可能讀多份資料、做研究並建立文件。重點不是名稱,而是它能在一段較長過程中持續推進。

先把邊界說清楚:Chat 與 Work 的定位及 rollout 狀態來自 OpenAI 當前官方說明;下面用多步規劃、工具、外部影響與結果調整來辨識 Agent,以及依影響範圍分級,是我為課程整理的判斷方式,不是 OpenAI 官方四分法。

Agent 的核心是「可連續行動」

判斷是否進入 Agent 工作,可以看四件事:

  1. AI 是否能自行把目標拆成多步?
  2. 是否能選擇或呼叫工具?
  3. 是否能改變檔案、系統或外部世界?
  4. 是否會依工具結果調整下一步?

符合越多,越需要把控制寫在任務開始前,而不是出事後才補一句「小心一點」。

不要用工具名稱代替風險判斷

同一個 Agent,唯讀整理公開資料和登入帳號修改設定,風險差很多。同一個 Chat,如果連上可寫入 app,也可能造成外部影響。

我的建議是用影響範圍分類:

練習:畫出一件工作的 Agent 使用界線

工作目標:
AI 只回答的部分:
AI 可自行規劃的步驟:
可使用的資料與工具:
只讀動作:
會改變外部狀態的動作:
必須由人批准:
任何情況都不授權:
誰審閱最後成果:

完成標準不是把更多事情交給 Agent,而是你能說出它從哪裡開始、最多能做到哪裡,以及哪一步一定回到人手上。

下一步會在一份可還原副本中做第一次 Agent 實驗,只讓它走完 read → plan → act → review,不登入外部服務,也不碰真實資料。

參考資料