AI 與工具

AI Agent 很強,但是你知道哪些事不該丟給它做嗎?

最近看到不少 AI Agent Demo。丟一句指令,它就自己查資料、開啟工具,把任務一路跑完。看完後很多人會開始想:那客服、報表、排程、資料整理,是不是都可以交出去?

白色機械手臂特寫
照片:Franck V./Unsplash

最近看到不少 AI Agent Demo。丟一句指令,它就自己查資料、開啟工具,把任務一路跑完。看完後很多人會開始想:那客服、報表、排程、資料整理,是不是都可以交出去?

圖卡 1/7:AI Agent 很強,但哪些事情不適合交給它?六個標準看完再判斷

但以我自己踩過的坑來看,放進公司日常後,真正麻煩的通常例外狀況的處理。例如資料少一欄時要不要繼續?要怎樣才不會跑一跑自己卡住?資料異動錯誤時,能不能 Rollback?

能成功執行一次,跟每天都能穩定地執行,是兩個不同的問題。

圖卡 2/7:能成功跑一次,不代表適合每天自動跑

所以我整理了一個工作版框架,把流程分流六種標準,可以幫助大家在判斷要維持人工,還是嘗試建立流程,或直接讓 AI Agent 進入工作中。

每題可以打 0–2 分:0 分代表目前還沒有條件,1 分代表部分具備、需要人工補位,2 分代表規則已經清楚而且可以管理。

Gate 1:這段流程值得讓 Agent 進場嗎?

第一題,這件事是否固定、重複發生?

Agent 需要建置、串接、測試,重點是也需要持續維護。若一件事一年只發生一兩次,每次的背景與做法又差很多,最後可能省下十分鐘操作,卻多出幾個小時維護,不如一開始就維持人工就好。

比較值得優先評估的,通常是每週或每天都會出現,而且主要步驟相對固定的工作。例如固定整理表單、彙整報表、把新案件分派到對應隊列。發生頻率夠高,省下來的時間才有機會大於導入成本。

第二題,輸入資料是否已經數位化,而且 Agent 有合法、穩定的存取權限?

資料放在表單、CRM 或固定格式的信件裡,Agent 才知道要去哪裡拿。如果關鍵資訊散在口頭交代、私人對話、紙本和不同人的腦袋裡,它每次開始前都得先找人補資料,或甚至無法自動化。

這時候先整理資料入口,通常比先做 Agent 更有用。第一關沒過,代表流程目前缺少足夠的重複性或可用輸入,急著自動化只會每自己帶來額外的麻煩。

圖卡 3/7:這段工作夠穩定嗎?第 1、2 題評分標準

Gate 2:Agent 知道什麼叫做完嗎?

第三題,完成條件能不能被明確定義

「幫我處理好」對人來說已經很模糊,交給 Agent 只會更難驗收。你要說得出最後應該留下什麼結果,系統才能判斷任務完成,或知道何時應該停下來。

例如,把客服訊息整理成 Ticket,可以檢查 Ticket 是否已建立、分類是否填寫、摘要是否包含問題與期望結果。這些欄位、狀態的驗收,才是 Agent 可以執行的完成條件。

第四題,常見例外能不能被列出,並且有對應動作?

日常營運很少只有一條成功路徑。客戶資料缺漏時,是退回補件還是繼續建立?碰到金額爭議、敏感措辭或高價值客戶時,需不需要提醒人工介入?

例外規則若只存在資深同事腦中,Agent 遇到狀況時可能不會如預期執行。比較穩定的做法,是先列出最常見的例外,為每一種狀況定義「繼續、補資料、改派、停下問人」其中一個動作。

第二關沒過,Agent 可能完成了很多步驟,團隊卻無法確定結果能不能用。這類流程適合先讓 AI 產生草稿或建議,由人判斷是否完成。

圖卡 4/7:成功與例外能被說清楚嗎?第 3、4 題評分標準

Gate 3:做錯時,團隊接得回來嗎?

第五題,Agent 的動作能否復原,或在執行前加入審核?

整理草稿、補標籤、建立待確認 Ticket,做錯後通常容易修改。但直接寄信給客戶、調整價格、更新資料,錯誤代價明顯更高,有些動作甚至無法完整復原。

權限應該跟錯誤代價一起調整。低風險動作可以自動執行;中風險動作先產生 preview;高風險動作則保留人工審核,人工確認後才真的送出,且最好是每一個操作都有記錄,有個萬一時,還有機會恢復資料。

第六題,出錯或卡住時,有沒有明確的人工 owner?

「丟回人工」還不夠。Agent 停下來時,應該知道要交給哪個角色,並附上原始輸入、已執行的步驟、停止原因與需要人決定的問題。人處理完之後,也要知道流程從哪一步繼續。

沒有 owner 的自動化,當 Agent 卡住時,容易安靜地堆在系統裡,直到客戶追問或報表出錯才被發現。第三關沒過,Agent 最多先當輔助,由人工進行決策。

圖卡 5/7:做錯時人接得住嗎?第 5、6 題評分標準

六題打完,怎麼決定?

這六題各打 0–2 分:

  • 0–4 分:先整理流程,或只讓 AI 協助一個步驟。
  • 5–8 分:適合從 copilot/workflow 開始,保留人工確認。
  • 9–12 分:可以整合 Agent ,先給有限資料與有限權限。

圖卡 6/7:依總分 0–4、5–8、9–12 決定先做到哪一層

分數只是方便判斷。只要碰到以下任一狀況,不論總分多高,都建議先停在人工確認:

  • 敏感資料的使用範圍與權限還沒被定義。
  • Agent 可以執行不可逆的對外或金流動作,卻沒有人工檢查。
  • 出錯後需要有負責人,且需要有停止方式或 Rollback 機制。

圖卡 7/7:命中任一項,先停在人工確認

拿一條每週都會重複的流程實際跑完六題,通常就能看出真正的卡點:AI 能力還不夠、流程本身還沒整理好,或權限與責任還沒有定義。

喜歡這篇文章嗎?

訂閱電子報,有新文章時會寄到你的信箱。