AI 回答正確嗎?用五種檢查法判斷能不能用
AI 回答看起來順,不代表能交付。分辨事實、計算、來源、判斷與建議,用對應檢查找出可支持與待確認的內容。
AI 回答不能只看它寫得順不順,或有沒有附上一個網址。你要先分辨它說的是事實、計算、來源、判斷還是行動建議,再用對應的方法檢查;查不到時,保留「待確認」比硬用答案更可靠。

「AI 會不會幻覺」比較像概念題。工作裡真正卡住的是:這段內容現在能不能用?我的判斷是,不能拿同一把尺去驗收日期、計算、引言和建議;那只會讓你以為自己檢查過了。
五種主張,五種檢查方式
| 主張類型 | 例子 | 最小檢查 | | --- | --- | --- | | 事實 | 活動日期、職稱、產品規格 | 回到原始公告或一手資料。 | | 計算 | 總額、成長率、排序 | 取得輸入,重算公式與分母。 | | 引言/來源 | 「某報告指出」 | 開原文,核對作者、日期、句子與脈絡。 | | 判斷 | 「A 比 B 合適」 | 檢查準則、遺漏條件與 trade-off。 | | 行動建議 | 「因此應該立刻做」 | 確認誰有權決定、後果能否回復、是否需專業審核。 |
這是我為工作情境整理的分類,不是模型官方保證。它想解決的是:別再停在「感覺像對」,而是把下一個檢查動作說出來。
練習:把找不到的內容留下來
材料只有這段虛構公告:
9 月 12 日舉辦線上產品說明會,報名截止為 9 月 8 日。
公告沒有載明講者、費用或是否提供錄影。
假設 AI 寫成:
產品說明會將在 9 月 12 日線上舉行,由產品主管主講,免費參加,
會後提供錄影;請在 9 月 8 日前報名。
日期、形式和截止日可以對回公告;講者、費用與錄影則不能。正確處理不是猜它們也許是真的,而是刪除、改成「未載明」,或交回給有資料的人確認。
有網址不是驗證,第二個 AI 也不是驗證
當 AI 附上引用,至少確認四件事:來源是否存在、作者與日期是否吻合、原文是否真的支持這句話、它有沒有把相關資訊寫成因果結論。網址能幫你開始檢查,不能替你完成檢查。
讓另一個 AI 再回答一次,頂多是多一份初稿。它可以幫你發現問題,但不會因此變成獨立驗證。
留下判斷過程,才不會下次又從「我記得查過」開始
輸出中的主張:
主張類型:事實/計算/引言來源/判斷/行動建議
原始來源或輸入:
我的檢查方式:
檢查結果:可支持/不支持/待確認
負責確認的人:
仍保留的不確定性:
如果一個答案會影響客戶、預算、合約、人員、健康、法律或安全,這張卡不會替你做決策。它只把責任交回應該確認的人,讓你不要因為一段流暢文字就跳過這一步。
驗證前後,還有兩個不能跳過的能力
在你檢查結果之前,也要先確認資料有沒有權利提供給 AI。若輸入和要求本來就不清楚,先回到任務界定;若是用 AI 整理會議文字,則把每一列對回原文。下一步的問題更早一步:你手上的工作材料,究竟能不能走進這個帳號與服務?
- 先把工作說清楚|先補齊目標、材料、限制與完成標準
- 用 AI 整理會議紀錄|把會議整理結果逐列對回原文
- 判斷資料與授權|在提供材料前判斷資料與授權路徑
相關官方文件
工具文件能幫你確認自己正在使用的服務如何接受指示與脈絡,但不能證明某個輸出為真。以下三份文件是產品層的延伸閱讀;這篇的五種主張與檢查法仍是獨立的教學架構: