跳到資源內容
回到全部資源
閱讀+複製可直接閱讀保留 Markdown 下載

AI 交付驗收卡

AI 說「完成了」時,用三樣證據分辨真假完成;附五種常見假完成的識別方式、一句話可貼進自訂指令的驗收規則,和什麼時候可以放鬆的判斷法。

下載 .md

可以直接往下閱讀;遇到指令或提示詞,右上角可以單獨複製。

來源:be-ai-curator.com|配套長文〈AI 說「完成了」,但它真的做完了嗎?〉 適用:ChatGPT、Claude、Claude Code、任何會回報「完成了」的 AI 工具

為什麼需要這張卡

AI 回報「完成了」的時候,通常不是在說謊——它是真心覺得「應該沒問題」:計畫寫得很完整、步驟看起來都對,於是把「打算做的」當成「已經做的」。

麻煩的是:模型越聰明,這個「應該」講得越有條理,你越不會想去點開檢查。

我自己的紀錄裡,這種「說做完了、其實沒驗證」的情況截至 2026 年七月下旬累積 167 次;就算換上最新一代模型,七月下旬那一週還是有 10 次。

STEP 01真正的完成,會附三樣東西

  • 做了哪些動作 —— 動了哪個檔案、跑了什麼指令、查了哪個網頁
  • 結果原封不動貼出來 —— 不是「執行成功」,是實際跑出來的東西
  • 我可以怎麼自己再確認一次 —— 一個你能點、能跑、能看的方法

三樣缺一,先當作還沒做完。

STEP 02五種最常見的假完成

它說的實際上怎麼抽查
「檔案都改好了」一個字都沒動打開檔案、看修改時間
「測試全部通過」測試根本沒跑起來要它貼出執行結果原文
「查證完畢,附上來源」連結是 404 或內容對不上自己點一次連結
「都幫你設定好了」設定放錯位置、從未生效製造一次觸發、看有沒有反應
「已經全部更新」只更新了它記得的那部分要它列出清單、逐項對

STEP 03一句話規則(直接複製)

貼進 ChatGPT 自訂指令、Claude 專案指示,或 CLAUDE.md:

可複製內容
宣告任何工作完成之前,先附上:你實際執行了什麼、原始結果、以及我可以怎麼自己驗證。沒有驗證過的部分,直接說沒驗證。

一句話就夠,不用寫成長篇規則。

STEP 04什麼時候可以放鬆一點

判斷只問一句:做錯了,我多久會發現?

  • 馬上會發現(改文字、換排版、回答你本來就懂的問題)→ 不用查,錯了當場就看到。
  • 要過一陣子才發現(設定、排程、資料整理、外部查證)→ 一定要證據。這類最容易被「都設好了」帶過去,然後幾週後才爆。

STEP 05養成習慣的兩個小動作

  • 聽到越篤定的「完成」,越隨機抽一個地方點開看
  • 每次它主動附上證據時,順手說一句「這樣很好」——把好行為固定下來

官方參考:https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models