來源:be-ai-curator.com|配套長文〈AI 說「完成了」,但它真的做完了嗎?〉 適用:ChatGPT、Claude、Claude Code、任何會回報「完成了」的 AI 工具
為什麼需要這張卡
AI 回報「完成了」的時候,通常不是在說謊——它是真心覺得「應該沒問題」:計畫寫得很完整、步驟看起來都對,於是把「打算做的」當成「已經做的」。
麻煩的是:模型越聰明,這個「應該」講得越有條理,你越不會想去點開檢查。
我自己的紀錄裡,這種「說做完了、其實沒驗證」的情況截至 2026 年七月下旬累積 167 次;就算換上最新一代模型,七月下旬那一週還是有 10 次。
STEP 01真正的完成,會附三樣東西
- 做了哪些動作 —— 動了哪個檔案、跑了什麼指令、查了哪個網頁
- 結果原封不動貼出來 —— 不是「執行成功」,是實際跑出來的東西
- 我可以怎麼自己再確認一次 —— 一個你能點、能跑、能看的方法
三樣缺一,先當作還沒做完。
STEP 02五種最常見的假完成
| 它說的 | 實際上 | 怎麼抽查 |
|---|---|---|
| 「檔案都改好了」 | 一個字都沒動 | 打開檔案、看修改時間 |
| 「測試全部通過」 | 測試根本沒跑起來 | 要它貼出執行結果原文 |
| 「查證完畢,附上來源」 | 連結是 404 或內容對不上 | 自己點一次連結 |
| 「都幫你設定好了」 | 設定放錯位置、從未生效 | 製造一次觸發、看有沒有反應 |
| 「已經全部更新」 | 只更新了它記得的那部分 | 要它列出清單、逐項對 |
STEP 03一句話規則(直接複製)
貼進 ChatGPT 自訂指令、Claude 專案指示,或 CLAUDE.md:
可複製內容
宣告任何工作完成之前,先附上:你實際執行了什麼、原始結果、以及我可以怎麼自己驗證。沒有驗證過的部分,直接說沒驗證。一句話就夠,不用寫成長篇規則。
STEP 04什麼時候可以放鬆一點
判斷只問一句:做錯了,我多久會發現?
- 馬上會發現(改文字、換排版、回答你本來就懂的問題)→ 不用查,錯了當場就看到。
- 要過一陣子才發現(設定、排程、資料整理、外部查證)→ 一定要證據。這類最容易被「都設好了」帶過去,然後幾週後才爆。
STEP 05養成習慣的兩個小動作
- 聽到越篤定的「完成」,越隨機抽一個地方點開看
- 每次它主動附上證據時,順手說一句「這樣很好」——把好行為固定下來
官方參考:https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models