AI 主理人
免費資源

Claude、ChatGPT・Codex更新

AI 說「完成了」,常是把打算做的當成已經做的,三樣證據分得出真假

AI 交付驗收卡

給常把工作交給 AI 的人閱讀+複製

為什麼這樣做?看原文《AI 說「完成了」,但它真的做完了嗎?用三樣證據分辨》

HAND IT TO YOUR AI

把《AI 交付驗收卡》交給你的 AI

它會收到:請照著它一步一步帶我做;每一步做完先等我回覆再繼續。

AI 說「完成了」時,用三樣證據分辨真假完成;附五種常見假完成的識別方式、一句話可貼進自訂指令的驗收規則,和什麼時候可以放鬆的判斷法。

WHAT'S INSIDE

這份包含5 項
  • 真正完成必附的三樣證據
  • 五種最常見的假完成與抽查方式
  • 一句話規則(可直接複製貼上)
  • 「做錯了多久會發現」的鬆緊判斷
  • 養成習慣的兩個小動作

THE GUIDE

來源:be-ai-curator.com|配套長文〈AI 說「完成了」,但它真的做完了嗎?〉 適用:ChatGPT、Claude、Claude Code、任何會回報「完成了」的 AI 工具

為什麼需要這張卡

AI 回報「完成了」的時候,通常不是在說謊——它是真心覺得「應該沒問題」:計畫寫得很完整、步驟看起來都對,於是把「打算做的」當成「已經做的」。

麻煩的是:模型越聰明,這個「應該」講得越有條理,你越不會想去點開檢查。

我自己的紀錄裡,這種「說做完了、其實沒驗證」的情況截至 2026 年七月下旬累積 167 次;就算換上最新一代模型,七月下旬那一週還是有 10 次。

STEP 01真正的完成,會附三樣東西

  • 做了哪些動作 —— 動了哪個檔案、跑了什麼指令、查了哪個網頁
  • 結果原封不動貼出來 —— 不是「執行成功」,是實際跑出來的東西
  • 我可以怎麼自己再確認一次 —— 一個你能點、能跑、能看的方法

三樣缺一,先當作還沒做完。

STEP 02五種最常見的假完成

它說的實際上怎麼抽查
「檔案都改好了」一個字都沒動打開檔案、看修改時間
「測試全部通過」測試根本沒跑起來要它貼出執行結果原文
「查證完畢,附上來源」連結是 404 或內容對不上自己點一次連結
「都幫你設定好了」設定放錯位置、從未生效製造一次觸發、看有沒有反應
「已經全部更新」只更新了它記得的那部分要它列出清單、逐項對

STEP 03一句話規則(直接複製)

貼進 ChatGPT 自訂指令、Claude 專案指示,或 CLAUDE.md:

可複製內容
宣告任何工作完成之前,先附上:你實際執行了什麼、原始結果、以及我可以怎麼自己驗證。沒有驗證過的部分,直接說沒驗證。

一句話就夠,不用寫成長篇規則。

STEP 04什麼時候可以放鬆一點

判斷只問一句:做錯了,我多久會發現?

  • 馬上會發現(改文字、換排版、回答你本來就懂的問題)→ 不用查,錯了當場就看到。
  • 要過一陣子才發現(設定、排程、資料整理、外部查證)→ 一定要證據。這類最容易被「都設好了」帶過去,然後幾週後才爆。

STEP 05養成習慣的兩個小動作

  • 聽到越篤定的「完成」,越隨機抽一個地方點開看
  • 每次它主動附上證據時,順手說一句「這樣很好」——把好行為固定下來

官方參考:https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models

想留在自己的資料夾,再下載 Markdown 原檔。

NEWSLETTER

下一份免費資源,寄到信箱

每月一封:我這個月的分工表、最值得動手的說明書,和只在信裡的加碼。

隨時一鍵退訂看過去的信《隱私權政策》

來自這篇文章:《AI 說「完成了」,但它真的做完了嗎?用三樣證據分辨》

想把這份說明書改成你們團隊的版本?聯繫合作