# AI 交付驗收卡

> 來源：be-ai-curator.com｜配套長文〈AI 說「完成了」，但它真的做完了嗎？〉
> 適用：ChatGPT、Claude、Claude Code、任何會回報「完成了」的 AI 工具

## 為什麼需要這張卡

AI 回報「完成了」的時候，通常不是在說謊——它是真心覺得「應該沒問題」：計畫寫得很完整、步驟看起來都對，於是把「打算做的」當成「已經做的」。

麻煩的是：**模型越聰明，這個「應該」講得越有條理，你越不會想去點開檢查。**

我自己的紀錄裡，這種「說做完了、其實沒驗證」的情況截至 2026 年七月下旬累積 167 次；就算換上最新一代模型，七月下旬那一週還是有 10 次。

## 一、真正的完成，會附三樣東西

- [ ] **做了哪些動作** —— 動了哪個檔案、跑了什麼指令、查了哪個網頁
- [ ] **結果原封不動貼出來** —— 不是「執行成功」，是實際跑出來的東西
- [ ] **我可以怎麼自己再確認一次** —— 一個你能點、能跑、能看的方法

三樣缺一，先當作還沒做完。

## 二、五種最常見的假完成

| 它說的 | 實際上 | 怎麼抽查 |
|--------|--------|----------|
| 「檔案都改好了」 | 一個字都沒動 | 打開檔案、看修改時間 |
| 「測試全部通過」 | 測試根本沒跑起來 | 要它貼出執行結果原文 |
| 「查證完畢，附上來源」 | 連結是 404 或內容對不上 | 自己點一次連結 |
| 「都幫你設定好了」 | 設定放錯位置、從未生效 | 製造一次觸發、看有沒有反應 |
| 「已經全部更新」 | 只更新了它記得的那部分 | 要它列出清單、逐項對 |

## 三、一句話規則（直接複製）

貼進 ChatGPT 自訂指令、Claude 專案指示，或 CLAUDE.md：

```
宣告任何工作完成之前，先附上：你實際執行了什麼、原始結果、以及我可以怎麼自己驗證。沒有驗證過的部分，直接說沒驗證。
```

一句話就夠，不用寫成長篇規則。

## 四、什麼時候可以放鬆一點

判斷只問一句：**做錯了，我多久會發現？**

- **馬上會發現**（改文字、換排版、回答你本來就懂的問題）→ 不用查，錯了當場就看到。
- **要過一陣子才發現**（設定、排程、資料整理、外部查證）→ 一定要證據。這類最容易被「都設好了」帶過去，然後幾週後才爆。

## 五、養成習慣的兩個小動作

- [ ] 聽到越篤定的「完成」，越隨機抽一個地方點開看
- [ ] 每次它主動附上證據時，順手說一句「這樣很好」——把好行為固定下來

官方參考：https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models
