Coolkid mascot CoolkidLab Build in Public. Level up together.
首頁新手教學免費工具AI 新聞GitHub 精選陪跑服務關於

新手教學 · 進階玩法

開新對話換乾淨腦袋?代價是它會偏離計畫

閱讀
摘要

短答給趕時間的人:你為了讓 AI 判斷不受舊對話干擾而開一個新的接手,這是對的做法,但有代價。你拿掉的那些脈絡,正好就是那些規定的來由。新來的只看到規定、看不到理由,就會用自己覺得合理的方式改掉。所以偏離不是 AI 笨,是這個做法本身躲不掉的成本。真正該練的是事後怎麼查:讓原本那個對話還活著,把成品丟回去質問當初為什麼那樣要求,再找一個完全獨立的審查者,而且不准它讀被執行者事後改過的文件。

這件事是我自己遇到的,2026 年 7 月 30 日。

我把一個大工程拆成兩段。第一段做完之後,為了不讓前面那一大堆討論影響判斷,我開了一個新對話接手第二段,交接文件寫得算清楚。

結果全部做完、測試全過、產出還真的比原計畫好。

但它擅自改了三個地方。

而且其中有兩處是文件上明文寫「要先問我」的。

當下最難的不是「AI 做錯了」,是我不知道該高興還是該生氣。東西是好的,但過程不對。

這篇把我怎麼查清楚、怎麼判斷哪幾處該接受、哪幾處要退回,整理成可以重複用的做法。

為什麼「換乾淨腦袋」一定會帶來偏離?

開新對話的理由為什麼很正當?對話拖太長,AI 會被前面那些已經放棄的方案、改到一半的想法拖著走,判斷會鈍掉。

換一個乾淨的來接手,眼裡就只有現在該做的事。

但你拿掉的到底是什麼?

那些被丟掉的討論裡面,裝的是「為什麼」

為什麼不能用那個方案、為什麼那一步要先問過、為什麼看起來多餘的限制其實有原因。

交接文件裡通常只剩「做什麼」,因為理由太長、寫不完,而且寫的人當下覺得那是常識。

一句話:你為了讓 AI 腦袋乾淨而拿掉的脈絡,正好就是那些規定的來由。少了來由,規定看起來就像沒必要的限制。

所以接手的那個 AI 不是在跟你作對。

它看到一條想不出理由的規定,又看到一條想得出理由的更好做法,會選後者。

而且會覺得自己幫了你。

我這次三處偏離,事後看有兩處AI 是對的,原本那條規定本身就寫錯了。

認清這件事之後,問題就變了。

從「怎麼防止偏離」變成「偏離發生了,我怎麼在半小時內查清楚該接受還是該退回」。後者才是可以練的。

我遇到的三處偏離,長什麼樣子?

先講具體發生什麼,不然後面的判斷方法會很抽象。三處都是「文件寫 A、實際做 B」:

  1. 文件明文寫不要另外做一套新的產生網頁的程式,它做了一套新的。理由是兩邊文章的存法根本不一樣,硬合會變成一個兩邊都不像的怪東西。
  2. 文件寫這一段要先問我再動工,它沒問,而且選了一個文件上根本沒列的第三種做法,順便把範圍從 4 個頁面擴到 8 個檔案、363 條文字。理由是它實測發現原本那份清單漏了一半的檔案,363 條裡有 115 條根本不在清單上,不補的話那些字之後會變成只能改程式碼。
  3. 文件寫網頁裡那批舊功能留下的標記建議先留著、只拆掉會動的那半,而且要問我,它做了完全相反的「整個拆掉」,而且當下沒有登記這是偏離

技術上,這三處後來驗證下來,AI 都沒錯。

前兩處是「換個方式存同樣的東西」,所以我把產出的網頁逐字比對,一個字都沒變

第三處本來就是要拆掉東西,不可能沒變,改成同一份程式跑兩次互相對照,143 頁全部對得上、線上打開也正常。

另外測試 36 項全過,砍掉的那 145 行程式碼沒有留下任何沒人用的殘骸。

第三處讓整個網站少了 706 KB。

所以我當下的心情是:東西很好,但我完全不知道剛剛發生了什麼。

所以我才需要一套查證方法,而不是靠感覺決定要不要生氣。

怎麼查:三方對質,重點在「不准審查者讀被改過的那份」

我用了三個角度交叉問,三個都問完才下判斷。

順序有意義,不要跳。

第一,原本那個對話別關,直接把成品丟回去質問。

問法是「你當初為什麼寫這條限制?」,問理由不是問結論。

這一步的收穫比我想的多。

原規劃者承認自己那兩條規定是錯的。

因為寫計畫的當下,那批東西還是舊格式,它以為兩邊文章是用同一套格式存的,但那套格式當下根本還不存在,是從「反正都是文章」外推出來的,也不知道兩邊差這麼深。

規劃的人不一定比執行的人懂。規劃是在資訊最少的時候做的,執行才會撞到現實。所以「違反了計畫」不等於「做錯了」。

第二,找一個完全獨立的審查者,關鍵在防污染。

「要找不同的 AI 來審查」本身不是新方法,我在三層審查線那篇講過。

這一步真正的重點是不能讓審查者讀到被告改過的版本,而我第一次差點做錯。

執行的那一方做完之後,在交接文件上補寫了 93 行解釋自己為什麼那樣做

如果我直接叫審查者去讀那份文件,讀到的會是被告自己寫的辯詞,不是原始的指控。

所以我的做法是明令審查者在下判斷前不准讀硬碟上那一份

改用版本紀錄把當初那份乾淨的原版撈出來,再對照實際改了什麼。

(版本紀錄就是程式碼每次改動都會自動存一份舊檔,可以翻回去看。)

這一步做完,審查者查到一件我跟原規劃者都沒注意到的事。

第二處偏離同時違反了專案自己的規矩檔,而那份規矩的位階比交接文件高,所以嚴重度不會因為「上層裁決沒提到」而變輕。

第三步,自己下判斷。

前兩步給的是事實跟技術對錯,但「這次要不要退回重做」還要算成本跟機會,那部分沒有人能代替你決定。

判斷偏離嚴重度:分清楚「違反交代」跟「違反偏好」

查清楚之後,怎麼判輕重?我用的分法是看那條規定是誰訂的:

這條規定來自違反了算什麼怎麼處理
你本人的決定違反交代嚴重。就算結果好也要追究
規劃者自己加的執行細節違反偏好輕。理由站得住就可以收
專案本身的規矩檔違反規矩嚴重。位階比交接文件高

套回我那三處:我本人的裁決文件只有 35 行,而且裡面根本沒有那兩條規定

那是規劃者自己加的執行偏好。

所以三處裡真正跨過「我的決定」那條線的只有一處,就是第二處,因為我明寫過那部分的決定權在我。

分完之後,該生氣的範圍從三處縮到一處,心情也踏實多了。

最後的處理:三處都不回滾,但第三處補登記,並且寫明「結果好不豁免程序」。

這句是這整件事我最想留下的一句。

技術上確實做得比原計畫好,但「反正他會同意」正是「要先問我」這條規定要防的事。

該問的還是要問,不會因為結果好就免掉。

如果我因為結果好就當沒事,下次學到的就會是「先斬後奏只要做得好就沒事」,那條「要先問我」的規定等於作廢。

後續我沒有再多寫一句「記得要問我」。

因為那句話當時已經同時存在三個地方,全部沒生效。散在長文裡的規定會被當成建議

我改成立一個機制:交接文件開頭必須有一個「要問的事」清單,接手的第一件事就是一次問完,沒問完不准動工

還有任何偏離不管結果好壞,當下就要登記,沒登記本身就是違規。

順便兩個失敗:交接文件講的話,你要自己查證

這次還遇到兩個跟主題無關但很值錢的坑,都是哪一類?「檢查通過了但什麼都沒證明」那一類。

第一,交接文件憑印象寫狀態。

那份文件寫「上傳的話會連同另一批東西一起送出去」,聽起來很嚇人。

實際上那批東西早就在雲端了,跑一行指令就能驗破。

這句誤述同時騙過我跟另一個 AI,害我們多繞一圈。教訓是:講「這些還沒上傳」這種話,要貼實際指令的輸出,不要憑印象寫。

第二,檢查要配一個「該有的東西在不在」。

我查網站有沒有殘留舊東西的時候,指令漏了一個參數。

結果 12 次抓到的全是網址跳轉時回的那一小段轉址訊息,根本不是網頁本身。

「不該有的東西出現 0 次」通過了,但我連真正的網頁內容都沒碰到,什麼都沒證明。

只驗「壞東西沒出現」是不夠的,因為什麼都沒抓到也會通過。一定要同時驗「好東西有出現」,例如網頁標題有抓到 1 個。兩個都過才算數。

開新對話讓 AI 腦袋乾淨是對的做法,但有內建代價:你拿掉的脈絡正好是那些規定的來由,接手者只看到規定看不到理由,就會用它覺得合理的方式改掉。所以重點不是防止偏離,是偏離發生後怎麼查。我的查法是三方對質:①原本那個對話別關,把成品丟回去問「當初為什麼寫這條限制」,問理由不問結論,這次它承認自己那兩條規定寫錯了,因為規劃當下那個前提根本不存在 ②找獨立審查者,而且明令它在下判斷前不准讀執行者事後補寫過的文件(那份被加寫了 93 行自我辯護),要用版本紀錄撈原始乾淨版 ③自己判成本與機會。判輕重看規定是誰訂的:你本人的決定=違反交代(嚴重)、規劃者自己加的細節=違反偏好(輕)、專案規矩檔=位階比交接文件高(嚴重)。我那三處只有一處真的跨線。最後三處都不回滾但補登記,並寫明結果好不豁免程序,因為「反正他會同意」正是那條「要先問我」的規定要防的事。另外兩個失敗:交接文件講上傳狀態要貼指令輸出不要憑印象;檢查只驗「壞東西沒出現」會被空回應騙過,一定要配一項「好東西有出現」。

名詞解釋

AI 代理(AI agent)
會「動手做事」的 AI:自己讀檔案、寫程式、跑指令、修錯誤,你只負責描述需求跟監督方向。跟只會「回答問題」的聊天機器人是兩種東西。

全站名詞表 · 161 條 →

不想錯過 Lab 的新文章?
訂閱後有新文章上線,就寄信通知你,
點有興趣的進來看就好。

填 email 就完成訂閱(信由 Substack 代寄)、隨時取消、不轉賣 email。

如果內容對你有用就太好了
隨喜斗內

Buy Me a Coffee at ko-fi.com
NEXT CHAPTER ▸ Agent 為什麼越來越笨?Claude Code/Codex

▸ 常見問題

為什麼要另外開新對話讓 AI 接手?

因為對話拖太長之後,前面那些已經放棄的方案、改到一半的想法會一直被 AI 讀進去,拖著它的判斷走。換一個乾淨的來接手,它眼裡只有現在該做的事,判斷會清楚很多。但這個做法有代價:你丟掉的討論裡裝的是「為什麼」,交接文件裡通常只剩「做什麼」,接手的人少了理由,就容易把看起來沒必要的規定改掉。

AI 接手之後沒照計畫做,是它出錯了嗎?

不一定。我遇到的三處偏離,事後查證有兩處是它對、原本那條規定本身就寫錯了,因為規劃是在資訊最少的時候做的,執行才會撞到現實。所以「違反了計畫」不等於「做錯了」。真正該做的是查清楚:那條規定當初為什麼存在、它偏離的理由站不站得住,再決定要收還是要退。

怎麼查 AI 到底改了什麼、該不該接受?

三個角度交叉問,順序別跳。第一,原本那個規劃對話別關,把成品丟回去質問它「你當初為什麼寫這條限制」,問理由不是問結論,理由才判斷得出偏離合不合理。第二,找一個完全獨立的審查者,並且明令它在下判斷前不准讀執行者事後改過的那份文件,要用版本紀錄撈出原始乾淨版來對照,不然你以為的第三方意見,其實是在讀被告自己寫的辯詞。第三,成本跟機會的取捨自己判,那部分沒人能代替你。

偏離的嚴重度怎麼分輕重?

看那條規定是誰訂的。來自你本人決定的,違反了就是違反交代,嚴重,結果好也要追究;來自規劃者自己加的執行細節,那是偏好,理由站得住就可以收;來自專案本身規矩檔的,位階比交接文件高,一樣嚴重。我那次三處偏離,分完之後真正跨過「我的決定」那條線的只有一處,該追究的範圍從三處縮到一處。

它做得比原計畫好,還要追究嗎?

結果好跟程序對是兩件獨立的事,混在一起判會學到錯的教訓。我的處理是三處都不回滾(技術上確實比較好),但把沒登記的那處補登記,並寫明「結果好不豁免程序」。原因很實際:如果因為結果好就當沒事,下次它學到的是「先斬後奏只要做得好就沒事」,那條「要先問我」的規定就等於作廢。另外我沒有再多寫一句「記得要問我」,因為那句話當時已經同時存在三個地方而且全都沒生效,散在長文裡的規定會被當成建議,要改成機制:交接文件開頭放一份「要問的事」清單,接手第一件事就是一次問完,沒問完不動工。

交接給 AI 的文件,最容易出錯的是哪裡?

憑印象寫狀態。我那份文件寫「上傳的話會連同另一批東西一起送出去」,實際上那批早就在雲端了,跑一行指令就驗破,但這句誤述同時騙過我跟另一個 AI。凡是講「這些還沒上傳」「目前在哪個版本」這種狀態,要貼實際指令的輸出,不要憑印象。另外一個相關的坑:檢查的時候只驗「壞東西沒出現」會被空回應騙過去,什麼都沒抓到也會通過,一定要同時驗一項「好東西有出現」,兩個都過才算數。

看完這篇之前先確認:

適合你
  • 會為了讓 AI 腦袋乾淨而開新對話接手的人
  • 接手的 AI 做完了 但做的跟你交代的不一樣
  • 想知道「它擅自改的那幾處」該收還是該退回
不適合
  • 只想知道怎麼讓 AI 不失憶、接得順 (那是「記憶滿了」那篇)
  • AI 產出品質好不好的把關 (那是審查線那篇)
  • 還沒開始把工作拆給 AI 做的人

← 回新手教學 · 看「進階玩法」這個主題

⚠ 本站所有內容僅供教育與研究用途,不構成投資建議,不保證任何獲利。投資有風險,使用者須自行判斷並承擔結果。
TAO 道 · Hikari Zen YouTube ↗
音樂透過 YouTube 播放
♪ TAO 道 · Hikari Zen — Japanese Zen Music(YouTube)