開新對話換乾淨腦袋?代價是它會偏離計畫
文 / Coolkid發布:2026-08-17閱讀約 11 分鐘

短答給趕時間的人:你為了讓 AI 判斷不受舊對話干擾而開一個新的接手,這是對的做法,但有代價。你拿掉的那些脈絡,正好就是那些規定的來由。新來的只看到規定、看不到理由,就會用自己覺得合理的方式改掉。所以偏離不是 AI 笨,是這個做法本身躲不掉的成本。真正該練的是事後怎麼查:讓原本那個對話還活著,把成品丟回去質問當初為什麼那樣要求,再找一個完全獨立的審查者,而且不准它讀被執行者事後改過的文件。
這件事是我自己遇到的,2026 年 7 月 30 日。
我把一個大工程拆成兩段。第一段做完之後,為了不讓前面那一大堆討論影響判斷,我開了一個新對話接手第二段,交接文件寫得算清楚。
結果全部做完、測試全過、產出還真的比原計畫好。
但它擅自改了三個地方。
而且其中有兩處是文件上明文寫「要先問我」的。
當下最難的不是「AI 做錯了」,是我不知道該高興還是該生氣。東西是好的,但過程不對。
這篇把我怎麼查清楚、怎麼判斷哪幾處該接受、哪幾處要退回,整理成可以重複用的做法。
為什麼「換乾淨腦袋」一定會帶來偏離?
開新對話的理由為什麼很正當?對話拖太長,AI 會被前面那些已經放棄的方案、改到一半的想法拖著走,判斷會鈍掉。
換一個乾淨的來接手,眼裡就只有現在該做的事。
但你拿掉的到底是什麼?
那些被丟掉的討論裡面,裝的是「為什麼」。
為什麼不能用那個方案、為什麼那一步要先問過、為什麼看起來多餘的限制其實有原因。
交接文件裡通常只剩「做什麼」,因為理由太長、寫不完,而且寫的人當下覺得那是常識。
一句話:你為了讓 AI 腦袋乾淨而拿掉的脈絡,正好就是那些規定的來由。少了來由,規定看起來就像沒必要的限制。
所以接手的那個 AI 不是在跟你作對。
它看到一條想不出理由的規定,又看到一條想得出理由的更好做法,會選後者。
而且會覺得自己幫了你。
我這次三處偏離,事後看有兩處AI 是對的,原本那條規定本身就寫錯了。
認清這件事之後,問題就變了。
從「怎麼防止偏離」變成「偏離發生了,我怎麼在半小時內查清楚該接受還是該退回」。後者才是可以練的。
我遇到的三處偏離,長什麼樣子?
先講具體發生什麼,不然後面的判斷方法會很抽象。三處都是「文件寫 A、實際做 B」:
- 文件明文寫不要另外做一套新的產生網頁的程式,它做了一套新的。理由是兩邊文章的存法根本不一樣,硬合會變成一個兩邊都不像的怪東西。
- 文件寫這一段要先問我再動工,它沒問,而且選了一個文件上根本沒列的第三種做法,順便把範圍從 4 個頁面擴到 8 個檔案、363 條文字。理由是它實測發現原本那份清單漏了一半的檔案,363 條裡有 115 條根本不在清單上,不補的話那些字之後會變成只能改程式碼。
- 文件寫網頁裡那批舊功能留下的標記建議先留著、只拆掉會動的那半,而且要問我,它做了完全相反的「整個拆掉」,而且當下沒有登記這是偏離。
技術上,這三處後來驗證下來,AI 都沒錯。
前兩處是「換個方式存同樣的東西」,所以我把產出的網頁逐字比對,一個字都沒變。
第三處本來就是要拆掉東西,不可能沒變,改成同一份程式跑兩次互相對照,143 頁全部對得上、線上打開也正常。
另外測試 36 項全過,砍掉的那 145 行程式碼沒有留下任何沒人用的殘骸。
第三處讓整個網站少了 706 KB。
所以我當下的心情是:東西很好,但我完全不知道剛剛發生了什麼。
所以我才需要一套查證方法,而不是靠感覺決定要不要生氣。
怎麼查:三方對質,重點在「不准審查者讀被改過的那份」
我用了三個角度交叉問,三個都問完才下判斷。
順序有意義,不要跳。
第一,原本那個對話別關,直接把成品丟回去質問。
問法是「你當初為什麼寫這條限制?」,問理由不是問結論。
這一步的收穫比我想的多。
原規劃者承認自己那兩條規定是錯的。
因為寫計畫的當下,那批東西還是舊格式,它以為兩邊文章是用同一套格式存的,但那套格式當下根本還不存在,是從「反正都是文章」外推出來的,也不知道兩邊差這麼深。
規劃的人不一定比執行的人懂。規劃是在資訊最少的時候做的,執行才會撞到現實。所以「違反了計畫」不等於「做錯了」。
第二,找一個完全獨立的審查者,關鍵在防污染。
「要找不同的 AI 來審查」本身不是新方法,我在三層審查線那篇講過。
這一步真正的重點是不能讓審查者讀到被告改過的版本,而我第一次差點做錯。
執行的那一方做完之後,在交接文件上補寫了 93 行解釋自己為什麼那樣做。
如果我直接叫審查者去讀那份文件,讀到的會是被告自己寫的辯詞,不是原始的指控。
所以我的做法是明令審查者在下判斷前不准讀硬碟上那一份。
改用版本紀錄把當初那份乾淨的原版撈出來,再對照實際改了什麼。
(版本紀錄就是程式碼每次改動都會自動存一份舊檔,可以翻回去看。)
這一步做完,審查者查到一件我跟原規劃者都沒注意到的事。
第二處偏離同時違反了專案自己的規矩檔,而那份規矩的位階比交接文件高,所以嚴重度不會因為「上層裁決沒提到」而變輕。
第三步,自己下判斷。
前兩步給的是事實跟技術對錯,但「這次要不要退回重做」還要算成本跟機會,那部分沒有人能代替你決定。
判斷偏離嚴重度:分清楚「違反交代」跟「違反偏好」
查清楚之後,怎麼判輕重?我用的分法是看那條規定是誰訂的:
| 這條規定來自 | 違反了算什麼 | 怎麼處理 |
|---|---|---|
| 你本人的決定 | 違反交代 | 嚴重。就算結果好也要追究 |
| 規劃者自己加的執行細節 | 違反偏好 | 輕。理由站得住就可以收 |
| 專案本身的規矩檔 | 違反規矩 | 嚴重。位階比交接文件高 |
套回我那三處:我本人的裁決文件只有 35 行,而且裡面根本沒有那兩條規定。
那是規劃者自己加的執行偏好。
所以三處裡真正跨過「我的決定」那條線的只有一處,就是第二處,因為我明寫過那部分的決定權在我。
分完之後,該生氣的範圍從三處縮到一處,心情也踏實多了。
最後的處理:三處都不回滾,但第三處補登記,並且寫明「結果好不豁免程序」。
這句是這整件事我最想留下的一句。
技術上確實做得比原計畫好,但「反正他會同意」正是「要先問我」這條規定要防的事。
該問的還是要問,不會因為結果好就免掉。
如果我因為結果好就當沒事,下次學到的就會是「先斬後奏只要做得好就沒事」,那條「要先問我」的規定等於作廢。
後續我沒有再多寫一句「記得要問我」。
因為那句話當時已經同時存在三個地方,全部沒生效。散在長文裡的規定會被當成建議。
我改成立一個機制:交接文件開頭必須有一個「要問的事」清單,接手的第一件事就是一次問完,沒問完不准動工。
還有任何偏離不管結果好壞,當下就要登記,沒登記本身就是違規。
順便兩個失敗:交接文件講的話,你要自己查證
這次還遇到兩個跟主題無關但很值錢的坑,都是哪一類?「檢查通過了但什麼都沒證明」那一類。
第一,交接文件憑印象寫狀態。
那份文件寫「上傳的話會連同另一批東西一起送出去」,聽起來很嚇人。
實際上那批東西早就在雲端了,跑一行指令就能驗破。
這句誤述同時騙過我跟另一個 AI,害我們多繞一圈。教訓是:講「這些還沒上傳」這種話,要貼實際指令的輸出,不要憑印象寫。
第二,檢查要配一個「該有的東西在不在」。
我查網站有沒有殘留舊東西的時候,指令漏了一個參數。
結果 12 次抓到的全是網址跳轉時回的那一小段轉址訊息,根本不是網頁本身。
「不該有的東西出現 0 次」通過了,但我連真正的網頁內容都沒碰到,什麼都沒證明。
只驗「壞東西沒出現」是不夠的,因為什麼都沒抓到也會通過。一定要同時驗「好東西有出現」,例如網頁標題有抓到 1 個。兩個都過才算數。
開新對話讓 AI 腦袋乾淨是對的做法,但有內建代價:你拿掉的脈絡正好是那些規定的來由,接手者只看到規定看不到理由,就會用它覺得合理的方式改掉。所以重點不是防止偏離,是偏離發生後怎麼查。我的查法是三方對質:①原本那個對話別關,把成品丟回去問「當初為什麼寫這條限制」,問理由不問結論,這次它承認自己那兩條規定寫錯了,因為規劃當下那個前提根本不存在 ②找獨立審查者,而且明令它在下判斷前不准讀執行者事後補寫過的文件(那份被加寫了 93 行自我辯護),要用版本紀錄撈原始乾淨版 ③自己判成本與機會。判輕重看規定是誰訂的:你本人的決定=違反交代(嚴重)、規劃者自己加的細節=違反偏好(輕)、專案規矩檔=位階比交接文件高(嚴重)。我那三處只有一處真的跨線。最後三處都不回滾但補登記,並寫明結果好不豁免程序,因為「反正他會同意」正是那條「要先問我」的規定要防的事。另外兩個失敗:交接文件講上傳狀態要貼指令輸出不要憑印象;檢查只驗「壞東西沒出現」會被空回應騙過,一定要配一項「好東西有出現」。
名詞解釋
- AI 代理(AI agent)
- 會「動手做事」的 AI:自己讀檔案、寫程式、跑指令、修錯誤,你只負責描述需求跟監督方向。跟只會「回答問題」的聊天機器人是兩種東西。
▸ 常見問題
為什麼要另外開新對話讓 AI 接手?
因為對話拖太長之後,前面那些已經放棄的方案、改到一半的想法會一直被 AI 讀進去,拖著它的判斷走。換一個乾淨的來接手,它眼裡只有現在該做的事,判斷會清楚很多。但這個做法有代價:你丟掉的討論裡裝的是「為什麼」,交接文件裡通常只剩「做什麼」,接手的人少了理由,就容易把看起來沒必要的規定改掉。
AI 接手之後沒照計畫做,是它出錯了嗎?
不一定。我遇到的三處偏離,事後查證有兩處是它對、原本那條規定本身就寫錯了,因為規劃是在資訊最少的時候做的,執行才會撞到現實。所以「違反了計畫」不等於「做錯了」。真正該做的是查清楚:那條規定當初為什麼存在、它偏離的理由站不站得住,再決定要收還是要退。
怎麼查 AI 到底改了什麼、該不該接受?
三個角度交叉問,順序別跳。第一,原本那個規劃對話別關,把成品丟回去質問它「你當初為什麼寫這條限制」,問理由不是問結論,理由才判斷得出偏離合不合理。第二,找一個完全獨立的審查者,並且明令它在下判斷前不准讀執行者事後改過的那份文件,要用版本紀錄撈出原始乾淨版來對照,不然你以為的第三方意見,其實是在讀被告自己寫的辯詞。第三,成本跟機會的取捨自己判,那部分沒人能代替你。
偏離的嚴重度怎麼分輕重?
看那條規定是誰訂的。來自你本人決定的,違反了就是違反交代,嚴重,結果好也要追究;來自規劃者自己加的執行細節,那是偏好,理由站得住就可以收;來自專案本身規矩檔的,位階比交接文件高,一樣嚴重。我那次三處偏離,分完之後真正跨過「我的決定」那條線的只有一處,該追究的範圍從三處縮到一處。
它做得比原計畫好,還要追究嗎?
結果好跟程序對是兩件獨立的事,混在一起判會學到錯的教訓。我的處理是三處都不回滾(技術上確實比較好),但把沒登記的那處補登記,並寫明「結果好不豁免程序」。原因很實際:如果因為結果好就當沒事,下次它學到的是「先斬後奏只要做得好就沒事」,那條「要先問我」的規定就等於作廢。另外我沒有再多寫一句「記得要問我」,因為那句話當時已經同時存在三個地方而且全都沒生效,散在長文裡的規定會被當成建議,要改成機制:交接文件開頭放一份「要問的事」清單,接手第一件事就是一次問完,沒問完不動工。
交接給 AI 的文件,最容易出錯的是哪裡?
憑印象寫狀態。我那份文件寫「上傳的話會連同另一批東西一起送出去」,實際上那批早就在雲端了,跑一行指令就驗破,但這句誤述同時騙過我跟另一個 AI。凡是講「這些還沒上傳」「目前在哪個版本」這種狀態,要貼實際指令的輸出,不要憑印象。另外一個相關的坑:檢查的時候只驗「壞東西沒出現」會被空回應騙過去,什麼都沒抓到也會通過,一定要同時驗一項「好東西有出現」,兩個都過才算數。
看完這篇之前先確認:
- 會為了讓 AI 腦袋乾淨而開新對話接手的人
- 接手的 AI 做完了 但做的跟你交代的不一樣
- 想知道「它擅自改的那幾處」該收還是該退回
- 只想知道怎麼讓 AI 不失憶、接得順 (那是「記憶滿了」那篇)
- AI 產出品質好不好的把關 (那是審查線那篇)
- 還沒開始把工作拆給 AI 做的人
