智能與秩序
我讓 codex 挑 Claude 的錯,但不照它說了算
摘要
作者使用兩個獨立的 AI 模型(Claude 與 codex)進行程式碼審查協作,核心問題是:第二意見極易淪為附和,失去獨立性。文章提出四步獨立性協定——問題不夾帶結論、保留原始輸出紀錄、審查者只指問題不改程式、交叉比對由人類決策——來守住第二意見的價值。最反直覺的洞見是:模型審得越準,越不應照單全收,而要回頭自己讀程式碼判斷。作者並強調探針故障時應快速失敗、清楚標註,以及規則應隨著模型能力改進而動態調整。這套機制適用於任何需要獨立驗證的工作流程。
重點
- 第二意見的最大風險是附和,需透過中性提問、留存紀錄、權限邊界、人類決策四步協定保護獨立性
- 多模型協作需要互為對照,分歧處才需人類回頭判斷;兩邊都點到的問題風險最高
- 審查者應只描述問題並標示嚴重等級,不動手改程式碼,避免混淆原意與外來修改
- 探針故障時須立即大聲說自己壞了,無聲拖延才是真正的坑,完成定義應看實質內容而非退出碼
- 規則是為填洞搭的鷹架,問題解決後應動態拆除,不應淪為永久儀式或盲目照抄
章節
- 為什麼要找第二個 AI 來審查
引入 codex 作為獨立審查者的動機與架構,強調換個血統的模型才能戳出盲點。
- 第二意見最大的風險:它會附和你
分析問題根源:提問方式若夾帶結論,模型會順著給假安心,獨立性難以保證。
- 怎麼讓第二意見保持獨立:四步協定
系統化規則對應失敗模式:中性提問、紀錄輸出、權限邊界、人類交叉比對。
- 審得越準,越不能照單全收
核心洞見:當両模型意見分歧時,應回頭自己讀程式碼判斷,而非盲目采信任一方。
- 探針會壞時,讓它大聲說自己壞了
故障處理哲學:快速失敗而非默默重試,將故障狀態顯式標註,避免無聲空等。
- 鷹架是為了填洞,洞補了就拆
規則應綁定具體問題,隨模型能力改進而動態調整,不應成為永久儀式。
- 一面會頂嘴的鏡子與實作附錄
總結價值定位與操作指南,並提供通用化的技術實作供讀者複製改用。
金句
同一個模型寫的東西,自己回頭看,容易看不到自己的盲點,甚至會順著自己先前的判斷點頭。換一個來自不同訓練、不同框架的模型,才戳得到第一個漏掉的地方。
如果你問第二個模型的方式裡,已經夾帶了你自己的結論,它很可能順著你說,給你一個假的安心。
審得越準,越不能照單全收。采信哪些、保留哪些,落在握有完整脈絡的那一方。
一個會壞的依賴,最重要的能力,就是在壞掉時大聲說自己壞了。無聲地拖著你空等,才是真正的坑。
我接 codex 進來,要的從來不是一個會點頭的聲音。我要的是在自己又一次太相信自己的時候,有個血統不同的對手戳我一下。