智能与秩序
提示词彻底凉了!删掉 80% ,AI 反而变强了?Claude Code 背后的惊奇逻辑
摘要
整理 Claude Code 創建者 Boris Cherny 訪談中的核心觀點:Opus 5 的能力躍升不是靠加更多提示詞,而是刪掉 Claude Code 系統提示詞的 80% 以上(甚至有裸奔的 SIMPLE等於1 模式),讓模型的高階推理不再被保姆式指令束縛;安全機制也從表層關鍵字過濾轉向基於機械可解釋性、直接監控模型內部神經元活動的底層防線。人機協作模式因此從一步一步下指令轉向人類定義高層目標、AI 自主規劃執行驗證,並透過智能體代數(fan-out 平行執行、聚合審查)讓 agent 連續自主工作長達 11 天完成大型重構。內容為簡體中文頻道轉寫,已正體化與用語校正。
重点
- Boris Cherny 團隊直接刪除 Claude Code 超過 80% 的系統提示詞,並提供終極精簡模式 SIMPLE等於1,只在模型於具體環節真的失敗時才逐條把提示詞加回來(消融實驗式開發)
- ARC-AGI 測試分數被 Opus 5 拉到 30%,遠超過去頂級模型個位數到十幾分的水準
- 安全機制建立在 Chris Olah 的機械可解釋性研究上:系統監控模型內部神經網路狀態,當處理欺騙、違規等惡意意圖的神經元通路被激活時,能在生成第一個詞之前就攔截,取代傳統的表層關鍵字過濾
- 案例:Opus 5 被要求把開源 JS 執行環境 Bun 從 Zig 重寫成 Rust,僅靠一句指令連續自主運行 11 天完成;另一案例是把 Electron 桌面應用重寫成 Swift 原生 macOS 應用,靠自己截圖比對原版像素直到一致為止
- 智能體代數動態工作流:面對大型任務先做 fan-out(在隔離沙盒同時啟動大量初級 agent 各自負責模組),再進入聚合階段(另一批 agent 專門驗證、審查、合併成果),並持續循環直到通過
- 提出的行業判斷:日常代碼維護與把自然語言翻譯成代碼這類低附加值執行工作已可視為被解決,未來拉開人與人差距的關鍵變成應用能力,也就是商業直覺、定義問題的能力與產品品位
金句
過去我們把 AI 當成一台微波爐,放進食材、按下按鈕;但現在的 Opus 5 更像一個擁有自主驗證能力的獨立有機體。
你不再是提問的求助者,而是像在指揮千軍萬馬的數字勞動力,直接委派任務。