OpenAI 近期對旗下 AI 程式設計工具 Codex 做出了一項重大調整:正式取消了針對 Plus、Business 和 Pro 使用者的每 5 小時使用限制。這意味著使用者無需再像過去那樣,為了保持隨時可用的狀態而刻意定時傳送訊息。然而,當重度使用者開始無限制地使用搭載了最新 GPT-5.6 模型的 Codex 時,一個新問題迅速浮出水面——Token 消耗量變得極其驚人。
根據多家科技媒體和社群使用者的實測反饋,GPT-5.6 雖然能力更強,但在執行任務時也變成了一個不折不扣的“Token 刺客”。有案例顯示,一個生成 3D 網頁的任務就讓 Codex 持續運行了近三個小時,其背後的 Token 消耗量遠超預期。儘管 Codex 官方解釋稱,使用者可能低估了 GPT-5.6 Sol Ultra High 推理檔位的消耗量,但社群很快發現了另一個關鍵癥結:許多曾經被視為必備的 Skills(技能包)。
在社交媒體上,大量使用者開始分享經驗,指出像 Superpowers、grill 以及 AGENTS.md 這類曾經用於增強 Agent 能力的技能和文件,如今反而成了負擔。其核心原因在於,GPT-5.6 本身已具備強大的 Agentic 能力,能夠自主規劃和執行任務。而外部 Skills 的反覆呼叫會汙染上下文視窗,導致模型思考時間變長,Token 消耗隨之飆升。有網友形象地評論道,這些舊時代的 Skills 就像“一裝就後台常駐還關不掉的流氓軟體,吃 Token 比吃大米還快”。
面對這一變化,OpenAI 的開發者體驗工程師 Eric 在 X 平台上釋出了一份 GPT-5.6 的官方提示詞指南,為如何高效使用新模型指明瞭方向。指南的核心思想不再是提供一套萬能模板,而是引導使用者轉變與 AI 的協作方式。
指南明確指出,使用 GPT-5.6 時,最應該優先考慮的是設定清晰的邊界,讓模型在指定的沙箱範圍內執行。使用者需要解釋模型應如何驗證其工作是否成功,並清楚地說明任務完成的狀態。如果提示詞中存在太多歧義,將直接導致更長的執行時間和更高的 Token 使用量。
這份指南打破了過往的許多“提示詞秘籍”。OpenAI 給出的第一條建議就是“用自己的話開始”。對於大多數任務,一句簡短的提示已經足夠。只有當任務更大、更重要時,才需要補充四類資訊:你想要什麼結果、有哪些背景資訊、成品應該長什麼樣、以及哪些邊界絕對不能觸碰。
指南中一個更具顛覆性的觀點是,提示詞最該寫的往往是結果,而非過程。過去,使用者習慣於為 AI 安排完整的思考步驟,但如今,模型已經能夠自行搜尋、比較和調整方法。人為規定每一步操作,反而可能限制其能力。同樣,在提供背景資訊時,原則是“只提供會改變結果的資訊”,而非一股腦地丟入所有資料,因為過期或無關的檔案只會製造噪音。
此外,指南還強調了驗收標準的重要性。當 AI 開始交付檔案、修改程式碼和操作工具後,輸出的可審查性變得比輸入的華麗程度更重要。例如,在 Codex 中修復一個 Bug,使用者需要提供復現步驟、相關檔案和約束條件,並要求 Codex 在修復後重新執行復現步驟並執行最小範圍的測試。這種“定義完成”的意識,是駕馭能力更強、能持續工作的 AI 的關鍵。
最後,這份指南也試圖消除使用者的“提示詞焦慮”,指出第一條提示無需一次到位。使用者可以像與同事協作一樣,先看結果,再通過後續訊息具體指出需要修改的地方。Codex 的引導功能和排隊功能也支援這種邊做邊改的互動模式。
總而言之,GPT-5.6 的釋出和 Codex 限制的取消,標誌著 AI 工具使用方式的一個分水嶺。過去那種依賴複雜 Skills 和冗長步驟指令的“網際網路秘術”正在失效。當 AI 越來越擅長“幹活”,人類的核心能力正在從“如何指揮”轉向“如何定義目標、設定邊界和驗收成果”。