規格倒退嚕:Codex 把 GPT-5.6 Sol 上下文從 372k 砍回 272k,官方認了「用量爆燒」
OpenAI 工程師在 Codex 的 GitHub 倉庫送出改動,把 GPT-5.6 Sol 的上下文視窗上限從 372k tokens 調回 272k,Hacker News 討論串拿下 280 分。官方成員 Tibo(Thibault Sottiaux)與後續說明給了理由:372k 的推出是近期訂閱用量「意外燒太快」的主要來源之一,回滾能顯著降低消耗,團隊正在處理根因,目標是之後把 372k 加回來。同一波更新還提到推理端最佳化省下的成本會回饋給所有訂閱,單這項就約多出 10% 用量。
機制上的問題出在計費邊界。OpenAI 指出,超過 272k tokens 的請求會被以較高費率計算,而目前許多第三方 harness 直接把 GPT-5.6 的上下文設在 372k,等於用戶在不知情的狀況下加速消耗配額。開發者 Kun Chen 在 X 上提醒:不是透過 Codex 官方管道用 GPT-5.6 的人,最好手動把上下文上限改回 272k,否則額度會掉得比預期快。
用戶端的不滿累積已久。Codex 倉庫裡早有 issue 抱怨上下文「廣告寫 1.05M、實際一路縮水」,從 353K 掉到 258K 的回報也有人貼出實測。廠商用遠端設定檔動態調整模型的實際規格,訂閱用戶看到的數字與拿到的服務之間出現落差,正是這波爭執的核心。本站第 38 期才報導過 Codex 誤刪 $HOME 目錄的 bug,GPT-5.6 Sol 上線後的品管風波一樁接一樁。
歸剛點評:上下文長度已經從「規格表數字」變成廠商手上的浮動閥門,隨用量壓力開開關關,用戶完全被動。實際建議:用第三方工具接 GPT-5.6 的人今天就去檢查 context 設定,改回 272k 能省下真金白銀;等 OpenAI 宣布恢復 372k 再調回去。訂閱制 AI 的透明度問題,遲早需要一份「規格異動公告」的行業慣例。