最重要的數字是 80。7 月 30 日,OpenAI 把 GPT-5.6 Luna 的 API 價格下調 80%,至每百萬輸入 token 0.20 美元、輸出 1.20 美元;GPT-5.6 Terra 下調 20%,至 2 美元和 12 美元。頂層的 Sol 價格不變,但獲得 Fast 模式:最高提速 2.5 倍,價格為兩倍,取代 Priority Processing。降價公布於題為'Advancing the price-performance frontier with GPT-5.6'的文章,前一天的一篇姊妹文章解釋了公司所說的利潤空間來源。
那個解釋才是不同尋常的部分。OpenAI 表示,在 Codex 中執行的 GPT-5.6 Sol 自主重寫並最佳化了用其自有的開源 GPU 語言 Triton 和 Gluon 編寫的生產核心,將端到端服務成本降低了 20%。模型還圍繞加速自身 token 生成的投機解碼草稿模型設計並執行了數百次實驗,把這項效率提升了 15% 以上,並在此過程中干預了硬體故障和訓練不穩定。OpenAI 謹慎地將其表述為'由人主導的過程',並稱 AI 編寫的核心已用開源浮點檢查工具 FpSan 驗證。
分發與價格同速推進。三個 GPT-5.6 模型現已在 Amazon Bedrock 全面可用,並新增顯式提示快取模式:快取讀取按一折計費,寫入按非快取費率的 1.25 倍,TTL 30 分鐘,每次請求最多四個快取中斷點。本週的基準聲明包括:最大推理檔的 Sol 在 Artificial Analysis 的 Coding Agent 指數上以'不到一半的成本'擊敗 Anthropic 的 Claude Fable 5;Terra 以一半價格在智能基準上追平 GPT-5.5;Luna 在 Agents' Last Exam 上超過 Fable 5,估算每任務成本低 99%。
對建構者來說,實際的部分很簡單:第二季寫下的任何成本模型今天都已過時,而新的快取經濟學獎勵穩定的提示前綴。細則部分需要更多時間。被廣泛引用的'三月旗艦智能如今只賣十三分之一價格'是第三方測算,把 GPT-5.4 在某個公開指數上的分數與 Luna 對比,並非 OpenAI 的數字。自我最佳化的收益是 OpenAI 在自己定義的流程裡測量自己。而'模型讓自己更便宜'是關於買家無法檢查的基礎設施的主張。這些都不會讓帳單變得不真實,而是意味著:如今定價所依據的效率故事,和此前的基準一樣,值得逐行細讀。
