昨天,我們分享了 GPT-5.6 如何協助自身提升運行效率。今天,我們將這些成果回饋給客戶,調降了 GPT-5.6 Luna 和 Terra 的價格,並透過 API 為 GPT-5.6 Sol 帶來更快的效能。這些更新共同協助客戶,讓他們投入 AI 的每一分錢都能獲得更多價值,並在時間緊迫時能更快地推進工作。
從今天起,我們最快速且最經濟實惠的模型 GPT-5.6 Luna 將降價 80%,而適用於日常工作的平衡模型 GPT-5.6 Terra 則降價 20%。當客戶使用 Codex 和 ChatGPT Work 時,Luna 和 Terra 的這些降價也將反映在付費訂閱的使用量計算上。
Luna 為企業提供了一種更具成本效益的方式,以極高的品質處理大量工作。它能夠使用工具並完成多步驟的工作流程,使得更廣泛的 AI 應用得以大規模實踐。
讓先進智慧更普及且更經濟實惠,是 OpenAI 確保通用人工智慧(AGI)造福全人類使命的核心。這些變革將這項承諾付諸實踐,它們反映了我們在模型建構、服務和應用方式上多年來的改進。
我們也在 API 中推出了「快速模式」(Fast mode),它取代了原有的「優先處理」(Priority Processing)服務。對於 GPT-5.6 Sol 而言,快速模式現在能以兩倍的價格,提供比標準處理快上 2.5 倍的速度,同時智慧能力不變。快速模式具有向下相容性:標記為優先的請求將自動使用快速模式。
根據預期成果匹配智慧能力。高效使用 AI 始於預期成果。風險、錯誤成本、緊急程度和規模,決定了智慧能力、速度、可靠性和成本之間的最佳平衡。這種平衡在工作流程的不同步驟中可能會有所變化。
GPT-5.6 為企業提供了更大的空間來優化這個方程式。Luna 提供的效能可與一年前的頂尖模型媲美,但每項任務的成本約為其 6%,速度則快了近九倍。在專業工作方面,根據 Agents’ Last Exam 的衡量,Luna 的表現優於 Fable 5,而每項任務的預估成本則降低了近 99%。
實際上,企業可以定義他們所需的成果和品質標準,然後透過評估來判斷在哪些環節增加智慧能力能顯著改善結果,以及在哪些環節使用更快、成本更低的處理方式也能達到相同的品質。例如,在程式碼開發流程中,可能會使用 Sol 來解決不確定性並定義計畫,然後使用 Luna 來實施明確的變更、編寫和運行測試,並評估結果。其他工作流程可能需要不同的平衡。
GPT-5.6 系列擴展了這些選擇的範圍。企業可以在每個階段應用最大化的實用智慧能力,同時為其創造的價值支付合理的價格。
提供這種彈性的前提是讓模型背後的每一層都更加高效。我們如何推進效率前沿。我們的效率優勢來自於改進模型本身、運行模型的推論系統,以及將模型連接到工具和上下文的代理協作框架(agentic harness)。GPT-5.6 模型在處理工作時採取更直接的路徑。
更好的路由保持硬體的高效運作,優化的生產軟體能更有效地生成 token,而更智慧的上下文管理則幫助代理避免重複已完成的工作。總體而言,這些改進使我們能夠以相同的運算資源完成更多有用的工作,從而減少每個結果所需的時間、token 和成本。
GPT-5.6 Sol 正日益協助我們發現並實現下一階段的效益。在人類主導的流程中,Sol 自主地重寫並優化了生產核心(production kernels),設計並執行了數百項實驗以改進 token 生成效率,並監控訓練過程,在問題出現時進行干預。
核心工作幫助將模型服務的端到端成本降低了 20%,而其實驗則將 token 生成效率提高了超過 15%。這項工作仍在持續,形成了一個更緊密的迴圈:隨著我們的模型不斷改進並能夠更自主地工作,我們提升效率的能力也隨之加速。欲了解更多關於 GPT-5.6 背後的工程技術,請閱讀相關資訊。
為規模化而建構的運算策略。滿足對普及智慧的需求,既需要更多的運算資源,也需要更具生產力的運算資源。我們正在建立一個具備彈性的基礎設施組合,並將每個工作負載匹配到最適合運行的系統。這種方法同時支援了價格效能曲線的兩端。在低成本端,新的 Luna 和 Terra 價格使得大規模處理高用量工作變得經濟實惠。在尖端效能端,當回應時間至關重要時,快速模式讓 API 客戶能更快地存取 Sol。
企業可以在不犧牲關鍵工作速度的前提下,將更多 AI 應用於日常營運。大規模文件分析、客戶互動分類和例行實施等工作,現在可以更經濟地廣泛運行,而複雜的 Sol 工作負載在值得付出更高成本時也能更快地完成。
這些效益可以疊加。在人類主導的流程中,能力更強的模型幫助我們的技術團隊找到下一代的改進方案,縮短了實現更好效能和更低成本的路徑。我們的策略仍然專注於提升能力和效率,以便每一代智慧都能以更低的成本完成更多工作。
可用性與定價。GPT-5.6 Terra 和 Luna 仍可在 ChatGPT Work、Codex 和 OpenAI API 中使用。在 ChatGPT Work 和 Codex 中,免費版和 Go 版用戶可以使用 Terra,而 Plus、Pro、Business 和 Enterprise 用戶則可以選擇 Terra 和 Luna。
從 7 月 30 日起,API 定價方面,Terra 模型每百萬輸入 token 為 2 美元,每百萬輸出 token 為 12 美元;Luna 模型每百萬輸入 token 為 0.20 美元,每百萬輸出 token 為 1.20 美元。Sol 的定價保持不變。
ChatGPT 和 Codex 的訂閱價格和配額預算也維持不變,但使用 Terra 和 Luna 現在將消耗更少的點數。定價變更將於今天稍晚開始在 AWS 上推出。
GPT-5.6 Sol 的快速模式取代了 API 中的優先處理功能,並與 Codex 中的 /fast 功能保持一致。現有標記為優先的 API 請求將繼續有效。查看完整的 API 定價詳情。
