今天,我們首次預覽了 Ultrafast,這是一個新的服務層級,能讓 GPT-5.6 Sol 的運行速度比標準處理快上 14 倍,並將率先在 OpenAI API 中推出。由 Cerebras 提供支援,Ultrafast 每秒可生成多達 750 個輸出 token,將我們最智慧的模型帶入分秒必爭的產品和工作流程中。
透過 GPT-5.6,我們正在拓展模型能力的邊界,並使其在我們技術堆疊的每一層都更加高效。這些改進讓先進的智慧變得更經濟實惠,並對更多人更有用。直到現在,要獲得即時速度通常意味著選擇更小或更專業的模型。Ultrafast 指向了一個新的進步方向:每秒完成更多有用的工作。
當速度不再需要犧牲智慧時,AI 就能進入企業中最時間敏感的環節,並開啟新型態的工作模式。我們已經看到 Ultrafast 的一些令人鼓舞的應用情境:
事件回應與可靠性:當關鍵系統故障時,在停機仍在發生時,分析應用程式日誌、最近的程式碼變更和工程師報告,以識別可能的原因並協助準備修復方案。
金融研究與安全:在市場狀況不斷變化時,分析市場訊號、評估交易並識別可疑活動。
客戶支援與語音:在不中斷對話的情況下即時解決複雜的客戶問題,即使尋找答案需要多個步驟或系統。
電子商務:在購物者仍在猶豫時,回答產品問題、檢查庫存、個人化推薦並解決結帳問題,避免猶豫變成棄單。
即時研究與實驗:將過去需要通宵運行的研究轉變為互動式工作環節,讓團隊能夠測試想法、檢查結果、調整方法並運行另一個實驗,而不會中斷他們的工作流程。
在預覽期間,我們正與首批客戶合作,以了解這種速度在哪裡能發揮最大的作用,以及這些經驗如何隨著時間推移改進我們的產品。如果您的業務需要最前沿的智慧且速度極快,您可以註冊以在開放更多存取權限時收到通知。
GPT-5.6 Sol 的 Ultrafast 模式和標準模式,可以從相同的文字提示詞並排建立一個可運作的 3D 倉庫模擬器。
早期客戶的體驗:我們一直在與首批橫跨程式設計、電子商務、金融研究、支援和其他互動式應用程式的公司,測試 GPT-5.6 Sol 的 Ultrafast 模式。從商業工作流程開始,讓我們能夠在真實的生產環境中研究這些條件。他們早期的工作正在幫助我們了解速度數量級的變化在哪裡創造了最大的價值,以及當模型能夠跟上使用者的速度時,產品會如何改變。我們將利用這些發現來指導隨著容量增長而進行的部署。
OpenAI 如何使用 Ultrafast:在 OpenAI 內部,一群開發人員一直在測試 GPT-5.6 Sol 的 Ultrafast 模式,以了解哪些工作流程能從即時回應的前沿智慧中受益。
事件回應就是我們團隊使用 Ultrafast 的一個例子。當警報觸發時,工程師需要在系統和證據仍在變化時建立準確的圖像。團隊利用它快速讀取日誌、分析追蹤、綜合對話、識別下一步檢查,並協助準備或驗證修復方案,所有這些都以 Sol 的智慧在極短的時間內完成。它減少了觀察訊號、測試假設和選擇下一步行動之間的延遲,同時工程師仍負責判斷和部署。
在研究方面,我們的團隊使用 Ultrafast 快速搜尋知識來源、查詢數據,並在連接的工具之間快速收集、組織和總結資訊。研究中常見的工作流程是我們的團隊成員在夜間啟動一批實驗,並在早上審查結果。透過 Ultrafast,我們看到這個循環正在縮短,以支持在工作日進行多次迭代。
由 Cerebras 提供支援:Ultrafast 標誌著我們與 Cerebras 合作的下一步,旨在將超低延遲推論帶入 OpenAI 的平台。現在,透過 GPT-5.6 Sol 的 Ultrafast 模式,Cerebras 正在支援 OpenAI 最智慧的模型,每秒提供高達 750 個輸出 token,使企業能夠建立反應更快的產品、做出更快的決策,並將強大的 AI 直接整合到他們最嚴苛的工作流程中。
可用性:GPT-5.6 Sol 的 Ultrafast 模式目前以有限預覽的形式提供給選定的客戶。我們將隨著容量的增長擴大存取權限。請註冊以獲取更新。



