在 OpenAI 應川普政府要求將錯開其下一代模型發布的消息傳出不到 24 小時,新模型 GPT-5.6 便已問世。週五,該公司揭示了其全新 GPT-5.6 模型套件的有限預覽版,其中包括旗艦模型 Sol、用於「高工作量」的中階模型 Terra,以及「快速且經濟實惠」的日常模型 Luna。OpenAI 表示,這些模型特別擅長程式設計、網路安全和生物學,並能在長時間的代理式 AI 任務中保持專注。

每百萬個 token,GPT-5.6 Sol 的定價為輸入 5 美元/輸出 30 美元,幾乎是 Anthropic 的 Claude Fable 5(輸入 10 美元/輸出 50 美元)的一半。Terra 的成本是 Sol 的一半,而 Luna 的成本又不到 Terra 的一半。

該公司還為 Sol 推出了兩種額外模式:「max」模式用於更深層次的推理,而「ultra」模式則用於利用子代理,這讓人聯想到 OpenClaw,或許也暗示了 OpenClaw 創作者 Peter Steinberger 在 OpenAI 的工作成果。

在華盛頓特區安全恐慌的背景下,OpenAI 毫不意外地將其發布部落格文章的大部分內容,用於強調安全性和潛在的濫用問題。文章似乎影射了其競爭對手 Anthropic 最近遭遇的越獄困境,指出「GPT-5.6 經過訓練,會拒絕提供被禁止的網路協助,即使使用者試圖偽裝其意圖或對模型進行越獄」。

它還表示,旗艦模型 Sol「在幫助人們發現和修復漏洞方面表現更好,而非可靠地執行端到端攻擊」,並且 Sol 在 OpenAI 的準備框架下並未跨越網路關鍵門檻,儘管值得注意的是,OpenAI 在四月修訂了其準備框架,並移除了一些先前的研究領域。

該公司表示,Sol 擁有其「迄今為止最堅固的安全堆疊」,並且「加強了對高風險活動、敏感網路請求和重複濫用的保護」。OpenAI 指出,它投入了「約 70 萬個 A100e GPU 小時」進行自動化紅隊測試,並與第三方測試人員合作,後者將在接下來的兩週內繼續對其進行測試。

OpenAI 在預覽期間似乎也採取了格外謹慎的態度,該期間正受到川普政府的密切監控。該公司寫道:「安全措施偶爾可能會干預合法工作,特別是在防禦性和攻擊性活動最初看起來相似的雙重用途領域。這正是預覽版旨在測試的一部分。」本週稍早的報導指出,川普政府將在預覽期間逐案審批客戶。

OpenAI 表示,由於公司堅信「廣泛普及」,該模型套件應在未來幾週內普遍上市;儘管公司在此次發布前與美國政府合作,但希望這不會成為常態。該公司寫道:「我們不認為這種政府介入的審批流程應該成為長期的預設模式。」「這會讓需要這些最佳工具的使用者、開發者、企業、網路防禦者和全球合作夥伴無法取得。

我們採取這項短期措施,是因為我們相信這是未來幾週內實現更廣泛普及的最有力途徑,同時我們也將與政府合作,制定網路行政命令框架和未來模型發布的可重複流程。」