OpenAI 週四發表了其最新的模型家族,為日益競爭的 AI 市場帶來一系列重量級產品。
GPT-5.6 包含三種版本:Sol(被視為其主力模型)、Terra(中階選項)和 Luna(經濟實惠的選項)。這些模型擴展了使用者在各領域的能力,OpenAI 承諾它們在企業工作、程式編碼甚至科學研究方面都具備強大功能。
執行長 Sam Altman 承諾,公司最新的模型比以前的版本在效率和成本效益上都有顯著提升。他最近向 CNBC 表示,Sol 在 AI 編碼任務中,token 效率提高了 54%。
最值得注意的是,OpenAI 稱 GPT-5.6 為其「迄今最強大的網路安全模型,以顯著更少的 token 達到領先效能」。事實上,該模型的網路安全能力引起了廣泛關注,因為川普政府曾試圖限制其推出,表面上是擔心模型可能被濫用。
GPT-5.6 支援多種防禦活動,包括威脅建模、程式碼審查與修補,以及藍隊演練(模擬攻擊自身系統以在真正的駭客入侵前找出弱點)。
OpenAI 也推出了一款名為 ChatGPT Work 的新工具,顧名思義,它專為企業團隊設計,作為工作場所的協作夥伴。該工具可在桌機、網頁和行動裝置上運行,協助處理日常文書工作,例如文件起草、試算表製作和簡報準備。
OpenAI 新發表的模型家族,緊隨本週競爭對手 SpaceXAI 和 Meta 的類似發布。然而,GPT-5.6 及其相關行銷策略,似乎主要旨在瞄準 OpenAI 的主要競爭對手 Anthropic。
Anthropic 在 AI 競賽中成功塑造了討人喜歡的「黑馬」形象,專注於企業客戶並因此贏得了越來越多的支持。為了不甘示弱,OpenAI 引用了著名的基準測試指標「Artificial Analysis Coding Agent Index」,聲稱其最新的模型家族在各方面都超越了 Anthropic 的模型。
OpenAI 稱 Sol 為其「迄今最佳的程式編碼模型」,並明確將其與 Anthropic 最近發布(且備受炒作)的 Fable 進行比較。OpenAI 聲稱,根據 Coding Agent Index,Sol 以 80 分「樹立了新的技術標竿,比 Fable 5 高出 2.8 分,同時使用的輸出 token 不到一半,所需時間不到一半,成本也減少約三分之一。」
OpenAI 補充道:「這項優勢延伸至整個家族:Terra 的表現略高於 Fable 5,而 Luna 則超越了 Opus 4.8。」
該公司表示,GPT-5.6 現已透過 ChatGPT、Codex 和 OpenAI API 提供。每百萬 token 的定價如下:Sol 輸入為 5 美元/輸出為 30 美元,Terra 輸入為 2.50 美元/輸出為 15 美元,Luna 輸入為 1 美元/輸出為 6 美元。



