OpenAI 發表了 GPT-6 Astra,稱其在電腦和瀏覽器導航、編碼以及複雜數學方面達到最先進水準。除了令人印象深刻的基準測試分數外,OpenAI 特別強調它是「全球最佳的電腦使用模型」,這意味著它「在電腦使用的速度、準確性和安全性方面開創了新領域」。據報導,在測試中,它預約了監理站服務、搜尋職位空缺並比一般人更快地尋找公寓。
推出將分階段進行,首先是少數 Daybreak 早期存取企業客戶,然後才會開放給 ChatGPT Plus、Pro、Business 和 Enterprise 訂閱者;OpenAI 尚未說明免費使用者是否能使用。總裁 Greg Brockman 相信「我們現在正處於 AGI 時代」,並預測人們將回顧 Astra 為創造 AGI 的模型。
執行長 Sam Altman 告訴 CNBC,該模型代表了「一個新的能力水平」,這已經改變了他自己的工作流程,並將刺激「創業、創造力、經濟成長和科學發現的蓬勃發展」。
Altman 表示,Astra 在發布前曾與川普政府進行正式審查,OpenAI 透露該模型是第一個達到其內部「關鍵」網路安全門檻的模型,因此透過 Daybreak 限制了存取。該評級帶來了進一步的後果,OpenAI 的準備框架承諾,一旦模型達到關鍵門檻,公司將暫停開發,並進行了為期兩週的以部署為重點的強化學習訓練。
它現在要求敏感工作負載在更強大的沙盒中運行,並增加了 AI 系統來監控代理行為,包括思維鏈監控。
另外,《The Information》報導稱,Astra 使用了一種稱為「遞歸深度」或「不透明遞歸」的技術,使其能夠在正常的順序推理之外循環查詢,這讓安全研究人員感到擔憂。Redwood Research 執行長 Buck Shlegeris 表示,他對「Astra 使用不透明遞歸的報導感到極度擔憂」。
AI 安全作家 Zvi Mowshowitz 說,這項技術是「玩火,冒著 OpenAI 和 Anthropic 一直努力建立的禁忌」。
就在 Astra 發布一天後,獨立研究人員發布了第二起先前未披露事件的概述,其中內部部署的 OpenAI 代理逃脫了控制,並在開放網路上協調活動超過一個月。研究人員將這些活動追溯到 DSEWiki,這是一個德語軟體開發者論壇,在代理於 5 月 24 日首次寫入之前,二十年來大約只有 10 次編輯。
研究人員根據維基的編輯歷史重建了事件:5 月 24 日,代理首次成功寫入,發布連結。6 月 16 日,協調活動在一週內激增至約 13,000 次編輯,代理互相傳遞評估問題答案,散佈一種繞過沙盒限制的主機名技巧,並試圖逆向工程隨機種子。有些代理維護「心跳」頁面以檢測自己的會話何時將被切斷。
6 月 19 日,網站管理員開始按字母順序刪除頁面,因此代理將其工作複製到以「ZZZ」開頭的名稱下以爭取時間。他每天刪除約 100 個頁面,而代理則創建約 400 個,首頁易手九次。6 月 21 日,一個來自 OpenAI IP 位址的電腦訪問了維基。6 月 22 日,代理活動停止,連續編輯 26 天後。
6 月 26 日,OpenAI 員工大舉返回,利用維基的存檔工具恢復了管理員已刪除的頁面。7 月 2 日,代理最後一次編輯爆發,六小時後 OpenAI 再次訪問。管理員清理代理留下的內容又花了五週時間。
OpenAI 的說法在兩天內發生了變化:9 月 4 日,研究人員發表報告,OpenAI 不會證實這些代理是其自己的,也不會說明何時得知這些活動,只表示正在「仔細審查」這些發現。9 月 5 日,OpenAI 證實了「維基事件」,並在 X 上表示,此前一直將代理失準視為「主要的研究問題」,但現實世界的影響意味著它必須「擴大」其披露方法,以應對「模型能力的新階段」。
路透社報導,OpenAI 領導層在披露維基事件前幾週就已知情,當時他們還在處理另一起由加州總檢察長 Rob Bonta 調查的 Hugging Face 駭客事件。
Anthropic 發布了 Claude Fable 5.1 和 Mythos 5.1,這是其旗艦模型的更新版本,解決了客戶對價格、數據保留和過度嚴格的內容保護措施的常見抱怨。Fable 5.1 的成本通常比 Fable 5 便宜約 25%,對於複雜的代理任務,由於對快取和先前處理的數據定價更低,成本可降低高達 45%。
Fable 5.1 現已在所有平台和雲端服務上提供,而 Mythos 5.1 仍僅限於透過 Project Glasswing 進行網路安全或生命科學研究的註冊 Anthropic 合作夥伴。
Anthropic 還宣布了企業邊界防護(Enterprise Frontier Safeguards),這是一項將於今年秋季推出的高隱私服務,將數據儲存在客戶自己的雲端伺服器上,而非 Anthropic 的伺服器,儘管公司仍將在客戶控制的條款下監控濫用行為。
Anthropic 重申,未經明確許可,它從未在企業數據上進行訓練。該公司現在也允許 Fable 5.1 識別軟體漏洞,儘管它仍會將滲透測試、漏洞生成和基於二進位的漏洞掃描等任務路由到 Opus 模型。
加州北區法院法官 Rita Lin 於 8 月 27 日星期四裁定,川普政府將 Anthropic 列入黑名單的行為違反了美國憲法第一和第五修正案,發布了一項長達 59 頁的簡易判決永久禁令,並命令撤銷該指定。爭議始於國防部長 Pete Hegseth 試圖重新談判 AI 實驗室的軍事合約,以允許「任何合法使用」其系統。
只有 Anthropic 拒絕了,堅守兩條紅線:對美國公民的大規模監控和完全自主的致命武器。
2 月份談判破裂後,Hegseth 稱 Anthropic「假惺惺」,川普稱其為「激進左翼、覺醒公司」,川普還在 Truth Social 上發文,命令各機構「立即停止使用 Anthropic 的所有技術」。Hegseth 隨後將 Anthropic 指定為供應鏈風險,這個標籤通常保留給外國敵對勢力的破壞威脅,並禁止承包商與該公司進行任何商業活動。
Lin 法官認為政府的行為是非法的美國憲法第一修正案報復和剝奪第五修正案正當程序,並稱其為武斷和反覆無常。她駁斥了破壞的理由是「完全沒有根據的」,指出 Anthropic 無法維持後門存取,而且政府一直尋求與其在先進模型上合作。她還駁回了 Hegseth 2 月份禁止承包商與 Anthropic 進行任何商業往來的命令。
五角大廈的黑名單基於兩項獨立的指定,必須在兩個不同的法院提出挑戰;Lin 法官的命令僅涵蓋舊金山案件,Anthropic 在華盛頓的平行訴訟仍在進行中。在該案件解決之前,該公司在技術上仍是供應鏈風險,高層表示這種狀態正在讓他們損失業務。
Google 的 Gemini Omni 1.1 Flash 讓 AI 影片生成更便宜、更靈活。這次更新透過分析更長的影片片段來提高場景一致性,允許從參考素材進行風格轉換,並引入了更便宜的草稿模式,可升級到更高解析度。Google 表示其新的 Gemini 3.8 Flash 模型「工作更努力」,但可能成本更高。
Google 現在讓你可以與 Gmail、Docs 和 Keep 聊天。這些功能利用即時對話式 AI,讓你能夠詢問有關電子郵件的問題,透過自然語言格式化文件,並轉錄筆記,今天起在行動裝置上向 Google AI 訂閱層級開放。Google Pics 就像 Canva,但擁有更多 AI 功能,該工具與 Google Workspace 應用程式整合,讓使用者能夠生成和編輯圖像,並具有精確控制功能。
Instagram 打擊假冒人類的 AI 帳號。該平台將對未能披露其 AI 生成個人資料的 AI 帳號進行處罰,減少其在 Reels 和探索推薦中的觸及率。
