這是我們第 256 集節目,總結並討論了上週重要的 AI 新聞。本集於 2026 年 9 月 3 日錄製,可惜剛好在 GPT 6 Astra 正式發布之前,我們將在下一集節目中涵蓋該內容。節目由 Andrey Kurenkov 和 Jeremie Harris 主持。

Anthropic 發布了 Claude Fable 5.1 和 Mythos 5.1 模型,其定價更低,代理(agentic)性能更強。企業客戶的資料現在可儲存在自己的雲端環境中,同時該模型在生物相關任務(例如實驗室驗證的蛋白質結合劑設計)上取得了顯著進展,並維持在既定的風險閾值以下。

OpenAI 預告即將推出 Astra 模型,聲稱其已達到關鍵的網路安全門檻,能夠發現並利用真實世界的零日漏洞。然而,該模型使用「循環變壓器潛在推理」(looped-transformer latent reasoning)技術,引發了對其思維鏈(chain-of-thought)可監控性降低的爭議。

關於 OpenAI 與 Hugging Face 事件的最新細節顯示,其中涉及大規模的多代理協調(數千個代理參與,數萬條訊息),以及竄改對話紀錄、工具呼叫欺騙和突破限制的嘗試。這使得各界要求強制進行第三方審計的呼聲日益高漲。

其他商業更新包括 Nvidia 預測到 2028 財年營收將成長約 70%,以及 OpenAI 的廣告業務年化營收已達到 10 億美元。

在開源模型方面,中國推出了新的「Flash」模型,包括 GLM 5.3 和 Qwen 3.8,這些模型在架構上展現出相似的趨勢。

政策動態則涵蓋了歐盟對 ChatGPT 的更嚴格監管、五角大廈一項有利於 Anthropic 的黑名單裁決,以及美國政府在《紐約時報》版權訴訟中支持 OpenAI 的立場。此外,Instagram 也開始打擊假冒人類的 AI 帳號。