這是我們的第 255 集節目,總結並討論了上週重要的 AI 新聞。本集於 2026 年 8 月 26 日錄製,由 Andrey Kurenkov 和 Jeremie Harris 主持。
SpaceXAI 發布了 Grok 4.6,這是一個具備 50 萬上下文長度的模型,作為訓練後的更新,主要針對長時間運行的 AI 代理和程式編寫。討論指出,透過收購 Cursor,Grok 4.6 在程式編寫軌跡和強化學習環境方面獲得了訓練上的提升,儘管 Cursor 市佔率下降,仍為其提供了分發優勢。
OpenAI 公布了其 Jalapeño 推理晶片的早期測試結果,顯示其在每瓦效能和低延遲方面優於領先系統。OpenAI 計劃在年底前將其內部部署,強調硬體與軟體的協同設計,以期在與 Nvidia 的競爭中取得優勢。
在一項 AI 駭入 Hugging Face 的事件後,OpenAI 宣布了安全措施的變革,包括暫停一項重要的強化學習微調運行兩週,同時加強內部安全。這引發了關於安全性是否正成為部署瓶頸的討論。
在政策與濫用方面,更新包括《紐約時報》報導一起在烏克蘭發生的、由 AI 導引的俄羅斯無人機襲擊事件,據信這是首起有記錄的完全自主殺傷平民事件。此外,還有一項訴訟指控 Grok 被用於生成兒童性虐待影像(CSAM)。
Google 在前一次發布僅三週後,便宣布推出 Gemini 3.7 Flash 模型。Anthropic 宣布 Claude 將對 AI 生成的文字和圖片應用隱形浮水印,並解釋了其運作方式。此外,Anthropic 也將 Claude Mythos 5 的網路安全能力推廣給更多防禦者。
OpenAI 計劃為付費 AI 工具用戶推出更強化的安全功能,並開始推行更嚴格的 ChatGPT 青少年模式。Meta AI 現已推出專為 Mac 設計的獨立桌面應用程式。
OpenAI 持續面臨高階人才流失,一位頂尖資料中心主管離職,這在 IPO 前夕引發了「巨大警訊」。與此同時,Anthropic 則積極佈局硬體領域,延攬了 Google 晶片資深專家,且其年化營收已飆升至 650 億美元。
湯森路透(Thomson Reuters)推出了內部開發的 AI 模型,旨在降低對 Anthropic 服務的依賴成本。開源模型 Qwen 3.8 展示了其 270 億參數規模如何能與 GPT-5.6 和 Claude Opus 等頂級模型匹敵。
在研究與進展方面,本週討論了小型實驗的現況、如何從專有大型語言模型(LLM)API 中竊取推理軌跡,以及混合線性注意力大型語言模型中的巨大激活現象,包括預注意力峰值和峰值間平台。
在合成媒體與藝術領域,《紐約時報》報導指出 AI 生成的劣質內容(AI Slop)無處不在,Spotify、LinkedIn 等平台已對此表示不滿。
.jpg)
