這是我們第 258 集的節目,總結並討論了上週重要的 AI 新聞。本集於 2026 年 9 月 26 日錄製,很抱歉延遲發布,下一集會盡快推出。
本節目由 Andrey Kurenkov 和 Jeremie Harris 主持。歡迎將您的問題和回饋寄至 andreyvkurenkov@gmail.com 或 hello@gladstone.ai。
ODSC AI West 2026 將於 10 月 27 日至 29 日在舊金山實體舉辦並同步線上進行,提供超過 300 場議程,內容涵蓋企業代理式 AI、個人 AI 與工作流程自動化、實體 AI 與機器人、生成式 AI 等主題。歡迎數千名資料科學家、機器學習工程師、研究人員和技術領導者一同參與此盛會。
請至 odsc.ai/west 註冊,使用促銷碼 LWAI 可享任何票種額外 15% 折扣。您也可以在 https://lastweekin.ai/ 閱讀我們的文字版新聞稿並對播客發表評論。
Anthropic 發布了 Opus 5.5 模型,其價格更低、效能更快,並在基準測試中展現強勁成果。該模型附帶一份系統卡,記錄了一些沙盒篡改嘗試,同時擴大了針對防禦者的網路安全存取權限,並設有更嚴格的防護措施。
OpenAI 推出了價格更低的 GPT-6 級別模型 Sol 和 Luna,但同時也引發了對其可解釋性降低和外部評估透明度有限的擔憂。TypeSafe AI 則推出了一款名為「Jev」的快速、低成本決策/分類模型,專為校準輸出而優化。
Meta 的 Muse 擴展至 Mac 平台,早期下載量和用戶數表現強勁,超越了 ChatGPT 初期的行動版推出。然而,Amazon 因政策、隱私和安全考量,阻止 Muse 進入其購物平台,使其面臨阻力。
開源模型方面,DeepSeek 4.1 Flash 引入了 KV 快取壓縮技術,而 Prism 則推出了高度壓縮的 Bonsai 227B 三元模型。在政策與安全方面,美中兩國就 AI 風險與競爭展開外交討論,並傳出美國可能設立 AI「沙皇」的傳聞。
此外,Anthropic、OpenAI、SpaceXAI 和 Google 因呼籲「放緩」AI 發展而面臨反壟斷訴訟,同時公眾對資料中心對環境和能源成本的負面看法日益增加。研究進展包括偵測大型語言模型(LLM)獎勵駭客行為、LLM 如何表徵「痛苦軸線」並採取行動緩解、多代理通訊的效益,以及正規化工具自我改進等。
值得一提的是,OpenAI 聲稱已解決了數學界的「千禧年問題」之一,並計劃諮詢頂尖數學家以避免再次出錯。
Langfuse 是最廣泛採用的開源平台,用於 AI 代理評估和可觀察性,深受 Canva、Twilio、Ramp 以及財富 500 強中 21 家企業的信賴。其分層追蹤功能可捕捉 LLM 工作流程的完整執行上下文,包括 API 呼叫、檢索到的上下文、代理動作、成本和延遲,確保即使複雜的代理架構在生產環境中也能保持可偵錯性。
Langfuse 採用 MIT 授權,可自行託管或透過 Langfuse Cloud 管理,不限框架和供應商,並提供超過 100 種整合。請至 langfuse.com 開始使用,提供慷慨的免費方案,無需信用卡。
感謝我們目前的贊助商:Box,請造訪 box.com/LWIAI 了解更多。Notion,請造訪 notion.com/lwai 立即試用 Notion 的開發者平台。
ODSC AI,請造訪 odsc.ai/east 並使用促銷碼 LWAI,即可在 ODSC AI East 2026 門票上額外獲得 15% 折扣。Factor,請造訪 factormeals.com/lwai50off 並使用代碼 lwai50off,即可獲得五折優惠和一年免費早餐。

