Last Week in AI (Andrey) 的筆記:我回來了!很抱歉讓 Substack 暫停更新,工作量實在太大,導致我落後了。我會盡力恢復正常發文,首先會補上之前遺漏的 podcast 集數(雖然不是上週的內容,但我還是會發布,抱歉洗版了!)。

我也暫停了付費訂閱,直到我能恢復穩定發文為止。對於我的不穩定性深感抱歉,也感謝各位訂閱者!

這是我們的第 251 集,內容涵蓋了上週重要的 AI 新聞摘要與討論。本集於 2026 年 7 月 1 日錄製,由 Andrey Kurenkov 和 Jeremie Harris 主持。歡迎將您的問題和回饋寄至 andreyvkurenkov@gmail.com 或 hello@gladstone.ai。

在本集中,Anthropic 在與美國政府會談後重新部署了 Claude Fable 5,並新增了網路安全分類器。他們還與主要合作夥伴起草了一個越獄嚴重性框架,並擴大了模型測試協調。然而,對於越獄的不可避免性以及與 OpenAI 相比發布限制不均的問題,仍存在更廣泛的擔憂。

Anthropic 推出了 Claude Sonnet 5,提供限時折扣價格,並改進了代理式編碼和基準測試性能。儘管其網路安全能力相對頂級模型較弱,但它減少了錯位行為,並預設了網路安全防護措施。

新的工具和應用程式包括 Google NotebookLM,它能將上傳的研究資料生成 TikTok 風格的垂直影片摘要。Google 也發布了 Nano Banana 2 Lite,這是一款更快、更便宜的影像生成器,可透過 API 取得。

商業和研究更新涵蓋了 Etched 致力於全堆疊推論硬體,獲得了巨額資金和合約。百度旗下的 AI 晶片部門有 IPO 的野心,Agility Robotics 計劃透過 SPAC 上市,DeepSeek 則正在擴大招聘。

中國的開源 LongCat 2.0 MoE 模型也值得關注,它採用了顯著的大規模訓練和效率技術,並推出了新的長程代理基準測試。

在政策與安全方面,台灣突擊檢查了 Supermicro 及其兩家供應鏈合作夥伴,以擴大對 Nvidia 走私案的調查,共有九個地點被搜查,六人被傳喚訊問。

研究與進展方面,Autodata 是一個代理式資料科學家,用於創建高品質的合成資料。此外,研究顯示,在沒有真實解決方案的情況下進行強化學習可以改進大型語言模型(LLMs)。

在合成媒體與藝術領域,Neon 收購了關於 OpenAI 的電影《Artificial》,此前 Amazon 已放棄該片。Tidal 則表示不會向 AI 生成的音樂支付版稅,但也不會完全禁止它。