跳到主要內容
maxstudioNews
Search the archive

Search

「強化學習」

28 results
  1. 001強化尖端 AI 訓練安全:OpenAI 提出安全案例指引OpenAI Blog·
  2. 002突破推論瓶頸:Google Research 透過 Retrieve-for-Train 加速複雜 AI 搜尋Google Research·
  3. 003AllSpark 發表 Iris-mini 與 Iris-pro:同級最強開源搜尋代理模型The Decoder·
  4. 004Hugging Face Jobs 上的 Async GRPO 與 LoRA:無需 NCCL 的分散式訓練新架構Hugging Face Blog·
  5. 005AI 創業家 Danijar Hafner 打造能應對未知的智慧代理MIT Technology Review AI·
  6. 006AI 程式碼模型水彩畫實踐:TRL 與 OpenEnv 的應用Hugging Face Blog·
  7. 007從麻省理工到 IBM:加速 AI 與量子技術落地應用MIT News (AI)·
  8. 008Hugging Face 推出開源機器鴨 Microduck,推動實體 AI 普及TechCrunch AI·
  9. 009IBM Granite 4.2 LLM:深度解析其建構與訓練策略Hugging Face Blog·
  10. 010參數時代終結?Z.ai CEO 唐傑談 GLM 5.3 與後訓練縮放法則Latent Space·
  11. 011AI 產業週報:記憶體價格飆漲、OpenAI 調整開發步調與開源模型新進展Latent Space·
  12. 012OpenAI 推出新安全措施,強化模型開發防護TechCrunch AI·
  13. 013微軟 CARE-X:整合多重技術,打造臨床實用放射學 VLMMicrosoft Research·
  14. 014AI 強化學習讓量子電腦邊運算邊校正錯誤Google Research·
  15. 015傑出電腦科學家暨多產作家:麻省理工榮譽教授 Dimitri Bertsekas 享壽 83 歲辭世MIT News (AI)·
  16. 016AI如何驅動自主機器人:從工廠到居家應用Ars Technica AI·
  17. 017LLM 賦能機器人:理解模糊指令、掌握關鍵細節MIT News (AI)·
  18. 018AI 打造超乎想像的無線電晶片,突破人類設計極限IEEE Spectrum AI·
  19. 019OpenAI 研究揭示:少量「有益特徵」訓練可大幅提升 AI 模型安全性與抗操控性The Decoder·
  20. 020MosaicLeaks:AI研究代理的隱私洩漏挑戰與解決方案Hugging Face Blog·
  21. 021OpenEnv 專案走向開放治理,獲開源社群與業界巨頭力挺Hugging Face Blog·
  22. 022AI 科技週報:模型、代理與開源生態系最新進展Latent Space·
  23. 023Hugging Face 推出 Delta Weight Sync:大幅降低非同步強化學習模型同步成本Hugging Face Blog·
  24. 024ChatGPT 的中文怪癖:「我會穩穩地接住你」引發熱議Wired AI·
  25. 025vLLM V0 到 V1 遷移:強化學習訓練的正確性挑戰Hugging Face Blog·
  26. 026Granite 4.1 大型語言模型:技術建構與訓練揭秘Hugging Face Blog·
  27. 027強化學習新突破:分而治之策略解決離策略學習擴展性難題BAIR Blog (Berkeley AI)·
  28. 028麻省理工學院發表「SEAL」框架,推進 AI 自我演化能力Synced Review·