跳到主要內容
maxstudioNews
Search the archive

Search

「多模態」

48 results
  1. 001微軟研究院推出 Quine:專為生物學複雜性設計的 AI 研究系統Microsoft Research·
  2. 002Suno 發表首款與唱片業合作的 AI 音樂模型 v6The Verge AI·
  3. 003NeoMME:高效多模態原生、多語言編碼器,提升視覺文件檢索效能Hugging Face Blog·
  4. 004Google DeepMind 推出 Gemini Omni 1.1 Flash:強化生成式影片創作控制力Google DeepMind·
  5. 005NVIDIA 斥資 130 億美元收購 HuggingFace;Z.ai 發表 GLM-5.3-Flash 模型Latent Space·
  6. 006簡報新創 Gamma 併購設計公司 Lica,強化 AI 視覺溝通能力TechCrunch AI·
  7. 007Deepseek 發表實驗性 Flash 視覺模型,代理任務表現直逼 Opus 4.8The Decoder·
  8. 008AI 模型視覺感知能力仍待加強:新基準測試揭示頂尖模型準確度未達六成The Decoder·
  9. 009MindTopo:揭露多模態模型拓撲空間推理的挑戰Microsoft Research·
  10. 010Meta 推出 Muse Glimmer:在地化、代理式、多模態開源模型Hugging Face Blog·
  11. 011巨型核心已死,巨型核心又活了:AI 推論工程的最新辯論與進展Latent Space·
  12. 012DeepSeek V4-Flash 模型開源,AI 安全事件與多模態進展成焦點Latent Space·
  13. 013Black Forest Labs 發表 FLUX 3:多模態模型超越業界標竿,並整合機器人應用Latent Space·
  14. 014Black Forest Labs 推出 Flux 3:首款支援原生音訊的 20 秒影片生成模型The Decoder·
  15. 015Kimi K3 重磅發布:2.8 兆參數開源模型問世,性能媲美 Opus 4.8 且價格具競爭力Latent Space·
  16. 016Kimi 發表 K3 模型:性能逼近 GPT-5.6 Sol 與 Fable 5,中國 AI 價格戰時代終結The Decoder·
  17. 017Mira Murati 實驗室推出開源多模態模型 InklingSimon Willison·
  18. 018Thinking Machines Lab 推出 Inkling:975B 多模態開源模型,樹立美國新標竿Latent Space·
  19. 019Thinking Machines Lab 發表首款模型 Inkling,主打開源與多模態能力Wired AI·
  20. 020AI 產業一日風雲:OpenAI 用戶激增,模型壓縮與多模態新突破Latent Space·
  21. 021Meta 發表 Muse Spark 1.1,加入 AI 程式碼戰局TechCrunch AI·
  22. 022SensorFM:打造穿戴式健康資料的通用智慧與介面Google Research·
  23. 023AI 產業前沿:Fable 5 應用、騰訊 Hy3 開源與 Anthropic J-Space 研究Latent Space·
  24. 024NVIDIA XR AI 公測登場,為 AR 眼鏡帶來免手持 AI 代理NVIDIA Blog·
  25. 025Android 17 正式登場,Google 強化 Gemini AI 體驗與多項新功能TechCrunch AI·
  26. 026Google DeepMind 推出 Gemma 4 12B:筆電專用、無編碼器多模態模型Google DeepMind·
  27. 027NVIDIA Nemotron 3.5 內容安全:為全球企業 AI 打造可自訂的多模態防護Hugging Face Blog·
  28. 028Google 推出 Gemma 4 12B 模型:16GB 筆電也能跑,AI 普及化再進一步Ars Technica AI·
  29. 029NVIDIA 重磅發布 Cosmos 3、Nemotron 3 Ultra 與 RTX Spark,引領開放模型與個人 AI 發展Latent Space·
  30. 030MiniMax M3 開源模型問世:百萬上下文視窗,效能比肩專有巨頭The Decoder·
  31. 031Nvidia GTC 台北大秀實體 AI 實力:推出全新世界模型、自駕車大腦與人形機器人平台The Decoder·
  32. 032NVIDIA Cosmos 3 世界基礎模型:賦予實體 AI 先思後行能力NVIDIA Blog·
  33. 033AI 每週回顧:Google Gemini 3.5 與 Omni 亮相,馬斯克控告 OpenAI 敗訴,AI 解決數學難題Last Week in AI·
  34. 034Google 搜尋框 25 年來最大變革:AI 驅動對話、多模態輸入,顛覆搜尋體驗VentureBeat AI·
  35. 035Gemini Omni 登場:Google DeepMind 發表多模態影音生成模型Google DeepMind·
  36. 036輝達 Nemotron Omni:AI 代理的統一多模態感知與推理模型The Sequence·
  37. 037商湯科技:平價AI模型仍能在全球競賽中脫穎而出CNBC Tech·
  38. 038iRobot共同創辦人推出新公司,打造AI社交機器人伴侶Engadget·
  39. 039Google Deepmind AI 輔助醫師盲測勝 GPT-5.4,但仍不及資深醫師The Decoder·
  40. 040LLM 函式庫 0.32a0 大幅重構,強化多模態與對話支援Simon Willison·
  41. 041AI 科技速報:推論系統、開源模型與代理應用新突破Latent Space·
  42. 042NVIDIA 發表 Nemotron 3 Nano Omni 模型:視覺、音訊、語言一體化,AI 代理效能提升九倍NVIDIA Blog·
  43. 043NVIDIA 推出 Nemotron 3 Nano Omni:長上下文多模態智慧,賦能文件、音訊與視訊代理Hugging Face Blog·
  44. 044圖像生成模型邁向通用人工智慧之路Latent Space·
  45. 045AI 科技週報:OpenAI 代理功能上線,xAI 佈局程式碼,DeepSeek 與 Kimi 實力躍進The Sequence·
  46. 046抖音推出 Astra:雙模型架構引領自主機器人導航新紀元Synced Review·
  47. 047Meta AI 發表 Muse Spark:通往個人超級智慧的關鍵里程碑Meta AI Blog·
  48. 048Meta 發表 Muse Spark 1.1:強化代理、程式碼與多模態理解的 AI 模型Meta AI Blog·