跳到主要內容
maxstudioNews
Search the archive

Search

「AI 推論」

60 results
  1. 001Bitbucket Cloud PR 專用 AI 程式碼審查側邊欄Cursor Forum (Showcase)·
  2. 002AI 推論服務商 Modal Labs 傳完成 7.5 億美元巨額融資,估值飆破 150 億美元TechCrunch AI·
  3. 003實體 AI 機器人推論卸載:微軟研究揭示效能與續航力新突破Microsoft Research·
  4. 004Hugging Face Transformers 整合 llama.cpp GGUF 格式,筆電也能高效運行 AI 模型Hugging Face Blog·
  5. 005突破推論瓶頸:Google Research 透過 Retrieve-for-Train 加速複雜 AI 搜尋Google Research·
  6. 006d-Matrix 整合 NVIDIA NVLink Fusion,推動機架級 XPU 部署NVIDIA Blog·
  7. 007AI 時代的記憶體與儲存架構:企業致勝的關鍵策略MIT Technology Review AI·
  8. 008NVIDIA 在 IFA 2026 點燃在地 AI 火花:RTX Spark 電腦與效能優化登場NVIDIA Blog·
  9. 009Nvidia 推出免費工具 PAIR:整合閒置電腦,打造個人 AI 運算中心The Verge AI·
  10. 010搭上 AI 熱潮:出租閒置算力賺取被動收入IEEE Spectrum AI·
  11. 011Fal H3 Max Live 實現超即時影像生成,打破無限視訊生成障礙Latent Space·
  12. 012Hugging Face 推出 @huggingface/kernels:加速瀏覽器本地 AI 推論的 WebGPU 核心函式庫Hugging Face Blog·
  13. 013OpenAI 自研晶片「Jalapeño」推論效能超車 Nvidia Blackwell 與 RubinThe Decoder·
  14. 014Accel 投資 Keenable,為 AI 代理打造專屬網路索引TechCrunch AI·
  15. 015Nvidia 推出 Groq 3 LPX,宣稱 AI 推論速度領先 Cerebras,但實際比較有待商榷The Decoder·
  16. 016OpenAI 的 AI 運算策略:打造豐沛智慧的完整堆疊OpenAI Blog·
  17. 017OpenAI 自研 Jalapeño 晶片首測:AI 推論速度與效率領先業界OpenAI Blog·
  18. 018吳恩達重塑 DeepLearning.AI,聚焦 AI 工程師四大核心技能Latent Space·
  19. 019Nvidia 宣布 Groq 低延遲 AI 推論機櫃今年上線CNBC Tech·
  20. 020輝達 Groq 3 LPX 全面量產,Vera Rubin 平台強化 AI 代理推論能力NVIDIA Blog·
  21. 021AI 硬體新創 Etched 估值一個月內翻倍至 210 億美元TechCrunch AI·
  22. 022Groq 募資 3.5 億美元,轉型 AI 推論雲端服務供應商TechCrunch AI·
  23. 023Kog 深入挖掘 GPU 潛力,大幅加速 AI 推論TechCrunch AI·
  24. 024OpenAI 預覽 Ultrafast 模式:GPT-5.6 Sol 推論速度提升 14 倍OpenAI Blog·
  25. 025AI 代理記憶新解方:ALTK-Evolve 以更少 Token 實現高效能Hugging Face Blog·
  26. 026AI 產業週報:AMD 併購 Taalas、Meta 模型突破與 OpenAI 產品更新Latent Space·
  27. 027Baseten 正式成為 Hugging Face 推論服務供應商,擴展無伺服器 AI 功能Hugging Face Blog·
  28. 028MacPaw 攜手 Liquid AI,為其應用程式商店提供裝置端 AI 推論技術TechCrunch AI·
  29. 029巨型核心已死,巨型核心又活了:AI 推論工程的最新辯論與進展Latent Space·
  30. 030LFM2.5-2.6B:輕量級 AI 代理模型,實現裝置端部署Hugging Face Blog·
  31. 031EvoLib:讓 AI 從經驗中學習,知識持續演進Microsoft Research·
  32. 032GPT-5.6 系列:兼顧頂尖智慧與卓越效率的突破OpenAI Blog·
  33. 033OlmoEarth 平台:實現行星級地理空間 AI 推論Hugging Face Blog·
  34. 034輝達 Spectrum-6 網路系統問世,助攻巨量級 AI 工廠NVIDIA Blog·
  35. 035NVIDIA Nemotron 3 Ultra 結合 LangChain Deep Agents 實現領先效能與成本效益NVIDIA Blog·
  36. 036法國 AI 新創 ZML 釋出免費工具,優化多種 AI 晶片推論速度TechCrunch AI·
  37. 037AI 晶片公司 SambaNova 再獲 10 億美元融資,估值達 110 億美元TechCrunch AI·
  38. 038AI成本趨近於零:智慧代理人如何重塑資料系統BAIR Blog (Berkeley AI)·
  39. 039AI 產業前沿:Fable 5 應用、騰訊 Hy3 開源與 Anthropic J-Space 研究Latent Space·
  40. 040AI用電波動劇烈,電網穩定性備受考驗IEEE Spectrum AI·
  41. 041AI 產業速覽:Fable 5 重啟、開源模型進展與代理應用新趨勢Latent Space·
  42. 042Hugging Face 攜手 Cerebras 實現 Gemma 4 即時語音 AIHugging Face Blog·
  43. 043輝達推論軟體堆疊:實現最低 AI 運算成本的關鍵NVIDIA Blog·
  44. 044Firefly Aerospace 首次在月球軌道運行 NVIDIA Jetson 邊緣 AI 平台NVIDIA Blog·
  45. 045Databricks 前 AI 主管新創公司 Unconventional AI,目標將 AI 功耗降低千倍TechCrunch AI·
  46. 046OpenAI 攜手 Broadcom 發表 LLM 推論晶片,強化 AI 基礎設施OpenAI Blog·
  47. 047NVIDIA 機密運算技術擴展 Apple 私有雲運算,強化 AI 隱私與安全NVIDIA Blog·
  48. 048Anthropic 啟動上市程序,共同創辦人 Amodei 駁斥 AI 投資報酬率疑慮TechCrunch AI·
  49. 049NVIDIA Nemotron 3.5 內容安全:為全球企業 AI 打造可自訂的多模態防護Hugging Face Blog·
  50. 050透過「戰艦」遊戲,AI 代理學會更有效提問MIT News (AI)·
  51. 051量子運算幕後推手:古典技術的關鍵進展IEEE Spectrum AI·
  52. 052JetBrains 推出 Mellum2:高效能 12B 專家混合模型Hugging Face Blog·
  53. 053NVIDIA AI雲端生態系全球擴展,滿足AI運算強勁需求NVIDIA Blog·
  54. 054自適應平行推理:高效推論擴展的未來典範BAIR Blog (Berkeley AI)·
  55. 055OpenAI 發表即時語音模型,讓對話 AI 擁有 GPT-5 級推論力The Decoder·
  56. 056AI推論時代來臨:運算資源與代理模型發展新趨勢Latent Space·
  57. 057AI 科技速報:推論系統、開源模型與代理應用新突破Latent Space·
  58. 058DeepInfra 進駐 Hugging Face 推論服務Hugging Face Blog·
  59. 059GitHub Copilot 調整計費方式:依實際 AI 用量收費Ars Technica AI·
  60. 060Google Simula:以機制設計與第一性原理,打造真實世界合成資料集Google Research·