「推論」
72 results- 001Bitbucket Cloud PR 專用 AI 程式碼審查側邊欄Cursor Forum (Showcase)·Cursor Forum (Showcase)AI 自動化Automation
- 002AI 推論服務商 Modal Labs 傳完成 7.5 億美元巨額融資,估值飆破 150 億美元TechCrunch AI·TechCrunch AI商業Business
- 003Hugging Face 釋出 LFM2.5-VL-DSpark:加速視覺語言模型推論Hugging Face Blog·Hugging Face Blog產品Product
- 004實體 AI 機器人推論卸載:微軟研究揭示效能與續航力新突破Microsoft Research·Microsoft Research研究Research
- 005Hugging Face Transformers 整合 llama.cpp GGUF 格式,筆電也能高效運行 AI 模型Hugging Face Blog·Hugging Face Blog產品Product
- 006突破推論瓶頸:Google Research 透過 Retrieve-for-Train 加速複雜 AI 搜尋Google Research·Google Research研究Research
- 007d-Matrix 整合 NVIDIA NVLink Fusion,推動機架級 XPU 部署NVIDIA Blog·NVIDIA Blog商業Business
- 008AI 時代的記憶體與儲存架構:企業致勝的關鍵策略MIT Technology Review AI·MIT Technology Review AI商業Business
- 009NVIDIA 在 IFA 2026 點燃在地 AI 火花:RTX Spark 電腦與效能優化登場NVIDIA Blog·NVIDIA Blog產品Product
- 010Nvidia 推出免費工具 PAIR:整合閒置電腦,打造個人 AI 運算中心The Verge AI·The Verge AI產品Product
- 011搭上 AI 熱潮:出租閒置算力賺取被動收入IEEE Spectrum AI·IEEE Spectrum AI商業Business
- 012Fal H3 Max Live 實現超即時影像生成,打破無限視訊生成障礙Latent Space·Latent Space產品Product
- 013Hugging Face 推出 @huggingface/kernels:加速瀏覽器本地 AI 推論的 WebGPU 核心函式庫Hugging Face Blog·Hugging Face Blog產品Product
- 014OpenAI 自研晶片「Jalapeño」推論效能超車 Nvidia Blackwell 與 RubinThe Decoder·The Decoder產品Product
- 015Accel 投資 Keenable,為 AI 代理打造專屬網路索引TechCrunch AI·TechCrunch AI商業Business
- 016Nvidia 推出 Groq 3 LPX,宣稱 AI 推論速度領先 Cerebras,但實際比較有待商榷The Decoder·The Decoder產品Product
- 017OpenAI 的 AI 運算策略:打造豐沛智慧的完整堆疊OpenAI Blog·OpenAI Blog商業Business
- 018OpenAI 自研 Jalapeño 晶片首測:AI 推論速度與效率領先業界OpenAI Blog·OpenAI Blog產品Product
- 019吳恩達重塑 DeepLearning.AI,聚焦 AI 工程師四大核心技能Latent Space·Latent Space商業Business
- 020Nvidia 宣布 Groq 低延遲 AI 推論機櫃今年上線CNBC Tech·CNBC Tech產品Product
- 021輝達 Groq 3 LPX 全面量產,Vera Rubin 平台強化 AI 代理推論能力NVIDIA Blog·NVIDIA Blog產品Product
- 022LFM2.5-DSpark 提升大型語言模型推論速度最高達 3.2 倍Hugging Face Blog·Hugging Face Blog產品Product
- 023AI 硬體新創 Etched 估值一個月內翻倍至 210 億美元TechCrunch AI·TechCrunch AI商業Business
- 024Groq 募資 3.5 億美元,轉型 AI 推論雲端服務供應商TechCrunch AI·TechCrunch AI商業Business
- 025Kog 深入挖掘 GPU 潛力,大幅加速 AI 推論TechCrunch AI·TechCrunch AI產品Product
- 026OpenAI 預覽 Ultrafast 模式:GPT-5.6 Sol 推論速度提升 14 倍OpenAI Blog·OpenAI Blog產品Product
- 027AI 代理記憶新解方:ALTK-Evolve 以更少 Token 實現高效能Hugging Face Blog·Hugging Face Blog研究Research
- 028AI 產業週報:AMD 併購 Taalas、Meta 模型突破與 OpenAI 產品更新Latent Space·Latent Space商業Business
- 029Baseten 正式成為 Hugging Face 推論服務供應商,擴展無伺服器 AI 功能Hugging Face Blog·Hugging Face Blog產品Product
- 030MacPaw 攜手 Liquid AI,為其應用程式商店提供裝置端 AI 推論技術TechCrunch AI·TechCrunch AI商業Business
- 031巨型核心已死,巨型核心又活了:AI 推論工程的最新辯論與進展Latent Space·Latent Space其他Other
- 032LFM2.5-2.6B:輕量級 AI 代理模型,實現裝置端部署Hugging Face Blog·Hugging Face Blog產品Product
- 033EvoLib:讓 AI 從經驗中學習,知識持續演進Microsoft Research·Microsoft Research研究Research
- 034GPT-5.6 系列:兼顧頂尖智慧與卓越效率的突破OpenAI Blog·OpenAI Blog產品Product
- 035OlmoEarth 平台:實現行星級地理空間 AI 推論Hugging Face Blog·Hugging Face Blog產品Product
- 036Diffusers 整合 Nunchaku 4 位元推論:加速影像生成並節省記憶體Hugging Face Blog·Hugging Face Blog產品Product
- 037輝達 Spectrum-6 網路系統問世,助攻巨量級 AI 工廠NVIDIA Blog·NVIDIA Blog產品Product
- 038NVIDIA Nemotron 3 Ultra 結合 LangChain Deep Agents 實現領先效能與成本效益NVIDIA Blog·NVIDIA Blog產品Product
- 039法國 AI 新創 ZML 釋出免費工具,優化多種 AI 晶片推論速度TechCrunch AI·TechCrunch AI產品Product
- 040AI 晶片公司 SambaNova 再獲 10 億美元融資,估值達 110 億美元TechCrunch AI·TechCrunch AI商業Business
- 041vLLM Transformers 模型後端實現原生速度Hugging Face Blog·Hugging Face Blog產品Product
- 042AI成本趨近於零:智慧代理人如何重塑資料系統BAIR Blog (Berkeley AI)·BAIR Blog (Berkeley AI)研究Research
- 043AI 產業前沿:Fable 5 應用、騰訊 Hy3 開源與 Anthropic J-Space 研究Latent Space·Latent Space其他Other
- 044AI用電波動劇烈,電網穩定性備受考驗IEEE Spectrum AI·IEEE Spectrum AI商業Business
- 045AI 產業速覽:Fable 5 重啟、開源模型進展與代理應用新趨勢Latent Space·Latent Space商業Business
- 046Hugging Face 攜手 Cerebras 實現 Gemma 4 即時語音 AIHugging Face Blog·Hugging Face Blog產品Product
- 047輝達推論軟體堆疊:實現最低 AI 運算成本的關鍵NVIDIA Blog·NVIDIA Blog產品Product
- 048DiScoFormer:單一 Transformer 模型,跨分佈估計密度與分數Hugging Face Blog·Hugging Face Blog研究Research
- 049Firefly Aerospace 首次在月球軌道運行 NVIDIA Jetson 邊緣 AI 平台NVIDIA Blog·NVIDIA Blog產品Product
- 050Databricks 前 AI 主管新創公司 Unconventional AI,目標將 AI 功耗降低千倍TechCrunch AI·TechCrunch AI商業Business
- 051OpenAI 攜手 Broadcom 發表 LLM 推論晶片,強化 AI 基礎設施OpenAI Blog·OpenAI Blog產品Product
- 052PP-OCRv6 於 Hugging Face 登場:輕量級多語言 OCR 模型家族全面升級Hugging Face Blog·Hugging Face Blog產品Product
- 053Google DeepMind 推出 DiffusionGemma:文字生成速度飆升四倍Google DeepMind·Google DeepMind產品Product
- 054NVIDIA 機密運算技術擴展 Apple 私有雲運算,強化 AI 隱私與安全NVIDIA Blog·NVIDIA Blog產品Product
- 055Anthropic 啟動上市程序,共同創辦人 Amodei 駁斥 AI 投資報酬率疑慮TechCrunch AI·TechCrunch AI商業Business
- 056NVIDIA Nemotron 3.5 內容安全:為全球企業 AI 打造可自訂的多模態防護Hugging Face Blog·Hugging Face Blog產品Product
- 057透過「戰艦」遊戲,AI 代理學會更有效提問MIT News (AI)·MIT News (AI)研究Research
- 058量子運算幕後推手:古典技術的關鍵進展IEEE Spectrum AI·IEEE Spectrum AI產品Product
- 059Holo3.1:快速本地化電腦代理,效能與應用大躍進Hugging Face Blog·Hugging Face Blog產品Product
- 060JetBrains 推出 Mellum2:高效能 12B 專家混合模型Hugging Face Blog·Hugging Face Blog產品Product
- 061NVIDIA AI雲端生態系全球擴展,滿足AI運算強勁需求NVIDIA Blog·NVIDIA Blog產品Product
- 062Hugging Face 推出 Delta Weight Sync:大幅降低非同步強化學習模型同步成本Hugging Face Blog·Hugging Face Blog產品Product
- 063自適應平行推理:高效推論擴展的未來典範BAIR Blog (Berkeley AI)·BAIR Blog (Berkeley AI)研究Research
- 064OpenAI 發表即時語音模型,讓對話 AI 擁有 GPT-5 級推論力The Decoder·The Decoder產品Product
- 065vLLM V0 到 V1 遷移:強化學習訓練的正確性挑戰Hugging Face Blog·Hugging Face Blog產品Product
- 066強化代理:推論時回饋機制優化工具呼叫代理Apple Machine Learning Research·Apple Machine Learning Research研究Research
- 067AI推論時代來臨:運算資源與代理模型發展新趨勢Latent Space·Latent Space產品Product
- 068AI 科技速報:推論系統、開源模型與代理應用新突破Latent Space·Latent Space產品Product
- 069DeepInfra 進駐 Hugging Face 推論服務Hugging Face Blog·Hugging Face Blog產品Product
- 070GitHub Copilot 調整計費方式:依實際 AI 用量收費Ars Technica AI·Ars Technica AI商業Business
- 071循環神經網路意外復興:挑戰 Transformer 的高效替代方案The Sequence·The Sequence研究Research
- 072Google Simula:以機制設計與第一性原理,打造真實世界合成資料集Google Research·Google Research研究Research