「參數」
42 results- 001輝達 DGX Spark 推出 64GB 版本,助開發者輕鬆建構與擴展在地 AINVIDIA Blog·NVIDIA Blog產品Product
- 002Olmo-core 3 全新發布:專為大型 MoE 模型打造的開放式可擴展訓練架構Hugging Face Blog·Hugging Face Blog產品Product
- 003NVIDIA Nemotron 3 Diarization:即時多說話者 AI 語音分離,精準辨識對話者Hugging Face Blog·Hugging Face Blog產品Product
- 004AllSpark 發表 Iris-mini 與 Iris-pro:同級最強開源搜尋代理模型The Decoder·The Decoder研究Research
- 005IBM 發表 Granite Time Series PatchTST-FM-r2 模型:領先業界的零樣本預測,支援商業應用Hugging Face Blog·Hugging Face Blog產品Product
- 006百步 GRPO 微調 3.5 億參數模型,顯著提升結構化輸出能力Hugging Face Blog·Hugging Face Blog教學Tutorial
- 007Agent Seer:從工具規格自動生成 AI 代理測試情境Apple Machine Learning Research·Apple Machine Learning Research研究Research
- 008Inherent AI 代理 Faraday 展現驚人實力:小模型在研究重現任務擊敗 Anthropic 與 OpenAITechCrunch AI·TechCrunch AI商業Business
- 009參數時代終結?Z.ai CEO 唐傑談 GLM 5.3 與後訓練縮放法則Latent Space·Latent Space商業Business
- 010Microsoft Copilot 驚傳資安漏洞:未公開參數與記憶體中毒恐洩個資Ars Technica AI·Ars Technica AI產品Product
- 011OlmoEarth Studio 推出嵌入向量匯出:加速地球觀測資料分析Hugging Face Blog·Hugging Face Blog產品Product
- 012Meta 發表 Glimmer AI 模型,勾勒祖克柏的個人智慧願景TechCrunch AI·TechCrunch AI產品Product
- 013Meta 推出 Muse Glimmer:在地化、代理式、多模態開源模型Hugging Face Blog·Hugging Face Blog產品Product
- 014光學技術突破:機器人AI模型即時更新,大幅降低能耗IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 015AI 強化學習讓量子電腦邊運算邊校正錯誤Google Research·Google Research研究Research
- 016NVIDIA 推出 Cosmos 3 Edge:為邊緣裝置打造的開放世界模型Hugging Face Blog·Hugging Face Blog產品Product
- 017Kimi K3 重磅發布:2.8 兆參數開源模型問世,性能媲美 Opus 4.8 且價格具競爭力Latent Space·Latent Space產品Product
- 018Kimi 發表 K3 模型:性能逼近 GPT-5.6 Sol 與 Fable 5,中國 AI 價格戰時代終結The Decoder·The Decoder產品Product
- 019Mira Murati 實驗室推出開源多模態模型 InklingSimon Willison·Simon Willison產品Product
- 020Thinking Machines Lab 推出 Inkling:975B 多模態開源模型,樹立美國新標竿Latent Space·Latent Space產品Product
- 021Thinking Machines Lab 發表首款模型 Inkling,主打開源與多模態能力Wired AI·Wired AI產品Product
- 022Thinking Machines 推出首款開源模型 Inkling,押注客製化 AI 優於通用型TechCrunch AI·TechCrunch AI產品Product
- 023微軟 Flint:專為 AI 打造的視覺化語言,簡化圖表生成Microsoft Research·Microsoft Research產品Product
- 024Anthropic 推出 Claude Sonnet 5:效能提升但實際成本恐增加Simon Willison·Simon Willison產品Product
- 025SkillOpt:將 AI 代理技能轉化為可訓練參數,提升可靠性Microsoft Research·Microsoft Research研究Research
- 026Google 推出 TabFM:表格資料的零樣本基礎模型Google Research·Google Research產品Product
- 027新浪VibeThinker-3B模型:小模型推理能力驚人,知識儲存仍是挑戰The Decoder·The Decoder研究Research
- 028LLM 的記憶解鎖術:推理如何喚醒潛藏知識Google Research·Google Research研究Research
- 029PP-OCRv6 於 Hugging Face 登場:輕量級多語言 OCR 模型家族全面升級Hugging Face Blog·Hugging Face Blog產品Product
- 030超越 LoRA:參數高效微調技術還有哪些選擇?Hugging Face Blog·Hugging Face Blog研究Research
- 031GLM-5.2 橫空出世:最強純文字開源大型語言模型問世Simon Willison·Simon Willison產品Product
- 032Microsoft Copilot 驚傳嚴重漏洞,駭客可竊取雙重驗證碼與敏感資料Ars Technica AI·Ars Technica AI產品Product
- 033Google DeepMind 推出 DiffusionGemma:文字生成速度飆升四倍Google DeepMind·Google DeepMind產品Product
- 034Cohere 發表 North Mini Code:首款專為開發者設計的 AI 模型Hugging Face Blog·Hugging Face Blog產品Product
- 035NVIDIA Nemotron 3.5 ASR 微調攻略:打造專屬多語言語音辨識模型Hugging Face Blog·Hugging Face Blog產品Product
- 036微軟 MAI 模型登場:參數與訓練資料的真相揭露Simon Willison·Simon Willison研究Research
- 037微軟推出 Surface RTX Spark 開發者迷你主機,滿足在地 AI 運算需求The Verge AI·The Verge AI產品Product
- 038JetBrains 推出 Mellum2:高效能 12B 專家混合模型Hugging Face Blog·Hugging Face Blog產品Product
- 039datasette-llm 0.1a7 發布:強化LLM外掛整合Simon Willison·Simon Willison產品Product
- 040Mistral 旗艦模型 Medium 3.5 登場,整合聊天、推理與程式碼能力The Decoder·The Decoder產品Product
- 041新創 Goodfire 推出 Silico 工具,讓 LLM 偵錯與訓練更精準MIT Technology Review AI·MIT Technology Review AI產品Product
- 042強化學習新突破:分而治之策略解決離策略學習擴展性難題BAIR Blog (Berkeley AI)·BAIR Blog (Berkeley AI)研究Research