跳到主要內容
maxstudioNews
Search the archive

Search

「Transformer」

21 results
  1. 001Hugging Face Transformers 整合 llama.cpp GGUF 格式,筆電也能高效運行 AI 模型Hugging Face Blog·
  2. 002Hugging Face 延攬 oMLX 創作者 Jun Kim,強化 MLX 社群支援Hugging Face Blog·
  3. 003像物理學家一樣修剪大型語言模型:區塊移除的伊辛最佳化方法Hugging Face Blog·
  4. 004NeoMME:高效多模態原生、多語言編碼器,提升視覺文件檢索效能Hugging Face Blog·
  5. 005使用 Sentence Transformers 訓練與微調多向量嵌入模型Hugging Face Blog·
  6. 006Sentence Transformers 6.0 支援多向量嵌入模型,大幅提升檢索效能Hugging Face Blog·
  7. 007LLM新紀元:新創公司挑戰Transformer極限,競逐下一代核心技術MIT Technology Review AI·
  8. 008蘋果 Siri 表情語音:記憶體高效音訊合成新架構Apple Machine Learning Research·
  9. 009vLLM Transformers 模型後端實現原生速度Hugging Face Blog·
  10. 010DiScoFormer:單一 Transformer 模型,跨分佈估計密度與分數Hugging Face Blog·
  11. 011混合模型在哪些詞元預測上更具優勢?Hugging Face Blog·
  12. 012運用 NVIDIA NeMo AutoModel 大幅加速 Transformer 模型微調Hugging Face Blog·
  13. 013Transformers.js 導入跨來源儲存 API:優化網頁 AI 模型載入體驗Hugging Face Blog·
  14. 014IEEE 推出大型語言模型線上課程,助工程師掌握 AI 核心技術IEEE Spectrum AI·
  15. 015新創公司Subquadratic聲稱突破大型語言模型瓶頸MIT Technology Review AI·
  16. 016輝達RTX Spark超級晶片登陸韓國網咖,攜手KRAFTON、NC與電競冠軍T1共襄盛舉NVIDIA Blog·
  17. 017xLSTM 架構重磅回歸:深度解析與潛力探討The Sequence·
  18. 018Apple 機器學習新突破:隨機 KV 路由,深度優化 Transformer 模型快取記憶體Apple Machine Learning Research·
  19. 019NVIDIA 推出 Nemotron 3 Nano Omni:長上下文多模態智慧,賦能文件、音訊與視訊代理Hugging Face Blog·
  20. 020循環神經網路意外復興:挑戰 Transformer 的高效替代方案The Sequence·
  21. 021Jay Alammar 部落格遷往 Substack 平台Jay Alammar·