「大型語言模型」
80 results- 001AI 代理聲稱完成任務,資料庫卻不同意:微軟 ThinkingBox 揭露 LLM 代理的可靠性挑戰Hugging Face Blog·Hugging Face Blog商業Business
- 002開源樂高 AI 生成器:用大型語言模型打造積木模型Hacker News (Show HN)·Hacker News (Show HN)AI 自動化Automation
- 003LLM 知識圖譜與向量 RAG:應用場景與選擇指南n8n Blog·n8n Blog商業Business
- 004Olmo-core 3 全新發布:專為大型 MoE 模型打造的開放式可擴展訓練架構Hugging Face Blog·Hugging Face Blog產品Product
- 005AI 報告分析自動化:程式碼計算數據,LLM 負責解釋,事實查核防堵虛構數字n8n Community·n8n CommunityAI 自動化Automation
- 006AI 代理人將大舉進駐職場,人類還沒準備好Wired AI·Wired AI商業Business
- 007AI 學習新途徑:從遊戲數據掌握物理世界Wired AI·Wired AI商業Business
- 008像物理學家一樣修剪大型語言模型:區塊移除的伊辛最佳化方法Hugging Face Blog·Hugging Face Blog研究Research
- 009應對AI衝擊:未來職場或將出現「機器人關係」部門CNBC Tech·CNBC Tech商業Business
- 010PrismML 推出迷你 LLM,有望徹底改變 AI 應用模式TechCrunch AI·TechCrunch AI產品Product
- 011研究發現:AI浮水印改變大型語言模型對有害提示詞的回應方式Ars Technica AI·Ars Technica AI研究Research
- 012AI 產業轉向悲觀:下一步何去何從?MIT Technology Review AI·MIT Technology Review AI觀點Opinion
- 013OpenAI 發表自研 AI 晶片 Jalapeño:LLM 助攻設計,大幅縮短開發時程IEEE Spectrum AI·IEEE Spectrum AI產品Product
- 014OpenAI 代理程式五月曾攻擊 RubyGems,卻未對外揭露Simon Willison·Simon Willison商業Business
- 015ToolGrad:以「文字梯度」高效生成工具使用資料集Google Research·Google Research研究Research
- 016大型語言模型安全對齊新策略:精準拒絕有害子集,而非整個主題Hugging Face Blog·Hugging Face Blog研究Research
- 017OpenAI 推出 GPT-6 Astra:新一代模型挑戰 Claude Fable,安全與長上下文能力領先Simon Willison·Simon Willison產品Product
- 018BenchMIRT:剖析大型語言模型基準測試的潛在能力Hugging Face Blog·Hugging Face Blog研究Research
- 019Walter Torous 獲任麻省理工房地產中心執行董事,將強化 AI 課程MIT News (AI)·MIT News (AI)其他Other
- 020OpenAI Astra 模型將問世,展現強大網路安全突破能力TechCrunch AI·TechCrunch AI產品Product
- 021讓AI聊天機器人跑在你的電腦上:本機執行指南Wired AI·Wired AI教學Tutorial
- 022AI 產業快訊:OpenAI 預計 2026 年達成 AGI,多項 AI 產品與安全議題受關注Latent Space·Latent Space其他Other
- 023NVIDIA 斥資 130 億美元收購 HuggingFace;Z.ai 發表 GLM-5.3-Flash 模型Latent Space·Latent Space產品Product
- 024QueryStory 運用 AI 彌補企業數據分析的信任鴻溝TechCrunch AI·TechCrunch AI商業Business
- 025AgentHands:XR 環境中 AI 助理的空間定位互動手勢Google Research·Google Research研究Research
- 026OpenAI 自研晶片「Jalapeño」推論效能超車 Nvidia Blackwell 與 RubinThe Decoder·The Decoder產品Product
- 027IBM Granite 4.2 LLM:深度解析其建構與訓練策略Hugging Face Blog·Hugging Face Blog產品Product
- 028AI 近三月回顧:模型失控、網路安全與政府監管Last Week in AI·Last Week in AI商業Business
- 029QAH:4位元壓縮模型效能超越原始全精度版本Hugging Face Blog·Hugging Face Blog研究Research
- 030自駕車將能「聽懂」乘客指令,客製化駕駛風格IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 031兒童語言學習效率遠勝 AI:科學家仍未解開謎團MIT Technology Review AI·MIT Technology Review AI研究Research
- 032AI 代理的演進:模型與框架的共生關係Latent Space·Latent Space觀點Opinion
- 033LFM2.5-DSpark 提升大型語言模型推論速度最高達 3.2 倍Hugging Face Blog·Hugging Face Blog產品Product
- 034Grok 驚傳安全漏洞:加密指令可繞過防護竊取用戶資料Ars Technica AI·Ars Technica AI研究Research
- 035模型路由成企業AI部署新顯學:高昂成本與開源模型普及推動需求Latent Space·Latent Space商業Business
- 036AI 硬體新創 Etched 估值一個月內翻倍至 210 億美元TechCrunch AI·TechCrunch AI商業Business
- 037Anthropic 揭露 Claude 隱形文字浮水印運作原理The Verge AI·The Verge AI產品Product
- 038Qwen 3.8 27B:強大開源模型,預設「過度思考」成效能瓶頸Simon Willison·Simon Willison產品Product
- 039中國四英尺高機器人成新一代網紅Wired AI·Wired AI產品Product
- 040Kog 深入挖掘 GPU 潛力,大幅加速 AI 推論TechCrunch AI·TechCrunch AI產品Product
- 041MindTopo:揭露多模態模型拓撲空間推理的挑戰Microsoft Research·Microsoft Research研究Research
- 042書商示警:AI 公司疑為訓練模型收購並銷毀珍稀書籍Ars Technica AI·Ars Technica AI商業Business
- 043大型語言模型的事實性瓶頸:知識召回才是關鍵Google Research·Google Research研究Research
- 044Accel 印度基金超額認購 5.5 億美元,押注 AI 驅動新創浪潮TechCrunch AI·TechCrunch AI商業Business
- 045AI 學術研究新格局:教授們如何應對產業巨頭挑戰MIT Technology Review AI·MIT Technology Review AI觀點Opinion
- 046福特推出全新 AI 助理,可查詢油量與胎壓The Verge AI·The Verge AI產品Product
- 047Hugging Face 推出高效知識蒸餾技術:大幅降低大型語言模型訓練成本Hugging Face Blog·Hugging Face Blog研究Research
- 048LLM新紀元:新創公司挑戰Transformer極限,競逐下一代核心技術MIT Technology Review AI·MIT Technology Review AI商業Business
- 049AI 家教何時該出手?TutorMoments 評估大型語言模型輔導的「分寸」Hugging Face Blog·Hugging Face Blog研究Research
- 050當紅「AI 聊天機器人」ChatTJB 爆紅:背後竟是真人回覆Wired AI·Wired AI觀點Opinion
- 051Baseten 正式成為 Hugging Face 推論服務供應商,擴展無伺服器 AI 功能Hugging Face Blog·Hugging Face Blog產品Product
- 052Reddit 導入 AI 版主工具「Rules Hub」並收緊 API 政策The Verge AI·The Verge AI產品Product
- 053AI 安全拉警報:模型脫韁失控危機The Verge AI·The Verge AI觀點Opinion
- 054Science One Framework:透過證據鏈實現可驗證的自主研究Google Research·Google Research研究Research
- 055EvoLib:讓 AI 從經驗中學習,知識持續演進Microsoft Research·Microsoft Research研究Research
- 056AI 模型是否過度運算?無權重神經網路有望大幅提升效率IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 057AI 代理重振本體論:語義網概念在 AI 時代的復興Latent Space·Latent Space觀點Opinion
- 058大型語言模型存在根本缺陷,極易遭受攻擊MIT Technology Review AI·MIT Technology Review AI研究Research
- 059對抗AI寫作浪潮:作家們正形塑「反AI文學次文化」Wired AI·Wired AI觀點Opinion
- 060ChatGPT 限制模仿作家風格的內容生成請求Ars Technica AI·Ars Technica AI產品Product
- 061ABBEL:透過信念狀態更新,提升大型語言模型長程互動效率BAIR Blog (Berkeley AI)·BAIR Blog (Berkeley AI)研究Research
- 062Anthropic 發表 Opus 5 模型:效能更優、限制更少、價格更親民TechCrunch AI·TechCrunch AI產品Product
- 063NASA 將 Google Gemma 大型語言模型送上軌道IEEE Spectrum AI·IEEE Spectrum AI產品Product
- 064中國 GLM 5.2 AI 模型:程式碼生成更經濟,挑戰美國領先地位IEEE Spectrum AI·IEEE Spectrum AI產品Product
- 065美軍AI代幣消耗過快,使用量遭限制Wired AI·Wired AI商業Business
- 066開源模型崛起:OpenAI為何擔憂?美國政府應如何應對?TechCrunch AI·TechCrunch AI商業Business
- 067AI 程式開發:超越傳統搜尋,上下文引擎如何提升效率與品質Ars Technica AI·Ars Technica AI產品Product
- 068AI 招募系統比人類更容易產生偏見MIT Technology Review AI·MIT Technology Review AI研究Research
- 069AI文字偵測器遇風格模仿寫作,辨識能力大打折扣The Decoder·The Decoder研究Research
- 070提示詞注入攻擊逆轉勝:研究員利用「上下文轟炸」癱瘓 AI 駭客代理Wired AI·Wired AI研究Research
- 071五角大廈AI新策略:速度優先,不完美對齊風險次之The Decoder·The Decoder其他Other
- 072OpenAI 打造 LLM 超級駭客 GPT-Red,大幅提升模型安全性MIT Technology Review AI·MIT Technology Review AI產品Product
- 073Claude 網頁抓取工具驚傳漏洞:用戶隱私資料恐遭外洩Simon Willison·Simon Willison產品Product
- 074我如何將 AI 導向黑暗面:大型語言模型安全漏洞揭秘IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 075Anthropic新研究揭示AI模型「內部思緒」:J-space的發現與意涵MIT Technology Review AI·MIT Technology Review AI研究Research
- 076提示詞注入成防禦新策略,AI 資安攻防戰升級Ars Technica AI·Ars Technica AI研究Research
- 077AI世界模型:模擬真實世界的潛力與挑戰Ars Technica AI·Ars Technica AI商業Business
- 078打造通用機器人AI基礎堆疊:X Square Robot的創新策略IEEE Spectrum AI·IEEE Spectrum AI產品Product
- 079AI 代理在《殺戮尖塔 2》中表現優異:結構化記憶解決上下文膨脹問題The Decoder·The Decoder研究Research
- 080ChatGPT 入門指南OpenAI Blog·OpenAI Blog教學Tutorial