「可靠性」
46 results- 001AI 代理聲稱完成任務,資料庫卻不同意:微軟 ThinkingBox 揭露 LLM 代理的可靠性挑戰Hugging Face Blog·Hugging Face Blog商業Business
- 002為 AI 代理設定「防護牆」與「技能」,提升開發效率與可靠性DEV Community (Codex)·DEV Community (Codex)AI 自動化Automation
- 003ProvenanceGuard:為多工具 LLM 代理提供來源感知的事實驗證Hugging Face Blog·Hugging Face Blog研究Research
- 004特斯拉 Optimus 機器人訓練卡關:員工憂被取代拒絕配合,AI 能力與供應鏈挑戰待解Ars Technica AI·Ars Technica AI產品Product
- 005NVIDIA 驗證工程師 Sakeena Fiza:確保 AI 硬體大規模成功的幕後推手NVIDIA Blog·NVIDIA Blog商業Business
- 006Google 產品副總 Robby Stein 將登 TechCrunch Disrupt 2026,剖析產品規模化與 AI 挑戰TechCrunch AI·TechCrunch AI商業Business
- 007OpenAI 推出 AI 失準揭露框架,揭示模型曾嘗試「越獄」Wired AI·Wired AI商業Business
- 008AI時代的材料基石:先進材料如何推動人工智慧發展MIT Technology Review AI·MIT Technology Review AI商業Business
- 009AI 代理的可靠性挑戰:一次成功,下次還能嗎?Hugging Face Blog·Hugging Face Blog研究Research
- 010AIUC 獲 5500 萬美元融資,推 AI 代理安全審計防範失控風險TechCrunch AI·TechCrunch AI商業Business
- 011OpenAI 稱 AI 研究助理已達標,但內部專家憂心發展失控The Decoder·The Decoder研究Research
- 012Legora 運用 GPT-6 Astra,數分鐘內完成 41 份文件審閱OpenAI Blog·OpenAI Blog商業Business
- 013WIRED 揭露 Flock 警用 AI 搜尋工具:功能、爭議與隱私疑慮Wired AI·Wired AI產品Product
- 014Hugging Face 服務如何強化 Papers with Code 的 AI 研究搜尋功能Hugging Face Blog·Hugging Face Blog產品Product
- 015Alexander Rakhlin 獲任麻省理工統計與資料科學中心主任MIT News (AI)·MIT News (AI)商業Business
- 016AI 代理重振本體論:語義網概念在 AI 時代的復興Latent Space·Latent Space觀點Opinion
- 017OpenAI稱Hugging Face攻擊「前所未有」,但這並非首次MIT Technology Review AI·MIT Technology Review AI觀點Opinion
- 018AI 驅動藥物開發:資料閉環的挑戰與未來展望MIT Technology Review AI·MIT Technology Review AI商業Business
- 019離網資料中心難解AI擴張困境,面臨在地反彈與可靠性挑戰Axios·Axios商業Business
- 020長週期模型安全挑戰與對齊策略OpenAI Blog·OpenAI Blog研究Research
- 021AI 時代的效益評估指標OpenAI Blog·OpenAI Blog觀點Opinion
- 022企業AI代理評估落差:信任不足卻仍加速部署VentureBeat AI·VentureBeat AI商業Business
- 023從 Shippy 專案學習:打造高可靠性 AI 代理的關鍵洞察Hugging Face Blog·Hugging Face Blog產品Product
- 024企業擴展 AI 規模的四大關鍵架構要素MIT Technology Review AI·MIT Technology Review AI商業Business
- 025SkillOpt:將 AI 代理技能轉化為可訓練參數,提升可靠性Microsoft Research·Microsoft Research研究Research
- 026AI 系統的必然趨勢:專業化才是王道Hugging Face Blog·Hugging Face Blog觀點Opinion
- 027Patronus AI 獲 5000 萬美元融資,建構虛擬環境強化 AI 代理可靠性TechCrunch AI·TechCrunch AI商業Business
- 028NVIDIA Blackwell 平台橫掃 MLPerf Training 6.0:最快、最大、最強NVIDIA Blog·NVIDIA Blog產品Product
- 029NVIDIA Halos OS 強化自駕計程車安全:從設計源頭確保可靠性NVIDIA Blog·NVIDIA Blog產品Product
- 030Google Gemini Enterprise Agent Platform 推出代理式 RAG,確保回應可靠性Google Research·Google Research產品Product
- 031Hugging Face CLI 專為 AI 代理優化:Hub 互動更高效Hugging Face Blog·Hugging Face Blog產品Product
- 032Claude Opus 4.8 深度解析:代理模型可靠性與效率再進化The Sequence·The Sequence產品Product
- 033ZeroDrift 募資千萬美元,為 AI 模型打造合規防護網TechCrunch AI·TechCrunch AI商業Business
- 034晶片設計師的業界之路:學術與實務的成功轉型IEEE Spectrum AI·IEEE Spectrum AI觀點Opinion
- 035ITBench-AA 基準測試揭示:頂尖 AI 模型在企業 IT 代理任務中表現未達五成Hugging Face Blog·Hugging Face Blog研究Research
- 036微軟研究:AI 長期委派任務的可靠性挑戰與展望Microsoft Research·Microsoft Research研究Research
- 037自適應平行推理:高效推論擴展的未來典範BAIR Blog (Berkeley AI)·BAIR Blog (Berkeley AI)研究Research
- 038Mozilla 運用 AI 偵測 Firefox 漏洞,誤報率近乎為零Ars Technica AI·Ars Technica AI產品Product
- 039Parloa 打造 AI 客服代理,提升客戶互動體驗OpenAI Blog·OpenAI Blog產品Product
- 040Anthropic 升級 Claude 代理平台:導入「夢境」功能,AI 代理可從錯誤中學習並協同作業The Decoder·The Decoder產品Product
- 041OpenAI 攜手科技巨頭推出 MRC 協定,突破 AI 超級電腦瓶頸The Decoder·The Decoder產品Product
- 042Scale AI 執行長強調 AI 可靠性是企業導入關鍵Axios·Axios商業Business
- 043大型語言模型多代理系統失敗歸因:PSU與杜克大學開創自動化診斷Synced Review·Synced Review研究Research
- 044多代理系統故障診斷新突破:自動化歸因方法與基準測試Synced Review·Synced Review研究Research
- 045Meta AI 強化先進模型安全框架與測試機制Meta AI Blog·Meta AI Blog產品Product
- 046Meta AI 助匹茲堡大學改造輔助機器人,提升使用者獨立性Meta AI Blog·Meta AI Blog產品Product