跳到主要內容
maxstudioNews
Search the archive

Search

「準確性」

54 results
  1. 001ProvenanceGuard:為多工具 LLM 代理提供來源感知的事實驗證Hugging Face Blog·
  2. 002OpenAI 推出 GPT-6.1 Sol:兼具 Astra 級智慧與低成本OpenAI Blog·
  3. 003美國防部斥資三千萬美元,欲打造 AI 測謊系統MIT Technology Review AI·
  4. 004OpenAI 發表 GPT-6 Sol 與 Luna:成本減半,錯誤率更低TechCrunch AI·
  5. 005美墨邊境「虛擬圍牆」死亡地圖:我們如何繪製首份全面分析報告MIT Technology Review AI·
  6. 006V7 Go 平台:賦予 AI 代理人企業級記憶,加速關鍵業務流程OpenAI Blog·
  7. 007騰訊 Gander AI 模型:邊聊邊工作,實現全雙工對話The Decoder·
  8. 008Clearview AI 測試 AI 工具,助警方深挖個人網路足跡Wired AI·
  9. 009OpenAI 推出 GPT-6 Astra:新一代企業級 AI 智慧模型,賦能專業工作OpenAI Blog·
  10. 010Google WeatherNext 3 革命性登場:告別物理模擬,AI 直取衛星數據預測天氣The Decoder·
  11. 011跨族群基因預測的轉移學習:探討在非歐洲族群中的表現Google Research·
  12. 012Legora 運用 GPT-6 Astra,數分鐘內完成 41 份文件審閱OpenAI Blog·
  13. 013AI 偵測工具 Pangram 崛起:出版界新標準,卻引發信任危機Wired AI·
  14. 014哈佛輟學生創立 Blue Voice,募資 600 萬美元打造「警界 Harvey」AI 助理TechCrunch AI·
  15. 015Agent Seer:從工具規格自動生成 AI 代理測試情境Apple Machine Learning Research·
  16. 016血糖監測基礎模型 GlucoFM:Google AI 提升代謝健康預測能力Google Research·
  17. 017AI不會取代放射科醫師,但將徹底改變他們的工作Ars Technica AI·
  18. 018QAH:4位元壓縮模型效能超越原始全精度版本Hugging Face Blog·
  19. 019運用移動數據,AI 模型提升對實體地點的理解Google Research·
  20. 020AI 編碼工具 Cursor 併入 SpaceXAI,加速軟體工程發展Latent Space·
  21. 021Google DeepMind 推出 Gemini 3.7 Flash:更智慧的程式碼與代理模型Google DeepMind·
  22. 022微軟 CARE-X:整合多重技術,打造臨床實用放射學 VLMMicrosoft Research·
  23. 023AI 偵測工具引發信任危機The Verge AI·
  24. 024DeepMind AI 模型 WeatherNext 提前一天預測颶風,準確度超越現有技術Wired AI·
  25. 025AI 咽喉影像分析系統 Nodoca:簡化例行檢查,加速流感診斷Wired AI·
  26. 026醫療AI輔助效益因人而異:專家與非專家反應大不同MIT News (AI)·
  27. 027AI 模型是否過度運算?無權重神經網路有望大幅提升效率IEEE Spectrum AI·
  28. 028Anthropic Claude Opus 5 效能超越 Fable 5,價格更具競爭力The Decoder·
  29. 029SymptomAI:對話式 AI 代理在日常症狀評估中的應用與潛力Google Research·
  30. 030OpenAI 推出 Presence:企業級 AI 代理部署解決方案OpenAI Blog·
  31. 031AI 判讀 X 光片:錯誤卻自信滿滿,潛藏醫療風險The Decoder·
  32. 032Nemotron Labs:開放模型賦能企業與國家,打造可信賴、可控、客製化的 AINVIDIA Blog·
  33. 033丹麥科學家結合 AI 與量子運算,突破性生成新胜肽加速藥物開發Wired AI·
  34. 034百度「無限 OCR」:借鑑人類記憶機制,高效處理多頁文件The Decoder·
  35. 035開源工具 pxpipe 透過 PNG 圖像壓縮,為 Claude Code 和 Fable 5 節省高達 70% 的代幣成本The Decoder·
  36. 036英國警方打造龐大AI犯罪預測系統,部分結果卻不可信Wired AI·
  37. 037Snowflake 測試揭示:GLM-5.2 表現媲美 Opus 4.7,成本卻大幅領先The Decoder·
  38. 038LLM 的記憶解鎖術:推理如何喚醒潛藏知識Google Research·
  39. 039PP-OCRv6 於 Hugging Face 登場:輕量級多語言 OCR 模型家族全面升級Hugging Face Blog·
  40. 040ChatGPT 健康資訊處理能力再升級OpenAI Blog·
  41. 041Google Gemini Enterprise Agent Platform 推出代理式 RAG,確保回應可靠性Google Research·
  42. 042透過「戰艦」遊戲,AI 代理學會更有效提問MIT News (AI)·
  43. 043前高盛、Meta 人才創 AethexAI,獲 300 萬美元募資,專攻非洲與中東在地化語音 AI 客服TechCrunch AI·
  44. 044Perplexity CEO 揭示 AI 競賽決勝關鍵:能源效率與經濟價值CNBC Tech·
  45. 045OpenAI Codex獲知識工作者青睞,應用超越開發者Axios·
  46. 046AI 洞察化學原理:MIT 教授引領藥物開發新紀元MIT News (AI)·
  47. 047Anthropic Mythos 模型重塑 Firefox 資安防禦,效率驚人TechCrunch AI·
  48. 048OpenAI 宣布 ChatGPT 新預設模型大幅降低「幻覺」問題The Verge AI·
  49. 049ChatGPT 預設模型升級:GPT-5.5 Instant 帶來更智慧、清晰、客製化的體驗OpenAI Blog·
  50. 050AI 急診診斷勝人類醫生:哈佛研究揭示大型語言模型潛力TechCrunch AI·
  51. 051研究:AI 模型過度友善恐犧牲準確性Ars Technica AI·
  52. 052微軟 Word 整合 AI 法律助理,革新合約審閱流程The Decoder·
  53. 053SPEX 與 ProxySPEX:大規模解讀大型語言模型互動BAIR Blog (Berkeley AI)·
  54. 054大型語言模型產品評估:三步驟加速開發與迭代Eugene Yan·