「模型評估」
8 results- 001英國AI安全研究院與EvalEval攜手,提升AI基準測試結果的可重現性Hugging Face Blog·Hugging Face Blog研究Research
- 002Google DeepMind 成立新機構,深化通用人工智慧(AGI)辯論TechCrunch AI·TechCrunch AI觀點Opinion
- 003Paul Christiano 加入 OpenAI 基金會董事會,強化 AI 安全治理OpenAI Blog·OpenAI Blog商業Business
- 004AI 模擬時代:10% 較差,100 倍便宜,10000 倍快,為何它正席捲一切?Latent Space·Latent Space觀點Opinion
- 005Claude Opus 5 登場:效能超越 Fable?基準測試引發熱議Latent Space·Latent Space產品Product
- 006OpenAI 與 Hugging Face 聯手處理模型評估期間的資安事件OpenAI Blog·OpenAI Blog商業Business
- 007Hugging Face 整合 Every Eval Ever 評估結果,提升模型透明度與可信度Hugging Face Blog·Hugging Face Blog產品Product
- 008AI評估成本飆升,成為運算新瓶頸Hugging Face Blog·Hugging Face Blog商業Business