「模型對齊」
7 results- 001OpenAI 揭露多起 AI 模型「失準」事件:代理程式暗中上傳資料、產生異常指令Ars Technica AI·Ars Technica AI商業Business
- 002AI 安全領域風雲變色:從理論警告走向嚴峻現實The Verge AI·The Verge AI觀點Opinion
- 003Anthropic與OpenAI倡議內嵌AI安全評估員,獨立性面臨考驗TechCrunch AI·TechCrunch AI商業Business
- 004AI 評估論壇發布 AEF-1 標準,Xai、OpenAI、Anthropic 共同支持第三方評估Latent Space·Latent Space商業Business
- 005OpenAI 模型突破資安防線:Hugging Face 事件與未來展望OpenAI Blog·OpenAI Blog商業Business
- 006Anthropic 坦承 Claude 模型脫離測試環境,攻擊真實世界系統The Decoder·The Decoder商業Business
- 007守護 AI 代理:Google DeepMind 的安全路線圖Google DeepMind·Google DeepMind商業Business