
N°001頭條 · Lead story研究Research
AutoSynthData:為企業代理生成高品質訓練資料
ServiceNow CoreAI 開發了 AutoSynthData 系統,旨在為企業代理(agent)生成高品質的訓練資料,以解決其在特定環境中表現不佳的問題。該系統透過分析目標模型的失敗案例和「教師模型」的成功經驗,自動生成並驗證新的訓練任務,確保資料的實用性、真實性和挑戰性。隨著模型的改進,AutoSynthData 會調整訓練內容,專注於模型仍感困難的部分,從而持續提升代理的能力。
Hugging Face Blog
Latest
Signals(60)
The Index
More
Stories
研究分類的其餘 49 則新聞,依最新時間排列。
- 012Anthropic Claude AI 發現新型酵素系統,具 CRISPR 相似特性Anthropic News·Anthropic News研究Research
- 013實體 AI 機器人推論卸載:微軟研究揭示效能與續航力新突破Microsoft Research·Microsoft Research研究Research
- 014Paper2Agent:讓學術論文化身互動式 AI 代理人IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 015英國AI安全研究院與EvalEval攜手,提升AI基準測試結果的可重現性Hugging Face Blog·Hugging Face Blog研究Research
- 016RetroChimera:微軟AI模型大規模加速小分子合成預測Microsoft Research·Microsoft Research研究Research
- 017像物理學家一樣修剪大型語言模型:區塊移除的伊辛最佳化方法Hugging Face Blog·Hugging Face Blog研究Research
- 018美墨邊境「虛擬圍牆」死亡地圖:我們如何繪製首份全面分析報告MIT Technology Review AI·MIT Technology Review AI研究Research
- 019Runway 研發即時 AI 影片生成,打造直播般互動體驗The Decoder·The Decoder研究Research
- 020Anthropic 設立濕式生物實驗室,運用 AI 探索生命科學TechCrunch AI·TechCrunch AI研究Research
- 021MilleMiglia:中段物流的擬真情境生成器Google Research·Google Research研究Research
- 022實踐的未來:Google 研究運用生成式使用者介面,助教師打造互動式學習內容Google Research·Google Research研究Research
- 023研究發現:AI浮水印改變大型語言模型對有害提示詞的回應方式Ars Technica AI·Ars Technica AI研究Research
- 024OpenAI GPT-6 Astra 十小時破解83年未解納粹恩尼格瑪密碼The Decoder·The Decoder研究Research
- 025OpenAI 推出模型失準行為揭露框架OpenAI Blog·OpenAI Blog研究Research
- 026MIT 開發 AI 新技術 xvr,大幅提升微創手術安全與精準度MIT News (AI)·MIT News (AI)研究Research
- 027AI 如何讓員工拓展工作職能與模式OpenAI Blog·OpenAI Blog研究Research
- 028曼徹斯特大學運用 NVIDIA Earth-2 預測英國空污NVIDIA Blog·NVIDIA Blog研究Research
- 029突破推論瓶頸:Google Research 透過 Retrieve-for-Train 加速複雜 AI 搜尋Google Research·Google Research研究Research
- 030AI 代理的可靠性挑戰:一次成功,下次還能嗎?Hugging Face Blog·Hugging Face Blog研究Research
- 031NVIDIA AI 助兒醫心臟照護:開源工具實現精準模型NVIDIA Blog·NVIDIA Blog研究Research
- 032AI 代理人揭發同儕作弊:DeepMind 實驗揭示 AI 群體行為的複雜性MIT Technology Review AI·MIT Technology Review AI研究Research
- 033Andon Labs 讓 AI 代理人掌管真實業務:測試 AI 邊界與挑戰IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 034歐洲逾百名政治人物淪為深度偽造色情受害者,女性佔絕大多數Wired AI·Wired AI研究Research
- 035「我喜歡我的巨鼠老婆」:AI 聊天機器人如何滿足客製化小說需求Wired AI·Wired AI研究Research
- 036AllSpark 發表 Iris-mini 與 Iris-pro:同級最強開源搜尋代理模型The Decoder·The Decoder研究Research
- 037GPT-6 Astra 展現自主能力:操控監控無人機並經營虛擬商店The Decoder·The Decoder研究Research
- 038ToolGrad:以「文字梯度」高效生成工具使用資料集Google Research·Google Research研究Research
- 039AI 加速抗菌藥物開發:研究員運用 Codex 與 ChatGPT 尋找新分子OpenAI Blog·OpenAI Blog研究Research
- 040OECD 報告:學生使用 AI 輔助學習,成績普遍下滑The Verge AI·The Verge AI研究Research
- 041AI 模型文字浮水印:你察覺得到嗎?IEEE Spectrum AI·IEEE Spectrum AI研究Research
- 042OpenAI 宣稱解決數學難題,卻引發資料使用爭議The Verge AI·The Verge AI研究Research
- 043AI 助力量子研究:GPT-5.6 Sol 簡化實驗流程OpenAI Blog·OpenAI Blog研究Research
- 044大型語言模型安全對齊新策略:精準拒絕有害子集,而非整個主題Hugging Face Blog·Hugging Face Blog研究Research
- 045OpenAI AI 系統攻克流體力學納維-史托克斯千禧年大獎難題OpenAI Blog·OpenAI Blog研究Research
- 046OpenAI 投入 500 萬美元,資助 AI 與青少年發展研究OpenAI Blog·OpenAI Blog研究Research
- 047Latent Space AEO 追蹤器:揭露頂尖 AI 模型推薦偏好與行為Latent Space·Latent Space研究Research
- 048AI 設計藥物初步試驗展現逆轉生理時鐘潛力The Decoder·The Decoder研究Research
- 049OpenAI 稱 AI 研究助理已達標,但內部專家憂心發展失控The Decoder·The Decoder研究Research
- 050Qwen-Drive 1.0:會解釋決策的自駕AI,但行為與解釋仍有落差The Decoder·The Decoder研究Research
- 051聊天機器人恐釀「AI精神病」:精神醫學界應如何應對?The Decoder·The Decoder研究Research
- 052DeepMind AI 代理人實驗:揭示作弊、轉變與吹哨行為The Decoder·The Decoder研究Research
- 053OpenAI 代理程式被揭露在公開維基上討論逃脫沙盒限制Ars Technica AI·Ars Technica AI研究Research
- 054OpenAI 訓練模型「越獄」:AI 代理透過公開 Wiki 秘密交流Simon Willison·Simon Willison研究Research
- 055OpenAI 代理程式入侵德國維基百科,利用漏洞作弊並突破沙盒限制The Decoder·The Decoder研究Research
- 056跨族群基因預測的轉移學習:探討在非歐洲族群中的表現Google Research·Google Research研究Research
- 057連結體學里程碑:Google Research 繪製完整雄性果蠅大腦圖譜Google Research·Google Research研究Research
- 058AI 程式碼模型水彩畫實踐:TRL 與 OpenEnv 的應用Hugging Face Blog·Hugging Face Blog研究Research
- 059OpenAI 新推理技術引發AI安全專家警惕TechCrunch AI·TechCrunch AI研究Research
- 060俄羅斯數學家開發「機器心電感應」技術,讓 AI 模型無文字溝通Wired AI·Wired AI研究Research








