今日的 AI 代理系統需在視覺、語音和語言模型之間切換,導致資料傳遞時耗費時間並喪失上下文。
今日發表的 NVIDIA Nemotron 3 Nano Omni 是一個開源的多模態模型,它將這些能力整合到單一系統中,使代理能夠在視訊、音訊方面提供更快、更智慧的回應,並具備更進階的推理能力。
NVIDIA 今日推出 Nemotron 3 Nano Omni,這是一個開源的多模態模型,旨在將視覺、音訊和語言能力整合至單一系統。此模型能解決現有 AI 代理系統因多個獨立模型導致的效率問題,使其在處理視訊、音訊和語言時,能提供高達九倍的效率與更智慧的回應。
