xAI 發布了 Imagine Image 2.0,這款模型配備了多種編輯工具和預設模板。在 Arena 基準測試中,該模型表現優異,緊追在 OpenAI 的 GPT-Image-2 之後。
xAI 已將 Imagine Image 2.0 作為新的「品質模式」在 grok.com/imagine 網站以及 Grok 的 iOS 和 Android 應用程式中推出。根據 xAI 的說法,Imagine Image 2.0 的 API 存取權限也即將開放。
該公司表示,Imagine 2.0 旨在精確遵循指令,在複雜的視覺效果中保持排版和佈局的清晰度,並在多代生成中保持一致性。
截至 2026 年 8 月 7 日的 Arena 排行榜顯示,該模型的快速「低」變體在全球兩個類別中均位居第二。在圖像編輯 Arena 中,它獲得 1,439 的 Elo 評分,僅次於 OpenAI 的 GPT-Image-2(1,463 分)。在文字轉圖像 Arena 中,它達到 1,320 分,同樣落後於 GPT-Image-2(1,380 分)。
Reve 2.1、Meta 的 Muse-Image、阿里巴巴的 Qwen-Image-3.0-Pro、Google 的 Gemini 和字節跳動的 SeedDream 等模型均排名更靠後。在這些測試中,新模型也以顯著優勢擊敗了其前身「品質」變體。
Imagine Image 2.0 隨附多項編輯功能,專為迭代工作流程設計。根據 xAI 的說法,一個名為「魔術棒」(Magic Wand)的工具只修改圖像的選定區域。分割功能讓使用者可以精確選擇區域,而背景移除工具則能將主體匯出為透明背景。
多重參考編輯(Multi-Ref Editing)允許使用者將最多五張輸入圖像組合成單一生成結果。「智慧調整大小」(Smart Resize)則能將現有圖像轉換為任何長寬比,模型會自行填補額外空間。
xAI 還新增了模板功能,將常見的圖像工作流程打包成預設的起始點。這些類別涵蓋了照片編輯、產品攝影、行銷材料、設計工具、遊戲素材和串流媒體表情符號。
xAI 也展示了一項功能,能夠獨立生成角色、地點和道具,同時在所有圖像中保持視覺風格的一致性。該公司將此定位為邁向完整影片製作流程的墊腳石。
xAI 表示,Imagine 2.0 可以生成具有一致視覺世界的角色、道具和地點,作為影片製作的起點。



