馬斯克旗下xAI宣布推出Imagine Image 2.0圖像生成模型,目前已以全新「Quality Mode」形式,登陸Grok.com網頁版,以及iOS和Android應用程式。
xAI表示,新模型提升指令遵循及細節處理能力,在複雜視覺內容中可預先規劃文字排版與版面結構,提高多元素畫面一致性及小字清晰度,並能在多輪生成及編輯過程中保留原有主體與設定。
Imagine Image 2.0亦重點加強圖片編輯功能,包括利用魔棒工具局部修改指定區域、透過分割功能精準選取內容,以及一鍵移除背景並輸出透明底圖。模型同時支援最多5張參考圖片進行單次生成或編輯,減少人手合成需要。
此外,用戶選定目標圖片比例後,模型可智能補全畫面,令同一素材適用於不同尺寸及平台。
xAI稱,Image 2.0主要針對攝影、設計及插畫場景訓練。根據其引用截至8月7日的Arena排行榜數據,該模型在文生圖及圖像編輯兩項能力均位列全球第二,僅次於OpenAI的GPT Image 2。(編輯部)