阿里巴巴在上海舉行的世界人工智能大會(WAIC)期間,推出新一代人工智能模型Qwen3.8-Max-Preview。新模型據稱擁有2.4兆個參數,是通義千問(Qwen)系列首款參數規模突破1兆的模型,並由純文字處理進一步升級為原生多模態模型,可同時理解文字、圖像、影片及文件內容。
Qwen團隊在社交平台X表示,Qwen3.8-Max-Preview在全球前沿模型中,整體能力僅次於Anthropic最新推出的Claude Fable 5,並稱新模型在程式編寫、複雜推理及智能體任務方面取得進展。不過,團隊暫未公布完整基準測試結果,亦未提供可供外界檢視的系統卡,因此有關排名目前主要建基於開發團隊自身評估,尚待第三方機構獨立驗證。
與今年5月推出的上一代Qwen3.7-Max相比,Qwen3.8-Max-Preview目前披露的技術資料相對有限。Qwen3.7-Max推出時曾公布多項能力測試,第三方評測平台Artificial Analysis現時給予其Intelligence Index 46分,並把它列為表現較領先的推理模型之一。
相比之下,阿里巴巴尚未交代Qwen3.8-Max-Preview的混合專家架構、實際啟動參數量、訓練數據規模、上下文窗口、推理成本及與上一代模型的逐項比較。這意味市場目前雖可從2.4兆個總參數了解其規模,但仍難以判斷模型在實際運行時需要調用多少參數,以及龐大模型規模能否轉化為更高效率和更低成本。
登陸阿里雲訂閱方案
Qwen團隊表示,新模型仍在持續演進,並計劃近期釋出開放權重,但暫未公布具體日期、授權方式及完整模型陣容。預覽版現時已率先登陸阿里雲Token Plan訂閱方案,並可透過旗下人工智能編程工具Qoder及QoderWork試用,反映阿里正把最新模型優先導入程式開發和智能體工作流程。
Qwen3.8推出之際,中國大型模型的參數競賽亦迅速升溫。月之暗面7月16日發布Kimi K3,官方資料顯示,該模型擁有2.8兆個參數、原生多模態能力及100萬token上下文窗口,主要面向長程程式開發、知識工作和深度推理。兩款模型相繼登場,意味中國開發者可使用的前沿模型,已由千億參數規模進一步跨入數兆參數時代。
過去一年,阿里巴巴持續擴大Qwen開放權重模型陣容,同時建設阿里雲模型服務、人工智能開發工具及自研晶片等基礎設施。開放權重策略降低開發者修改、部署及微調模型的門檻,亦有助阿里把Qwen生態與雲端運算服務綁定,吸引更多企業和程式開發者使用其平台。
不過,Qwen3.8能否在實際性能上挑戰Claude Fable 5及Kimi K3,仍要視乎正式版發布後的基準測試、推理成本、運行速度及第三方評測結果。在更多技術資料公布前,其2.4兆參數規模更多反映阿里在前沿模型競賽中的技術投入,尚不足以單獨證明模型的實際能力排名。(編輯部)