中國人工智能(AI)初創公司月之暗面(Moonshot AI)上周發布並上線新一代大模型Kimi K3,憑藉2.8萬億個參數、100萬Token上下文窗口,以及在程式設計和智能體任務中的突出表現,引發全球科技業及資本市場關注。外界開始重新評估中國與美國尖端AI模型之間的技術差距,以及矽谷巨額AI投資能否持續取得相應回報。
Kimi K3採用混合專家架構,被月之暗面定位為面向長程程式設計、知識工作及深度推理的旗艦模型。公司已開放模型服務,並計劃於7月27日公布完整模型權重,使開發者能夠進一步部署及調整模型。以總參數規模計算,Kimi K3亦被視為目前全球最大的開放權重大模型之一。
在由開發者盲測及投票的Arena「前端程式碼榜」(Frontend Code Arena)中,Kimi K3取得1,679分,超越Anthropic旗下Claude Fable 5的1,631分及OpenAI旗下GPT-5.6 Sol的1,618分,升至全球第一。Kimi上一代K2.6僅排第18名,新模型一次躍升17個名次,並在七個前端程式設計細分類別中取得六項第一。
彭博報道指出,Kimi K3的表現正在動搖「美國尖端AI技術仍明顯領先中國」的固有認知。此前,不少中美科技業人士估計,中國最先進模型較美國落後約半年至一年。本周仍有一名不具名Anthropic高層表示,該公司的技術領先中國競爭對手約六至12個月。
差距縮短至兩三個月
不過,加州大學伯克利分校電腦科學教授、Arena共同創辦人斯托伊卡(Ion Stoica)表示,業界過去普遍認為中國開放模型較全球最先進模型落後六至九個月,但Kimi K3發布後,差距可能已縮短至兩至三個月。他指出,Kimi K3在初步程式設計評測中的表現,已進入Anthropic及OpenAI頂級模型所處的相近區間。
Kimi K3的快速追趕,亦令人聯想到DeepSeek在2025年初帶來的市場震撼。當時,DeepSeek以較低成本訓練出具競爭力的模型,令投資人質疑美國科技企業投入數千億美元興建數據中心及採購高端晶片,是否一定能形成難以跨越的技術壁壘。如今月之暗面再次證明,中國企業即使面對先進晶片出口限制,仍有可能透過模型架構、訓練方法及運算效率創新,縮小與美國領先企業的差距。
企業客戶對AI模型的選擇亦愈來愈重視成本,而非單純追求最高性能。部分開發者已採用「模型路由」服務,按照任務難度、速度及價格,自動選擇最具成本效益的模型。中國開放權重模型價格較低,又容許企業自行部署及調整,正逐步進入更多企業工作流程,可能壓縮美國閉源模型供應商的定價空間。
一名美國AI公司高層表示,美國企業仍可依靠持續創新維持領先,但隨着中國模型進步及市場競爭加劇,美國業者必須更清楚證明其產品相對高昂價格所帶來的價值。OpenAI行政總裁奧爾特曼此前亦承認,中國開放模型已達到相當高的水平,但仍相信OpenAI能繼續開發全球最優秀的模型。(編輯部)