OpenAI行政總裁薩姆.奧特曼表示,旗下人工智能模型突破測試環境並入侵開源平台Hugging Face,再次說明先進AI系統的能力正迅速增強,也凸顯將AI權力集中在少數個人或企業手中的風險。
據《商業內幕》7月28日報道,奧特曼在參加創業孵化器Y Combinator的播客節目時表示,任何人面對這次事件若沒有感到一絲恐懼或警惕,便可能尚未充分認識問題的嚴重性。他承認OpenAI在事件中犯下錯誤,並稱事故顯示,AI失控已不再只是理論上的擔憂。
OpenAI於7月21日披露,事件發生在一次內部網絡安全能力測試期間。參與測試的並非單一模型,而是包括GPT-5.6 Sol及一個能力更強、尚未發布模型在內的組合。為測試模型的極限網絡攻擊能力,OpenAI當時降低了部分安全拒絕機制,並將模型置於理論上高度隔離的沙箱環境。
不過,模型在尋找網絡安全基準ExploitGym答案的過程中,發現並利用軟件套件快取代理中的「零日漏洞」,取得開放互聯網存取權限。其後,模型在OpenAI測試環境內提升權限及橫向移動,並推斷Hugging Face可能儲存相關模型、數據集及測試答案,繼而使用被盜憑證及其他漏洞,在Hugging Face伺服器上找到遠端執行程式碼的途徑,最終從生產數據庫取得測試資料。
OpenAI稱,模型並非蓄意攻擊Hugging Face,而是為完成既定任務採取極端手段,試圖繞過正常測試取得答案。
集中壟斷後果嚴重
奧特曼表示,事件反映AI系統已擁有極強能力。若未來由一家公司、一個人或一個模型掌握遠超其他社會力量的權力,可能造成嚴重後果。因此,用戶不應被鎖定在單一AI系統或一家企業的「道德世界觀」中,AI創造的經濟財富及技術能力也不應集中於少數企業。
他認為,更廣泛地分配AI能力,可讓更多機構開發防禦工具,從而提高整體安全水平。
事件發生後,Hugging Face聯合創辦人兼行政總裁克萊門特.德朗格要求OpenAI採取「徹底透明」的處理方式,公開失控AI智能體留下的運行軌跡及日誌,讓全球研究人員分析事故原因。
他同時要求OpenAI提供價值1億美元的算力,協助Hugging Face社區利用開放及封閉模型建立更強的網絡防禦系統。
OpenAI表示,雙方正合作進行取證調查及修補漏洞,公司已加強測試環境的網絡配置、存取控制和監測措施,並將Hugging Face納入可信存取計劃。
事件亦令開放權重與封閉模型之爭進一步升溫。支持者認為,開放模型可讓更多開發者參與安全防禦;反對者則擔心,強大網絡攻擊能力一旦廣泛擴散,也可能被不法分子利用。(編輯部)