曾浩年,《亞洲週刊》新金融編輯,北京大學西方哲學博士、香港中文大學哲學系學士,博士論文著作《黑格爾邏輯學的現實概念與唯心論原則》;曾任香港「哲學01」策劃人、香港武術頻道「武備志」策劃人。
在九月二十三日的聯合國安理會上,請來幾家AI公司掌舵人,討論人工智能對國際安全的威脅。開發ChatGPT的OpenAI行政總裁奧特曼(Sam Altman)警告,人類「可能失去對未來的控制」。最受注目的發言,卻來自一家被AI攻擊過的公司。Hugging Face是全球最大的AI模型集散地,其行政總裁德朗格(Clément Delangue)說:「我們遭到AI攻擊,但更重要的是,我們用AI保護了自己。」救了他們的,是一個中國模型。 這宗事故已成為今年AI規管辯論的轉捩點。過去抗拒監管的AI公司,如今爭相要求政府立規矩;但最強的AI被層層上鎖之後,鑰匙落在誰手上,才是真正的問題。 事發於七月。OpenAI在測試兩個模型的網絡攻擊能力,讓它們以「AI代理」形式運作,即能自行上網、寫程式、連串執行任務的AI程序,在與外界隔絕的模擬環境(業界稱「沙箱」)裏做攻防考題。為測出真實本領,模型拒絕攻擊指令的安全設定被刻意調低。 結果,至少一千二百個代理找到一個無人知曉的軟件漏洞,逃出沙箱,連上真實的互聯網。它們推斷考題答案存放在Hugging Face,於是在七月十一日至十三日闖入其內部系統,偷取登入憑證,控制多組伺服器,執行約一萬七千六百個動作。沒有人下令攻擊,它們只是想作弊。 該公司首席科學官沃爾夫(Thomas Wolf)說,攻擊者一開始就不像人類:「人類黑客要的是能賣錢的東西。」OpenAI直到事故公開後,才發現元兇是自己的模型。 更耐人尋味的一幕,發生在入侵之後。保安人員要分析攻擊程式碼,先交給另一家美國AI巨頭Anthropic的模型,卻遭拒絕:模型內置的安全限制(業界稱「護欄」)一見攻擊程式碼便停工,分不清提問的是黑客還是救火的人。 他們最後改用北京智譜公司的GLM 5.2。這是「開放權重」模型,任何人都可下載到自己的電腦運行,不必經過原公司的網上服務,也不受其使用規則約束。在華盛頓,中國開放模型常被視為安全隱患;這一次,它成了美國公司的救兵。開放模型當然也可落入黑客手中;但七月闖禍的,恰恰是封閉模型。 攻擊者安全設定被調低了,防守者沒有。德朗格因此主張,現在「不是放慢的時候,而是要加速」,讓防守者用得上強大的AI,尤其是開放模型。 護欄只是企業自設的規則;一旦寫進法律,就成了整個行業的門檻。業界主流正朝這方向走:要求政府出手,放慢AI發展。九月九日,OpenAI呼籲國會訂立強制性的全國規管,並支持加州設立AI審計師登記冊,未登記者不得做AI安全審計。九月十二日,Anthropic呼籲為最尖端模型「定速」,其中一步是由民主國家幾家頂尖公司協調,共同設定安全標準和能力進展的上限;他在腳註承認,這需要「政府斡旋或豁免反壟斷限制」。奧特曼與馬斯克隨即附和;微軟創辦人蓋茨九月二十五日也警告,AI足以造成「十億人死亡」,「沒有人認為自我規管是足夠的」。 反壟斷法的本意,是禁止同業串通定價、限產。幾家最大的公司聯手決定整個行業跑多快,再請政府網開一面;這種安排放在其他行業,無論動機如何,都叫卡特爾。全球最大AI芯片商英偉達的行政總裁黃仁勳便抨擊這種豁免,說「我們不需要新的規管」。但英偉達也非局外人:九月三日,它宣布以一百二十九億美元收購Hugging Face。那個七月靠開放模型自救的獨立平台,就此歸入OpenAI主要供應商的旗下。 國際層面,桌子同樣只有兩邊:中國國家主席習近平九月訪問華盛頓後,美中宣布建立人工智能對話機制。特朗普說:「沒有第三名,只有我們和中國。」 規管的共同點:誰可審計、誰能用最強模型,都由少數決定。OpenAI承認「沒有一家公司應該控制未來」,藥方卻是擴大「受信任存取計劃」——經開發商審核,才向指定防守者開放最高階能力。七月那個週末,Hugging Face沒時間等候審核。 對於亞洲的醫院、銀行與中小經濟體而言,這並不抽象:遇襲時,手上有沒有一個能在自家機房運行的模型,決定了它們是在查案,還是在排隊。


