近期,美國人工智能前沿實驗室內部與高層接連發出強烈安全警告,顯示出產業對AI失控風險的深層焦慮。
Anthropic前研究員Jacob Coxon於9月初公開辭職,並在社交平台發文指出,他曾在OpenAI與Anthropic從事預訓練研究,兩家公司均未負責任地行事,正競相邁向可自我改進的超級智能,等同拿人類生命賭博。他直言,建設AI的人真心相信這項技術可能在十年內殺死全人類,這並非行銷噱頭,私下討論中恐懼更為明顯。Coxon甚至放棄尚未歸屬的股權提前離職,其言論迅速引發迴響,Anthropic內部對齊負責人亦公開呼應,估計AI在十年內導致人類滅絕的機率超過10%。
幾乎同時,OpenAI首席科學家Jakub Pachocki發文稱,AI進展速度過快,人類已難以充分理解與控制。他指出,模型正快速具備操作電腦、協作研究乃至自我改進能力,風險持續上升,呼籲實驗室自願放慢擴展速度,直到安全監測與對齊技術足夠成熟。
Anthropic的執行長Dario Amodei緊隨其後發表長文,主張必須放慢提升AI模型能力的步調,讓安全研究有時間跟上。他強調既不能停止建設以免錯失機會或被專制力量主導,也不能過快推進。OpenAI的執行長山姆·奧特曼與xAI的執行者馬斯克也迅速表態支持,奧特曼同意「節奏控制」並承諾採納獨立評估機制,馬斯克則直接表示「Dario是對的」。
這些接連警告並非孤立事件,而是反映AI產業內部對「遞歸自我改進」等議題的共識性憂慮。隨著模型能力接近或超越人類,競爭壓力使安全妥協難以避免。Coxon的吹哨、Pachocki的技術警示與Amodei的產業呼籲,形成從基層到高層的連動效應,並獲得跨公司支持,罕見地展現出暫時的行業統一立場。

