![]() |
| (圖片來源:vocal.media) |
九月中旬,中美兩國元首在華盛頓會晤時,人工智能治理成為首要議題。中美兩國一直在競相研發功能日益強大的人工智能系統,且雙方都無意放緩腳步。但即便是這場競賽的贏家,也無法規避該技術所帶來的深層風險。
其中一個風險源於人工智能不斷提升的能力:發現軟件漏洞和執行複雜的網絡行動。由於網絡衝突的攻防力量嚴重不對稱,即便擁有全球最先進人工智能模型的國家,依然會面臨網絡攻擊的威脅。這種相互脆弱性,在很大程度上讓雙方在利用人工智能攻擊關鍵基礎設施(如金融網絡、通信系統和電網)時保持相互克制。
這種克制並非沒有先例。2015年,美國總統巴拉克·奧巴馬與習主席達成共識:兩國政府均不會實施、也不會蓄意支持以獲取商業利益為目的、利用網絡手段竊取知識產權的行為。雙方還建立了信息交換、協助調查及應對惡意網絡活動的機制。此後,網絡安全企業監測到源自中國相關組織的攻擊事件急劇下降,不過分析人士指出,這一下降趨勢在協議簽署前便已開始,可能反映了中國軍方及網絡機構的內部調整。
但人工智能帶來了一種傳統網絡協議未曾充分考慮的可能性:該技術可能對關鍵系統發動自主攻擊。7月中旬,在一次安全防護措施有所削減的內部網絡安全評估中,一群OpenAI智能體突破了沙盒測試環境,接入互聯網,併入侵了主要開源人工智能平台Hugging Face的系統。OpenAI報告稱,這些智能體“失控”,採取了超出其任務範圍的行為。
Anthropic、谷歌和Meta也報告了類似事件:人工智能智能體逃離隔離測試環境,並試圖對外部系統進行未授權入侵。儘管此類漏洞的後果迄今尚屬有限,但若一個美國人工智能智能體侵入例如騰訊的系統,導致微信癱瘓,情況恐怕就截然不同了。微信是14億人使用的超級應用,已深度融入中國人的日常生活。
這並非天方夜譚。安全企業Calif的研究人員近日披露,人工智能曾協助他們發現微信通話系統中的零點擊漏洞。該團隊在約兩天內就編寫完成一個遠程代碼執行攻擊程序,隨後又花了一周時間,打造出一種能夠通過微信通話傳播的蠕蟲病毒。
在受控演示中,來自可信聯繫人的通話可在用戶未接聽的情況下劫持微信賬號,攻擊者不僅能獲取其消息和通話記錄,還能訪問並侵入賬號保存的聯繫人。Calif已將該漏洞報告給騰訊,後者隨後修復了該缺陷。
Calif的WeWorm蠕蟲只是一次受控的安全演示。但結合美國發生的多起事件,它指向了一個令人憂慮的可能性:一次非故意的人工智能跨境入侵,看上去可能與蓄意攻擊無異。美中雙方能看到損害,卻未必知曉是否出於故意。保持溝通或可促成克制,但模糊性也可能引發報復,或為蓄意攻擊者提供掩護。無論是否出於意外,一次跨境漏洞都可能迅速升級為地緣政治危機,甚至軍事衝突。
鑒於此,未來任何關於人工智能驅動網絡攻擊的美中協議,都必須包含一種可信的手段,以區分意外與蓄意入侵。這意味着,除了建立報告渠道和熱線之外,協議還必須解決核驗問題。
一種方案是將舉證責任歸於“攻擊發起方”。攻擊來源國必須提供可信證據,證明其並非故意,例如顯示系統所受任務、權限、工具使用、人工授權記錄,以及日誌文件,證明智能體行為何時偏離預設指令。
核驗並不意味着完全透明。在美中均為締約國的《化學武器公約》下,“受控准入”允許調查員調查可能的違規行為,同時允許各國保護敏感設施及無關的涉密信息。可建立類似機制,讓雙方認可的專家獲取評估人工智能事件所需的證據,同時限制敏感信息的披露範圍。
此類機制還將帶來額外收益。由於能夠證明入侵系非故意的,可以降低遭受報復的風險,各國政府和人工智能企業將更有動力改進其記錄存留與信息共享系統,這也有助於開發者優化人工智能智能體,防範未來類似事件發生。
同樣,為避免高昂的調查成本,各國政府和人工智能企業將更有動力實施更嚴格的權限管理,並投資於監控與隔離防護體系。這些防護手段可降低未來事件的發生概率,並在事件發生時控制破壞範圍。而隨着為中美雙邊安排所開發的制度、程序及技術工具被更廣泛地採納,全球人工智能安全實踐水平也將隨之提升。
關於人工智能可能導致人類滅絕的警告,往往忽視了最迫在眉睫的風險:一場無人策劃、未經人類批准的攻擊所引爆的戰爭。我們亟需一種機制,來區分非故意損害與蓄意攻擊。美中協議必須致力於建立這樣的機制。
全文翻譯自報業辛迪加(Project Syndicate),原文標題“Preventing an AI World War”(2026)。
