軍事安全

中美能否「對齊」人工智能風險觀?

2026-10-10
孫成昊(Sun Chenghao)清華大學戰略與安全研究中心副研究員

隨着中美人工智能博弈不斷升級,一個問題越來越值得關註:雙方擔心的究竟是不是同樣的人工智能風險?

過去,外界常用一種簡單的二分法理解中美人工智能治理。中國更關注內容安全、社會穩定和數據治理,美國則更重視模型安全、權利保護以及前沿人工智能可能帶來的災難性風險。這種概括看似有一定的現實依據,但隨着兩國政策不斷調整,已經越來越難以準確描述雙方的風險認知。

中方近期發佈的《人工智能安全治理框架3.0》就是一個明顯變化。新版框架把人工智能風險劃分為內生安全風險、應用安全風險和衍生安全風險,不僅包括“幻覺”、算法偏見、數據泄露、虛假信息等問題,也將智能體越權、自主網絡攻擊、關鍵基礎設施安全、核生化導相關知識失控,以及未來可能出現的人工智能脫離人類控制等納入治理視野。與過去相比,中國對人工智能風險的認識正在明顯向前沿技術領域延伸,對可能引發重大安全後果的風險也更加重視。

美國的政策方向也在發生變化。美國國家標準與技術研究院(NIST)的《人工智能風險管理框架》,以及聯邦政府近年來針對可能對權利、安全和重要公共利益產生重大影響的人工智能應用出台的相關規則,都長期關注模型可靠性、隱私、公民權利以及人工智能對個人和社會的影響。但特朗普執政後,美國人工智能政策的優先次序發生調整,一方面更加強調創新速度、產業競爭力和減少監管負擔,另一方面又明顯提升對網絡、生物、化學等國家安全風險的關注。美國當前對於前沿模型的安全評估,越來越聚焦那些可測試、可驗證、並可能直接影響國家安全的能力。

把兩國最新政策放在一起看,中美風險觀正出現三個值得注意的變化。

一是雙方在前沿人工智能可能引發的重大安全風險上,正在形成更多共同認識。無論是模型失控、智能體自主行為,還是人工智能增強網絡攻擊能力、生物安全風險和關鍵基礎設施風險,兩國政策文件所使用的語言已經出現越來越多交集。中國強調安全對齊、紅隊測試、人類干預和緊急停止機制,美國則強調模型可靠性、可控性和高風險能力評估。2024年,中美元首確認應維持由人類控制核武器使用的決定。這也說明即使在高度敏感的安全領域,雙方仍可能找到最低限度的風險共識。

二是雙方對社會風險和價值風險的理解仍有明顯差異。中國的人工智能治理一直具有較強的系統性,不僅關注模型自身安全,也把虛假信息、社會認知、就業結構、智能鴻溝、文化影響等納入風險治理框架。美國當前政策則更重視如何避免監管限制創新,並傾向於區分可以直接證明的安全風險與具有較強政治、社會和價值判斷色彩的風險。雙方在“哪些問題應被定義為人工智能風險”“政府應介入到什麼程度”上存在不同判斷。

更棘手的是,雙方正在把對方的一部分人工智能政策本身視為風險。中國把技術壟斷、出口管制導致的芯片、軟件和服務斷供納入供應鏈安全風險,美國則將先進芯片、算力和前沿模型能力擴散視為國家安全問題。對一方而言是降低風險的政策工具,對另一方而言卻可能意味着風險上升。

這些差異並不只是技術專家對風險大小判斷不同,背後還有更深的政策邏輯。

首先,兩國治理目標不同。中國更習慣從技術、經濟、社會和國家安全的整體關係中理解人工智能風險,強調發展與安全並重。美國當前政策則更突出技術領先、創新能力和國家安全。這決定了雙方即便看到同一種風險,也可能給予完全不同的政策權重。

其次,雙方對“治理本身的風險”認識不同。中國更多考慮的是人工智能發展過快、應用失序可能帶來的風險,美國當前政策則特別警惕監管過度、創新受限可能削弱自身競爭力。中美之間需要討論的,因此不單單是人工智能有什麼風險,也包括應該付出多大治理成本來降低這些風險。

更重要的是,人工智能已經嵌入中美戰略博弈。芯片、算力、模型、開源生態和國際標準都已具有明顯的戰略屬性。在這種情況下,一方為了提高自身安全而採取的措施,很容易被另一方理解為競爭和遏制,風險認知由此與經典的安全困境相互疊加。

因此,中美短期內形成一套完全一致的人工智能風險觀既不現實,也沒有必要。更可行的目標,是在關鍵風險問題上逐步形成共同語言、基本判斷和穩定的溝通機制。

第一步可以從共同的風險語言開始。相比泛泛討論“安全”“失控”或“負責任的人工智能”,雙方更需要圍繞具體場景形成可討論的概念,比如一個模型達到什麼能力以後需要更嚴格的測試,什麼樣的智能體自主行為可以被認定為重大安全事件,人工智能輔助網絡攻擊發展到什麼程度會產生跨境安全影響,高風險軍事應用中的“人類控制”究竟意味着什麼。只有把概念說清楚,未來發生事故時雙方才可能準確理解彼此的判斷。

第二步是推動風險評估方法具有一定可比性,而不是追求監管制度統一。中美完全可以選擇網絡安全、生物安全、智能體自主性等雙方都較為關注的領域,用各自的測試工具對同類能力進行評估,再比較指標、閾值和結果。雙方無須共享模型權重和核心技術,也可以逐步了解對方究竟在測量什麼、為什麼認為某種能力危險。

第三步是建立重大人工智能安全事件的溝通機制。如果未來先進模型出現嚴重失控、人工智能智能體實施跨境網絡攻擊,或者關鍵基礎設施受到自主系統影響,中美至少應該存在較為固定的溝通窗口和基本的信息交換方式。這種機制並不要求雙方首先建立高度互信,其價值恰恰在於互信不足時,避免一次技術事故迅速被解讀為國家敵對行為。

至於內容治理、意識形態、出口管制、技術供應鏈等問題,雙方的分歧在短期內恐怕很難彌合。更現實的辦法是承認這些屬於結構性分歧,同時避免其阻斷其他領域的風險治理合作。中美可以有一張需要長期管控的“分歧清單”,也應該形成一張可以逐步推進的“共同風險清單”。

中美真正需要“對齊”的,未必是一整套人工智能風險觀。雙方更需要的是在那些可能造成重大跨境影響和戰略誤判的領域,對基本概念、判斷標準和溝通方式形成最低限度的共識。這或許比追求一套宏大的人工智能治理共識更現實,也更緊迫。

更多文章