講真D|要防範AI潛在安全風險

文/黎岩

人工智能正以超越人類預期的速度重塑人類社會。聯合國秘書長古特雷斯早前在聯大一般性辯論中發出警示:「今天,權力日益來自數據、算力和演算法。這種新權力高度集中,推進速度驚人,遠遠超出了我們理解其全部後果的能力。」這一判斷並非危言聳聽。就連微軟創辦人蓋茨亦發出警告,AI或會威脅全球10億人的生命。當AI從輔助工具走向直接執行決策,當代理式AI開始脫離人類預設軌道,國際社會面臨的核心問題已不再是「AI是否安全」,而是「我們是否有足夠能力確保AI安全」。

長期以來,公眾對AI風險的認知往往停留在科幻敘事層面。但2026年密集曝光的一系列事件,徹底打破了「AI失控尚屬遙遠」的幻想。2026年7月,OpenAI承認其GPT-5.6 Sol模型和另一款預發布模型在內部安全測試中失控,突破隔離測試環境,入侵了人工智能開源平台Hugging Face的系統,攻擊持續數天。更令人不安的是,從模型首次出現異常到OpenAI確認攻擊者身份,至少間隔了一周。Hugging Face聯合創始人沃爾夫透露,在緊急應對過程中,美國多家閉源大模型因安全機制過於嚴苛而拒絕提供幫助,最終依靠中國企業智譜AI的開源模型GLM-5.2才成功應對攻擊。這一細節具有深刻的象徵意義:AI安全是全人類的共同挑戰,任何技術封鎖或單邊主義都無法提供有效解決方案。

面對日益嚴峻的AI風險,國際社會的應對呈現出顯著的碎片化特徵。各主要行為體的治理理念和路徑存在根本性分歧,全球協調機制的構建步履維艱。

聯合國層面已搭建起初步的制度框架。2026年2月,聯合國大會正式任命了全球首個獨立國際AI科學小組的40名成員,該小組仿照政府間氣候變化專門委員會模式運作,負責評估AI在非軍事領域的機會、風險與影響,並發布年度報告。2026年7月,首屆全球AI治理對話在日內瓦舉行。

然而,大國立場的根本分歧構成了全球協作的最大障礙。2026年9月,芬蘭和挪威牽頭22國發表聯合聲明,呼籲AI「必須始終處於人類指導、監督和控制之下」,並提議仿照國際原子能機構模式建立全球AI監督機構。但美國等國家均未簽署該聲明,德國、法國、意大利等歐洲主要經濟體也未加入。特朗普在聯大明確表示美國「完全反對任何構建全球主義控制方案的嘗試」。美國白宮發布的《國家人工智慧立法框架》則以「搶佔州級AI立法」為核心導向,明確拒絕設立新的聯邦AI監管機構,轉而依靠行業主導標準和現有部門監管。中國的治理路徑側重於科技倫理審查,工信部等十部門印發了《人工智能科技倫理審查與服務辦法(試行)》,並啟動了倫理審查與服務先導計劃。

這種「各自為政」的格局意味着,AI風險的全球性與治理的國別性之間存在深刻張力。AI模型不受國界限制,一次失控事件可以在數小時內跨越多個司法管轄區,而各國的監管能力、技術水準和政治意願差異巨大。治理與管控的碎片化本身就是一種系統性風險。

儘管前路艱難,國際社會仍存在可推進協作的具體抓手。當前最為緊迫的是在以下三個層面建立共識與機制。

第一,構建統一的AI安全技術標準與評估框架。目前,ISO/IEC JTC 1/SC 42正在推進AI可信度、風險管理、治理等領域的標準化工作,但覆蓋範圍仍以基礎框架為主,對前沿模型的系統性風險測試標準尚不完善。歐盟《通用人工智能行為準則》已為系統性風險模型設定了對抗性測試、紅隊演練、網絡安全措施和嚴重事件報告等義務,可作為國際標準化的參考藍本。有效的國際標準必須在政府、產業界、學術界和公民社會的共同參與下制定,才能獲得業界認可並遵從。

第二,建立跨國AI風險預警與事故通報機制。當前AI安全事件的資訊披露高度依賴企業自願,OpenAI在入侵Hugging Face事件中延遲一周以上才確認責任方,澳洲的相關事件甚至延遲近4個月才通知當地政府。這種資訊不對稱嚴重削弱了各國政府的風險感知和應急回應能力。建立強制性、標準化的跨國事故通報機制,應成為下一階段國際談判的優先議題。

第三,守住「人工終審權」的底線。關乎人類「生死」的關鍵決策絕不能交給機器。「殺人機器人」絕不能在人類社會中佔有一席之地,這一原則應成為國際社會的共同底線。在AI全自動化趨勢下,無論是金融交易、醫療診斷還是司法裁決,保留人類對關鍵決策的終審權,是防止演算法權力凌駕於人類判斷之上的最後防線。

全球氣候變化談判的歷史表明,當風險足夠緊迫、共識足夠廣泛時,國際社會能夠建立有效的協作機制。AI風險的緊迫性絲毫不亞於氣候變化,但其演變速度更快、不確定性更高、地緣政治色彩更濃。核軍控的經驗表明,即便在競爭最激烈的時期,大國之間仍能就涉及人類共同生存的議題達成最低限度的合作。AI治理需要的正是這種超越地緣博弈的理性。

當前,聯合國全球AI治理對話、獨立國際科學小組等機制已為協作提供了初步平台。中國政府致力推動的全球人類命運共同體理念,亦漸漸被越來越多的國際社會有識之士認可。國際社會需要以更大的緊迫感和更務實的路徑,推動建立一套既能促進創新又能管控風險的全球AI治理體系——這不僅是技術問題,更是關乎人類共同未來的政治抉擇。一個不容忽視的簡單命題就是,如果人類不能聯手操控機器人,那麼總有一天,機器人就會操縱人類命運。機器人失控會殺人,這絕非危言聳聽。

(本文為作者觀點,不代表本媒體立場)
收藏 收藏
取消收藏 取消收藏

講真D|要防範AI潛在安全風險

(本文為作者觀點,不代表本媒體立場)
收藏 收藏
取消收藏 取消收藏