文:張恭銘
當“防失控”遇上“不願落後”,世界AI治理走向碎片:2026年9月Anthropic公司27歲研究員Jacob Coxon宣佈辭職,併發出一則震動硅谷的警告:“人類即將失去控制權。”與此同時,Anthropic官方承認旗下Claude模型出現“偏誤推理”與“魯莽”的越界行為,OpenAI的代理AI更被揭露利用邊緣網站進行未經授權的秘密通訊。一時間,“AI會不會失控”從科幻敘事躍升為全球政策圈的緊迫議題。
一、失控的陰影:從實驗室到真實系統
AI失控不再是紙上談兵。Anthropic在回溯約14萬筆記錄後確認,Claude Opus 4.6早期版本在模擬測試中因環境設定錯誤連上外網,不僅癱瘓目標機器,還主動尋找漏洞入侵第三方系統並讀取用戶個資。Anthropic對齊科學主管Evan Hubinger坦言,未來十年人類面臨毀滅風險的概率超過10%。
然而《國際AI安全報告2026》明確指出,現有AI尚不具備造成真正“失去控制”的完整能力。這種“風險已知但尚未致命”的微妙狀態,恰恰構成了各國治理分歧的根源——太緊迫會束縛發展,太松懈則可能追悔莫及。
二、中美分野:減速避險與裝剎加速
中美兩國都警惕AI失控,但應對思路截然不同。美國科技領袖主張“讓整個賽道慢下來”,Anthropic首席執行長阿莫迪呼籲放慢前沿AI研發並加強第三方安全評估,同時支持收緊對華晶片出口限制。這種“減速”邏輯的背後,是硅谷將AI視為可能超越人類控制的超級智能——誰先突破誰獲決定性優勢,但智能本身可能強大到無法駕馭。
中國的思路則是“裝好剎車,讓車開得更穩更快”。中國政策制定者更常將AI視為電力、蒸汽機那樣的通用技術,重點是用它來改造產業、推動經濟升級。2023年發佈的《全球人工智能治理倡議》倡導“以人為本、智能向善”,2026年9月最新發佈的《人工智能安全治理框架3.0》進一步將智能體、具身智能納入治理範疇,並提出構建“柔性、動態、可控的沙箱監管環境”。
台灣清華大學科技法律研究所所長林勤富的分析切中要害:美國AI發展由市場驅動,嚴格治理有賴於政治動能,“人類存續風險”因而成為推動立法管制和爭取資源的政治槓桿;中國則沿用既有網絡和數據治理體系,由國家自上而下介入,過去的管控經驗強化了“管得住”的信心。
這種差異已在實踐中顯現。美國加州2026年9月簽署SB 53《前沿人工智能透明度法案》,要求前沿AI開發者公開披露安全框架,並簽署行政令推動建立AI“緊急關停開關”。但這些舉措仍屬州級先行,聯邦層面的統一立法依然缺位。中國的做法則是將合規要求前置至產品設計與備案環節,2023年中企曾在生成式AI管理規則定稿前推遲聊天機器人上線,直到規則生效後才推出產品。
三、歐洲模式:剛性立法與務實回調
歐盟走的是一條“先立法、後執行”的第三條道路。2026年8月2日,歐盟《人工智能法案》正式進入執行階段,AI辦公室獲得對通用AI模型提供商的調查和處罰權,罰款最高可達1500萬歐元或全球營業額的3%。但就在執行日前幾天,歐盟通過“數字AI綜合法案”對原法案進行修正,將高風險AI系統的大部分合規義務推遲至2027年底至2028年。這一“邊執行邊鬆綁”的做法,折射出歐洲在安全訴求與產業競爭力之間的艱難平衡。
英國則選擇了更輕觸的路徑。英國不設專門的AI監管機構,依賴現有法律框架進行場景化治理。AI安全研究所2025年更名為AI安全研究院,標誌著政策重心從“安全優先的審慎”向“安全與機遇並重”轉移。英國通過自願協議獲得對OpenAI、Anthropic、谷歌等公司模型的部署前訪問權,以評估其能力與風險。
四、亞太拼圖:從首爾到新德里的多元探索
亞太地區的AI治理呈現出碎片化但充滿活力的格局。韓國於2026年1月22日正式實施《AI基本法》,成為繼歐盟之後全球第二個擁有全面橫向AI法規的國家,對特定AI系統引入有約束力的透明度與安全義務。日本則堅持“戰略先行、法律後置”,2026年7月批准第二版AI基本計劃,提出“開放AI主權”戰略,意在避免對任何單一公司或國家的依賴。印度在2026年7月釋放信號,可能轉向專門的AI立法,標誌著其監管思路的重要演變。
五、全球治理的碎片化困境
聯合國試圖為這場治理競賽提供協調框架。2026年2月,聯合國大會正式任命了全球首個獨立國際AI科學小組成員,該小組的首份年度報告於7月在日內瓦首屆全球AI治理論壇上發佈。聯合國秘書長古特雷斯強調:“國家行動至關重要,但全球協調不可或缺。”
然而,現實中的治理格局遠未趨同。美國主導的“卡羅萊納原則”在G20創新部長級會議上獲得20國背書,主張寬松且具彈性的監管;而中國推動的“世界人工智能合作組織”則於2026年7月在上海成立,強調“主權AI”與“公平普惠”,獲得全球南方國家的廣泛響應。
全球AI治理正站在一個十字路口:是走向以聯合國為核心的多邊協調,還是在大國競爭的邏輯下分化為彼此隔離的監管陣營?中美首腦會晤前夕,美方提議建立AI事故通報機制,這或許是一個微小的積極信號。但正如林勤富所言,“不同體制會把同一種不確定性,翻譯成不同的政策語言”。當“剎車”與“油門”的設計理念根本不同時,如何讓全球AI治理這台車安全前行,將是未來數年最嚴峻的政策挑戰。

