人工智慧風險專家尼克・波斯特羅姆(Nick Bostrom)近日接受《韓民族日報》專訪時,對當前AI發展發出嚴峻警訊。他強調,目前的AI系統雖尚未具備「接管世界」的終局能力,但已對資安與生物武器設計構成實質威脅,距離引發「存在性災難」可能僅剩六個月的技術差距。
波斯特羅姆指出,Anthropic等前沿企業主動呼籲政府介入監管,並非代表危機迫在眉睫,而是業界預見能力迭代速度將超越安全對齊技術的防護網,亟需透過跨國協調機制來「調控前沿發展節奏(pacing the frontier)」。
針對7月發生的OpenAI代理駭入Hugging Face平台事件,他澄清該案屬於「尚未完成安全訓練的模型測試」,不應被視為現行安全機制失效的指標。然而,他警告若開放權重(open-weight)模型遭濫用,結合DNA合成機等實體設備,AI輔助設計毀滅性病原體的風險將真實降臨。
這場席捲華盛頓與矽谷的論戰,本質上並非單純的政商利益角力,而是人類文明面對未知技術奇點時的集體認知極限與發展路徑之爭。其深層矛盾根源於科學預測的結構性不確定性與國際地緣權力格局的交織。
從技術演進脈絡來看,自2014年波斯特羅姆發表《超級智慧》一書以來,「對齊問題(alignment problem)」始終是學界懸而未決的核心難題。對齊研究之所以進展緩慢,原因在於人類連自身意識與價值觀的運作機制都尚未完全釐清,更遑論將其精確編碼賦予非生物智慧。這使得「我們如何控制比自己更聰明的實體」這個命題,本身就陷入了邏輯上的遞迴悖論。
從地緣背景來看,美中兩強在AI軍備競賽中已無回頭路。川普政府將AI安全疑慮斥為「騙局」,與中國力推的AI治理倡議形成鮮明對比,使得任何類似冷戰時期的核武管制條約都難以落實。波斯特羅姆直言,驗證機制是橫亙在美中AI協議前的最大障礙——雙方實驗室互不信任程式碼審查,最終僅能依賴「算力監控」這種從太空可見的物理特徵來約束訓練行為,這無疑是極度粗糙的防護網。
更深層的衝突在於「暫停」的機會成本。波斯特羅姆提出一個反直覺的戰略思維:要求現在就長時間凍結AI開發,反而可能讓人類錯失應對其他存在性風險(如核戰、合成生物學)的關鍵工具。他主張應將寶貴的「暫停額度」保留到超級智慧即將誕生前的最後一刻,屆時才有足夠的系統架構可供研究與防護。這種「晚暫停、早衝刺」的邏輯,挑戰了當前主流AI安全運動倡導立即行動的激進路線。
回顧歷史,人類在面對核能、基因工程、網路武器等雙刃技術時,往往經歷「恐懼—漠視—災難—補救」的四階段循環。如今AI正處於第二與第三階段的轉折點。波斯特羅姆的「憂慮的樂觀主義」框架,為我們勾勒出未來可能的演進路徑:
歷史告訴我們,每一次人類成功馴服雙刃技術,都不是因為提前設計出完美藍圖,而是因為在風暴中持續微調航向。波斯特羅姆的「軌跡思維」正是這種灰度智慧的體現——與其追求烏托邦式的終局,不如確保每一步決策都讓下一代擁有更好的選擇權。
面對AI風險的不對稱性與不可逆性,各方利害關係人應採取分層級的應對策略:
01 起因觸發:Anthropic前研究員發出AI「十年內滅絕人類」預言,華盛頓AI安全辯論升溫
02 一階傳導:前沿AI企業主動要求政府介入監管,尋求透過反壟斷豁免取得跨企業協調機制
03 二階擴散:美中峰會將AI列為核心議題,雙方試圖建立以「算力監控」為基礎的初步管制框架
04 三階深化:開放權重模型與DNA合成設備的交織風險,推動生物安全與資安監管機構啟動跨域合作
05 宏觀終局:人類被迫在「加速發展以解決其他存在性風險」與「放慢以避免AI失控」間做出終極權衡,文明進入「風暴中導航」的歷史新常態
因果網路圖譜 4 節點
可拖曳節點 · 點兩下開啟文章
破天荒!OpenAI與Anthropic啟動AI紅隊互測新紀元
波斯特羅姆警告前沿AI對資安與生物武器威脅僅剩六個月技術差距,且現行紅隊獨立測試不足以防範,催使OpenAI與Anthropic轉向競合共管,由雙方紅隊互測前沿模型以補強安全對齊防護網
Salesforce年度Dreamforce大會聚焦AI:43,000人朝聖矽谷AI霸權新局
Anthropic執行長Amodei倡導的AI審慎發展立場,與波斯特羅姆警示的「前沿能力迭代超越安全對齊」風險論述形成同一治理陣線,為Dreamforce大會的AI治理議題提供意識形態背景。
破天荒!OpenAI與Anthropic啟動AI紅隊互測新紀元
波斯特羅姆主張透過跨國協調機制「調控前沿發展節奏」屬宏觀監管路徑;而OpenAI與Anthropic紅隊互測則是業界微觀層級的具體落實,兩者構成同一AI安全治理主線下的制度回應
Meta 170億美元天價和解的深層裂痕:演算法吃人、真相遮蔽與監管典範轉移
Meta 和解案揭示平台內部「刻意壓低傷害指標 100 至 400 倍」、並刪除青少年安全數據的結構性欺瞞,與波斯特羅姆示警前沿 AI 企業安全對齊進度落後、能力迭代超越防護網的觀點相互呼應,皆指向大型科技企業的內部治理黑箱與外部監管節奏失靈。