人工智慧與機器人示意照。路透社
多年來,人工智慧(AI)研究人員不斷發出警告,指出AI技術可能以多種方式毀滅人類:AI可能設計出一種無法遏制的致命疾病、引發核子戰爭,或者如一項著名的思想實驗所述:將整個地球轉化為巨大迴紋針工廠。
如今,多名科技巨頭高層發聲表示基於安全考量,應暫緩AI開發,AI產業內外關於這些「末日情境」真實性的辯論便日益升溫。
儘管有警告稱人類可能失去對AI的控制,但也有人懷疑,由AI公司自身所描繪的最壞情境,與其說是現實,不如說是為了「證實其工作重要性」所做的鋪陳與渲染。
網路安全公司SentinelOne研究員兼OpenAI邊境風險委員會(Frontier Risk Council)成員格雷羅-薩德(Juan Andrés Guerrero-Saade)批評這些末日場景,他說:「這些論點根本站不住腳。我認為這只是科幻小說,非常吸引某種不成熟的思維模式。這對前沿實驗室來說極具誘惑力,因為這能幫他們吸引特定類型的人才加入。」
然而,面對AI憑藉驚人能力震撼世界的同時,愈來愈多人開始對這項技術帶來的風險感到不安。
因擔心公司及其競爭對手在AI開發上缺乏責任感、選擇辭職的Anthropic 研究員考克森(Jacob Coxon)最近在社群平台X表示,他需要「努力研究」如何更有效地向公眾傳達「AI究竟會如何毀滅人類」。他在本月稍早寫說:「不幸的是,要具體傳達出特定的末日情境極其困難。」
根據美聯社報導,以下是目前討論最為廣泛的四種AI末日情境。
核戰冬天(Nuclear Winter)研究人員長期以來一直推測,AI系統可能透過誘使各國發射核彈相互攻擊,從而引發全面核子戰爭。核爆以及隨之而來的「核子冬天」,將對地球上的生命造成毀滅性打擊。
蘭德公司研究人員在去年的一份報告中得出結論,指出「目前」AI不可能直接啟用核武器,因為「指揮與控制系統建有嚴格的安全防護機制」。然而,報告也警告,如果AI模型被整合到核武的「決策鏈」中,或未經授權侵入了這些系統,情況可能會改變。
對許多AI研究人員而言,危險恰恰在此:這並非AI突然決定滅絕人類,而在於人類、國家或極端組織本來就想利用AI來消滅對手,AI可能只是認定發動核戰是最優解。
生物武器(Bioweapons)AI最被寄予厚望的前景之一,是幫助人類開發攻克不治之症、罕見疾病的藥物與療法。
然而,治療疾病的反面,就是創造或升級疾病以危害人類。本月稍早,Anthropic提出安全報告表示,有不良份子企圖利用其AI模型Claude從事網路攻擊、人口監控,以及可能研發生物武器等一系列惡意活動。
Anthropic透露,在其中一個案例中,一不良用戶向Claude提出請求,研究如何增強基於蚊子傳播的「屈公病」(Chikungunya virus)病毒變異,使其危害性顯著提升。Anthropic指出,雖然此類研究可用於開發更有效的疫苗與治療方法,「但它同樣可用於讓病原體變得更加危險」。
無獨有偶,蘭德公司的報告亦提到,AI開發的最新進展「具有改變合成病原體設計的潛力」。
在描繪生物武器末日情境時,報告指出,新型病原體可能在實驗室中被創造出來,並被輸送至目標地點,進而在多個地區造成大規模感染。不過,這一末日情境依然是由人類主導、由人類完成最後一哩路,而非自主的AI發動攻擊。
AI失控(Runaway AI)部分AI研究人員擔心,人類滅絕事件可能起於AI的「對齊失控」(misalignment),即AI模型在未經人類授權的情況下自行採取行動、與其他模型進行協調,或是規避人類的監督。這並非源自惡意,因為AI既不是人類,也沒有善惡之分,而僅僅是因為人類可能成為AI模型實現目標過程中的「阻礙」。
引發這波AI恐慌的關鍵事件就是典型的對齊失控。OpenAI、Anthropic、Meta與Google這些AI巨頭,近幾個月來全都報告,他們的AI發生過自行發動網路攻擊的行為。這些AI並非突然自主決定進行網攻,而是「它們」認為發動網攻直接找到答案,是最有效達成人類設定目標的方式。
牛津大學哲學家博斯特羅姆(Nick Bostrom)幾十年前提出著名的「迴紋針最大化」(paper clip maximizer)思想實驗,可以說明這類狀況:如果一個先進的AI接獲命令,要求盡可能生產迴紋針,它最終可能會將整個地球、甚至愈來愈多的宇宙空間,全部轉化為迴紋針工廠。
博斯特羅姆在2003年寫道,這個思想實驗旨在展示超智慧AI(通常稱為通用人工智慧,即AGI)會如何推動一個看似人類渴望的目標、但「最終卻證明是成為反烏托邦的目標,其中對人類繁衍至關重要的事物已不可逆轉地消失」。他寫道:「小心你對超智慧許下的願望,因為願望很可能成真。」
AI接管網際網路(AI Internet Takeover)鑑於AI的發展速度,Anthropic執行長阿莫戴(Dario Amodei)本月警告指出,在未來短短幾個月內,由AI代理組成的蜂群(swarm)可能具備透過殭屍網路(botnet)「接管」網際網路的能力,並可能造成數十億美元的損失。這可能意味著電力網、供水系統、交通系統或金融機構遭受大規模AI駭客攻擊。這些攻擊或許不至於直接終結人類,卻能引發國家社會極度混亂,造成生命損失。
以前一些基礎設施的軟體故障,離如航管系統的故障,就能引發非常大的混亂,已經凸顯出當前倚賴網路與軟體服務的基礎建設有多脆弱。而功能更為強大的AI模型,有更難以阻擋的網路攻擊能力。然而,也有部分專家認為,AI能夠一舉接管高度分化的網際網路,這種觀點未免過於荒謬且不切實際。
尚未納入考慮的實體AI值得注意的是,這四個主要的AI毀滅世界場景,大多避開了實體AI(Physical AI)的發展,除了那個「迴紋針」思考實驗。
目前非常強大的AI有時可以被形容為「超級殘疾人士」,因為其擁有傲視群倫的「腦力」,但沒有「四肢」去具體操作物理實體的世界。
這一狀況隨著實體AI的發展,很可能很快就會被打破。實體AI的目的就是要把AI的「腦力」裝進機器人,使其有直接與實體世界互動、操作各種設備的能力。
以「生物武器」場景來說,主導發動攻擊與執行散播疾病的都是人類,只是靠AI把病原體改造得更為致命。那如果改造病原體從設計到執行都能由AI與機器人一手完成呢?
路透社上週獨家報導,Anthropic公司已經在舊金山灣區設立了生物實驗室,以進行AI協助的藥物與療法開發。這是會真正執行生物培育實驗的「濕實驗室」(wet lab)。
Anthropic公司的生命科學部門主管考德勒-艾布蘭(Eric Kauderer-Abrams)強調,AI發想的藥物終究必須在實驗室中進行實證。而這個生物實驗室與其他藥廠的實驗室一樣,都是由人工操作,受到監管。
但是,生物實驗一大特性就是會有非常多枯燥、重複的流程,很容易想像會有AI公司或藥廠,決定直接用機器人去執行這些工作,甚至認為這更可以避免實驗的病原體感染到研究者。屆時,AI操作的機器人,距離設計、散播致命病原體就不遠了。