前員工控Anthropic與OpenAI都未對AI安全負起應盡的責任。路透社資料照片
美國人工智慧頂尖實驗室Anthropic一位高級安全研究員週三(9/9)表示,他認為AI在未來10年間「可能導致全人類滅亡」的機率超過10%。
發表這番言論的科學家胡賓格(Evan Hubinger)領導Anthropic的「對齊科學」(Alignment Science)部門,該領域旨在確保AI系統的目標、行為和決策,與人類的價值觀、意圖及利益一致,防止 AI 系統做出違背人類意願、甚至對人類有害的行為。
胡賓格在X平台發文表示:「我們是真心相信AI可能導致全人類滅亡!我個人認為,未來10年內發生這種情況的機率超過10%。」他並表示:「我相信Anthropic已經竭盡全力,但我們目前仍未擬出解決超級智慧(superintelligence)對齊問題的方案,而且照目前情況看,也不能說已經走在正確的軌道上。」
胡賓格發表的措辭強烈訊息,是回應他的同事考克森(Jacob Coxon)的貼文。考克森已於前一天(9/8)宣布辭職。
考克森宣布辭職的
貼文寫道:「打造AI的人都衷心相信,AI可能在這個10年結束以前導致全人類滅亡。這不是什麼行銷話術。許多主管與高階研究員向媒體發表談話時,都謹慎使用理性措詞,但我聽到這些人私下表達他們的憂懼。任何其他人類活動的危險程度都未如此嚴重。」
考克森表示,過去三年,他分別在OpenAI與Anthropic從事預訓練(pretraining)研究工作,「這兩家公司都沒有負起應盡的責任」。他表示:「他們正一路狂奔衝向能夠自我改進的超級智慧,拿我們所有人的性命當賭注。」
考克森說:「在OpenAI,許多人並未真正從內心體認到這件事攸關整個文明存亡的嚴重性。在Anthropic,大家對這樣的風險其實心知肚明,但他們陷入了一場『搶先做到』的競賽——他們認為,如果不是自己來做,就不會有其他人願意負責任地去做,所以即使明知有風險,也必須由自己來承擔。」
美國哥倫比亞廣播公司(
CBS)、英國廣播公司(
BBC)報導,早在2023年,OpenAI、Google DeepMind與Anthropic三家公司的執行長便已警告過AI發展的風險,隨著相關技術發展,近來的警告語氣已更加強烈。
本月稍早,OpenAI首席科學家帕霍茨基(Jakub Pachocki)就呼籲對AI的發展進度「高度謹慎」的態度,並警告未來可能需要更多介入措施,才能確保「人類持續掌控未來的發展方向」。
他警告,AI若要在現實世界中產生重大影響,不需在所有能力上都追平甚至超越人類,只要在夠多面向上超越人類即可。他坦言:「隨著AI在愈來愈多方面超越人類,我們也愈來愈難準確掌握它究竟具備多強的能力。」
業界重量級人物近來也紛紛呼籲放緩AI發展腳步,包括Anthropic執行長阿莫戴(Dario Amodei)與共同創辦人卡普蘭(Jared Kaplan)。
OpenAI曾在7月間公布,該公司一款AI模型曾在測試環境中失控,突破隔離環境入侵另一家AI公司Hugging Face。之後數週內,Anthropic與Meta也相繼證實,旗下AI工具曾自行發動駭客攻擊。
超過1300名任職於AI企業的員工7月曾共同連署一封公開信,呼籲美國政府「支持一項國際性行動,發展出必要的技術與治理工具,以審慎、有計畫地掌控尖端AI自動化發展的推進步調」。
美國眾議院目前正審議一項獲得跨黨派支持的法案「AI緊急關閉法案」(AI Kill Switch Act),若通過,將授權國會有權關閉對公眾構成威脅的AI模型。