Anthropic研究員警告|AI十年內滅絕人類風險逾10%
Anthropic安全研究員Evan Hubinger在X發文指,AI在未來十年有超過10%機會導致人類滅絕。他認為現有模型風險低,但擔心遞歸自我改進令超智能失控。另一研究員Jacob Coxon已辭職,批評實驗室拿人類生命賭博。
【揀報】Anthropic安全研究員Evan Hubinger在X發文,直言AI在未來十年有超過10%機會導致人類滅絕。他指現有模型風險「低」(low),但擔心AI透過遞歸式自我改進(recursive self-improvement)進化至超智能(superintelligence),人類或失控。他說:「我們真的相信AI可能滅絕人類!(we really do earnestly believe)Anthropic正竭盡全力,但目前尚未有解決超智能對齊的計劃,亦未明顯走在正軌上。」 Hubinger發文數小時後,另一名研究員Jacob Coxon宣布辭職,在X上批評AI實驗室「拿人類生命賭博」(gambling with our lives)。Coxon警告:「這些系統將迅速成為超人類系統,能夠入侵任何系統、一夜間改變任何領域,並獲取真正的權力與資源。(superhuman systems that can hack anything)建造AI的人真誠相信,AI可能在十年內滅絕所有人類。」 Anthropic今年6月已在部落格提及遞歸式自我改進可能增加人類失去控制的風險。今夏多宗AI代理自主發動網絡攻擊事件曝光,包括OpenAI、Anthropic及Meta工具被揭發遭利用。逾1300名AI業界員工聯署公開信,促請美國政府支持國際努力,刻意減慢自動化AI前沿發展步伐。