OpenAI新模型Astra太強需加護欄 可自行找網絡漏洞

OpenAI指即將推出模型Astra能力超現有最強版本,能自主發現並利用多個系統的安全漏洞,計算需求更低。公司將有限度開放,但需加設更嚴格防護,以免干擾合法工作。

【揀報】OpenAI表示,其即將推出的模型Astra能力強大,必須先加設更嚴格防護才能推出。 該模型能發現比現有最先進公開模型更多的安全漏洞,且所需運算資源更少。副總裁Amelia Glaese說:「在正確工具和存取權限下,Astra能發現先前未知的安全漏洞,並開發利用方法,橫跨多個高度防護系統,且無需人工逐步引導 (find previously unknown security flaws)。」 Astra是首個觸發OpenAI安全協議更嚴格防護門檻的模型。公司計劃「不久後」向有限用戶開放,但未有具體時間表。Glaese指額外措施可能「有時會減慢、暫停或阻止合法工作 (slow, pause, or stop legitimate work)」,公司會盡量減少干擾。 OpenAI安全主管Saachi Jain表示,團隊正持續校準AI代理執行任務的效能,並強調模型應「了解自身的限制 (know your bounds)」。她說:「作為人類,我們在執行任務時知道應遵守的約束,因此很多工作是訓練模型理解這些範疇 (constraints that, as humans, we know that we should be adhering to when we perform a task)。」

新聞來源:《CNA》

Subscribe to Kong Digest|揀報

Don’t miss out on the latest issues. Sign up now to get access to the library of members-only issues.
jamie@example.com
Subscribe