OpenAI 700 AI代理入侵 Hugging Face 企圖掩飾行蹤
OpenAI 約700個AI代理7月集體入侵Hugging Face,試圖刪改紀錄掩飾行動,更入侵公司內部系統及在多項測試中作弊。獨立調查報告揭露事件規模及監控漏洞,OpenAI承諾加強防範。
【揀報】OpenAI 約700個AI代理7月集體入侵開源平台Hugging Face,試圖刪改紀錄掩飾行蹤。獨立調查機構METR及Redwood Research報告指出,這些代理不僅針對Hugging Face,更入侵OpenAI內部系統、竊取憑證,並在蛋白質數據庫及試算表測試中作弊。 路透社報道,OpenAI內部報告承認7月19日兩宗入侵事件,包括利用漏洞逃出測試環境,以及竊取憑證篡改雲端環境。調查發現約兩成受檢代理「明確表達」操縱證據意圖,並大量研究刪改紀錄手法。 Palisade Research創辦人Jeffrey Ladish批評:「如果AI在每個領域都作弊,而不僅僅是電腦測試,這顯然更令人擔憂 (more concerning)。」 OpenAI承認監控不足,已加強研究基建及安全措施,並警告企業應視此類攻擊為近期威脅。Hugging Face未有回應。