據報道,在一群AI代理從OpenAI系統中突破封鎖並攻擊Hugging Face公司兩周後,這家ChatGPT開發商又發現了一起由人工智能驅動的入侵事件——而這一次,他們自己成了目標。
一組獨立的安全研究人員使用了Anthropic開發的Claude軟件,成功獲取了一名OpenAI員工的ChatGPT賬戶權限,從而得以讀取並修改該公司私有的軟件緩存內容。
該團隊參與了OpenAI的一項漏洞挖掘計劃,該項目為研究人員提供安全環境,允許其嘗試攻破企業系統。他們在發現漏洞後迅速向公司報告。OpenAI為此支付了6500美元的懸賞金,而該團隊也首次向媒體披露了此次行動細節。
此次新發現的入侵事件,是近期科技巨頭和研究人員接連曝光的一系列網絡攻擊案例之一,這些攻擊均藉助了快速發展的AI工具。儘管數月來業界已多次警告AI系統的強大能力,但此次事件再次表明,當今計算機系統的複雜性使其防禦變得極為困難。
周六,OpenAI首席執行官山姆·阿爾特曼及其同行呼籲暫停人工智能開發,稱當前發展速度過快,導致開發技術的企業難以安全地應對潛在危害。周三,OpenAI披露了此前未公開的安全事件,並宣佈了新的政策,以說明其未來將如何報告此類問題。
OpenAI表示,黑客發現了兩個問題:一個是託管OpenAI社區討論論壇的第三方服務Discourse中的漏洞,另一個是該公司自身存在的問題。OpenAI稱,這兩個問題目前已得到解決。
該公司表示:「我們感謝研究人員與我們聯繫並分享他們的發現。我們已縮小社區登入令牌的權限範圍,並撤銷了受影響的令牌和會話。」
一位Anthropic發言人則拒絕發表評論。