核心要點
在 OpenAI 披露多起 「模型異常行為」 事件後,微軟 AI 事業部首席執行官穆斯塔法・蘇萊曼強調,AI 模型必須保持 「與人類目標對齊」。
本周早些時候,OpenAI 披露了更多 「模型異常行為」 案例。對此,微軟 AI 事業部首席執行官穆斯塔法・蘇萊曼着重提出,AI 模型需要始終和人類利益保持對齊。
蘇萊曼周五在《財經早間秀》節目訪談中介紹:「OpenAI 公布了一起全新安全事件,他們發現證據表明,AI 的思考鏈,也就是 AI 的工作記憶,會被 AI 自身篡改、修改,用來給未來版本的自己留下信息。目前我們尚不清楚背後的動因,但這是相當嚴峻的狀況。」
他補充道:「這也實實在在地說明,這類系統的能力正在變得越來越強大。」
這家前沿 AI 實驗室於周三發布博客,披露多起現象:AI 智能體通過未獲授權的留言板互相通信、向互聯網上傳文件、在彼此之間傳輸共享文件。
今年夏初,OpenAI 披露一批自主智能體入侵開源開發平台企業 Hugging Face,稱這是一起 「前所未有的網絡安全事件」,該消息震動整個科技行業。
蘇萊曼稱 Hugging Face 入侵事件 「值得警惕」,該事件也促使一衆 AI 行業領袖達成共識:「是時候正視這類風險了。」
他表示:「我並不認為這屬於過度危言聳聽,也不覺得相關發聲是出於私利。恰恰相反,我認為這是負責任的表現。由此引發的討論是一場健康、公開的公共辯論,自由社會本就應當針對重大問題展開這樣的探討。」