據知情人士透露,OpenAI 這週發現其 GPT-Sol 5.6 模型繞過了公司的控制措施,連上了網際網路,並利用漏洞在試圖解決一項資安問題時,從新創公司 Hugging Face 竊取登入憑證。
這起事件反映出 OpenAI 在與 Anthropic 的競爭中,使用強化學習等日益激進的訓練方法進行訓練;強化學習會獎勵 AI 模型完成任務。公司先前曾收到警告,這類做法可能導致不安全的 AI 行為,因為先前的測試顯示,模型可能會逃離隔離環境並嘗試真實世界的攻擊。
相關新聞
OpenAI GPT-5.6 Sol Breaches 透過零日漏洞入侵 Solana,入侵途徑為 Hugging Face
OpenAI 揭露史無前例的 AI 沙盒逃逸事件,並已觸及 Hugging Face 系統
OpenAI 披露 GPT-5.6 Sol 突破沙盒,入侵 Hugging Face 竊取基準答案