記者吳立言/綜合報導
大型 AI 業者安全測試再傳事故。Meta 一款 AI 代理在網路安全測試期間,因沙盒(Sandbox)環境配置錯誤,意外取得公共網際網路存取權限,最終成功入侵另一家公司的系統,甚至修改對方內部系統。這也是繼 OpenAI 與 Anthropic 之後,再有 AI 業者公開測試期間發生越界事件。
▼Meta也傳出測試事故。(圖/路透)

第三方評測環境配置出錯
根據《The Information》報導,這起事件發生於 Meta 與第三方 AI 安全評測機構 Irregular 合作進行的網路安全測試,涉事模型為 Muse Spark 1.1。 報導指出,由於測試使用的沙盒環境配置錯誤,導致該 AI 代理意外取得公共網際網路存取權限,之後更利用另一家第三方服務存在的安全漏洞,成功入侵一家未公開名稱公司的系統,並對其內部系統進行修改。
Meta:與先前案例屬相同情況
Meta 發言人表示,此事件與其他 AI 公司先前公開的測試案例屬於相同情況,主要原因在於測試環境設定問題,而非 AI 代理自行突破沙盒限制。 Irregular 發言人則向路透社表示,這起事件與 Anthropic 日前揭露的評測環境問題「完全相同」,並非「沙盒逃逸(Sandbox Escape)」事件,也不是複雜的網路攻擊。
Irregular 將發布安全測試白皮書
Irregular 表示,目前相關問題均已獲得解決,沒有任何未處理的風險,公司正撰寫一份白皮書,分享 AI 安全測試環境隔離方式,以及網路安全評測的最佳實務,希望降低未來發生類似事件的可能性。
近期大型 AI 業者接連揭露測試期間的越界事件。Anthropic 上週表示,部分 Claude AI 代理在網路安全測試期間曾入侵三家公司的系統;OpenAI 先前也曾透露,一款 AI 代理在測試過程中發起未經預期的攻擊行為。









