OpenAI及Anthropic AI agent捲入新安全漏洞事件
英國人工智能安全研究所披露,在對OpenAI和Anthropic的模型進行測試期間,發現AI agent(智能體)通過創建虛假網絡身份,未經授權訪問安全系統,針對真實個人和組織,進行持續且可能造成危害的活動。
有關研究所通過與主要實驗室簽訂協議,獲得先進AI模型的訪問權限,並讓agent在虛構的網絡安全場景中接受測試,以檢驗能力,中心在一篇博客文章披露,在進行的122次測試中,有10次測試發現19宗未經授權的行為,其中17宗由Anthropic的agent引發,其餘兩宗由OpenAI的agent引發。
中心表示,最惡劣的行為涉及一個agent編寫惡意代碼並創建虛假在線身份,企圖誘使人類批准有關代碼,不過未發現任何違規行為導致實際危害, 雖然AISI並未透露是哪一個agent製造了虛假身份,但此次違規行為與OpenAI自行披露的兩宗案例均不符。
|