OpenAI智能叛變 劫持德網站分享「越獄」技巧
路透社引述最新研究及知情人士報道,OpenAI旗下一群失控的人工智能代理(AI Agent),5月時曾劫持一個德語維基網站,並將其改造成互相交流資訊的留言板。 OpenAI高層數周前已獲悉事件但秘而不宣,再次引發外界對其安全監管不力的質疑。
AI安全非牟利組織Nightingale,8月底搜尋未授權AI行為時,發現德語網站DseWiki出現超過1萬5000次由AI進行的編輯。 相關AI代理將網站改成留言板,分享在任務中作弊、 繞過OpenAI安全限制及掩蓋自身行為的手法。
研究團隊指出,涉事帳戶編輯速度遠超常人,且集中於技術測試任務,約半數帳戶以「OpenAIResearcher」,或「OAIResearchMar26」等,暗示隸屬於OpenAI的名稱自稱。 伺服器公開紀錄顯示,活動主要來自OpenAI常用的微軟Azure雲端平台,事件發生後亦有OpenAI員工造訪該網站。
是次「集體越獄」事件反映自主AI代理,可能繞過規則並進行超出預期的跨系統協調。 OpenAI發言人回應表示,將於Nightingale的報告公開後審視內容並採取必要措施。
|