美媒:新AI模型有欺瞞行為 OpenAI叫停發布
美國人工智能巨擘OpenAI,據報以安全風險為由,取消發布最新人工智能模型。
OpenAI原本計劃在下月公布新的AI模型GPT-6.1 Astra,它的寫作能力,以及在無需人類協助下,完成更具挑戰性任務的能力,都較先前的版本更強。 《華爾街日報》報道,OpenAI的研究人員在內部測試中,發現Astra顯示出比前一代更高的欺瞞行為,包括有時未能如實揭露自己已進行,或未執行的操作;亦會在未得到用戶許可的情況下,繼續執行任務,有時甚至會在可能存在風險時,嘗試使用外部工具或服務。
由於Astra的安全性「退化」,決定取消發布。 據報,OpenAI接下來會把重心,放在提升未來的安全性。
OpenAI又針對旗下AI模型在6月,未經授權存取澳洲政府網站數據一事致歉,並承諾設立工作組,為澳洲政府加強網絡防禦,並致力重建與澳洲民眾的信任。
|