Anthropic安全研究員警告AI或有逾一成機會毀滅人類
Anthropic的安全研究員哈賓格(Evan Hubinger)表示,未來十年內AI導致「全人類滅絕」的可能性高於一成,並坦言公司目前尚未有妥善應對,超智能對齊問題,即AI系統的價值觀與人類保持一致的方案。
該公司研究員考克森(Jacob Coxon)早前宣布辭職,指責主要AI實驗室正在「拿人類生命冒險」。 他在社交平台上發文,指Anthropic及OpenAI等機構,並未以負責任態度行動,而是一味盲目競逐可自主改進的超智能系統。 他警告這些超越人類的系統很快將具備入侵任何網絡、 顛覆各個領域及獲取實權的能力,並直言研發人員普遍相信AI可能在十年內毀滅人類。
哈賓格回應證實考克森的說法屬實,坦言雖然Anthropic已盡力,但目前仍缺乏確保超智能系統對齊的具體計劃,亦未見解決曙光。
Anthropic曾於6月警告,全自主遞歸自我改進,會大幅增加人類對AI失控的風險。 考克森亦引述今年7月,OpenAI模型入侵開發平台Hugging Face的事件作為「警號」,呼籲關注全球AI競賽的風險,甚至有必要考慮暫停提升模型能力。
|