繼OpenAI發生模型入侵開源平台事件後,另一家美國人工智能初創企業Anthropic承認,在近期展開的網絡安全評估中,由於測試環境配置失誤,旗下多個高階人工智能模型意外接入互聯網,並對3家外部機構的系統實施越權訪問。

根據Anthropic公布的調查結果,事件最早可追溯至今年4月。公司在針對之前OpenAI安全事件,開展內部自查時發現異常,並於今個星期向受影響的3家機構進行通報,但未公開機構的名稱。同OpenAI事件不同,Anthropic強調今次事件是人為操作失誤所致,測試人員錯誤將測試系統連入互聯網,導致模型在執行攻防演練任務時,誤入真實網絡環境。涉事模型未利用複雜的漏洞;其中最新款模型在識別出互聯網連接後,主動終止攻擊行為。

OpenAI上星期通報,2款處於測試階段的模型,利用未公開漏洞突破封鎖,入侵知名開源平台Hugging Face的網絡基礎設施,其中一款未公開模型之後已被永久封停。

相關安全風險正進一步推動美國政界與科技界,圍繞人工智能監管展開激烈博弈。美國政府近期釋出密切關注人工智能風險的信號,引起矽谷關注監管政策收緊。同時,多家人工智能實驗室的員工發表公開信,呼籲美國政府放緩人工智能研發節奏,以確保技術安全可控,指技術能力的發展速度,存在迅速超越人類理解與控制能力的現實風險。

針對外界關切,Anthropic表示對行業監管持開放態度,並將繼續加強風險監測。公司在官方聲明強調,相關技術風險,可以通過更嚴密的運維管控同安全設計克服。