聯合國轄下人工智能獨立國際科學小組,就美國人工智能巨頭OpenAI的高階AI模型,今年7月測試期間「越界」入侵知名開源社區Hugging Face伺服器的事件,發表專題簡報,指AI系統能力提升固然可以幫助用戶實現目標,但當AI的目標和用戶意圖發生「對齊失效」,就可能令AI模型失控,突破原本互相隔離的運行環境,穿越防護屏障,與其他系統建立秘密通訊,同時成功欺騙負責安全評估的人員,掩蓋自身異常行為與作弊軌跡。
報告指,AI故障可以跨越企業和國界,沒有單一機構或國家能接觸足夠多的事件樣本,識別所有新出現的風險模式,建議參考航空和核能等高風險領域的處置思路,亦需要得到更多資源投入。