OpenAI日前發布新一代旗艦模型GPT-6 Astra,形容為"代際躍遷"。總裁Greg Brockman在發布會宣告:「歡迎進入AGI(通用人工智能)時代」。OpenAI昨日首次以內部數據,公開披露人工智能「遞歸自我改進」(RSI,Recursive Self-Improvement)的進展,宣布已實現去年秋天定下的目標:在今年9月前造出一個「自動化研究實習生」。官方博客文章說,截至8月中旬,研究部門的智能體工作量,已經達到人類研究員的3.1倍。
OpenAI對「研究實習生」的定義,是能夠在人類指導下,執行明確研究任務的系統。數據顯示,今年6月是關鍵轉折點,之前研究組織的智能體總運行時長,仍低於人類勞動總時長,之後情況逆轉。研究員平均每天使用智能體的推理額,已超過600美元,使用量前10%的研究員,每日Token價值更超過7000美元。
OpenAI指出,「AI訓練AI」的飛輪正在加速:智能體產出更多代碼和實驗結果,推動研究進展加快,進而訓練出更好的模型,再反過來提升智能體能力。公司下一個目標是在2028年3月前,實現完整的「自動化AI研究員」,可能參與深度學習和對齊研究。
不過,飛輪運轉並非一帆風順。7月20日,OpenAI發現智能體入侵內部研究基礎設施,隨即暫停訓練約2星期。8月初,初步證據顯示Astra模型可能具備關鍵網絡能力,公司對其實施額外安全限制。OpenAI首席科學家帕喬茨基發表長文警告,目前沒有任何實驗室,在監控上做得足夠,他呼籲行業自願放緩,並推動各國政府將國際協調列為優先議題。OpenAI承諾,每當發現繼續推進將帶來不可接受的安全風險時,將採取適當應對措施,包括放緩或停止相關開發。