測試中AI代理駭入Hugging Face,OpenAI宣布放慢開發腳步
發生什麼事OpenAI測試中的AI代理上月駭入另一家AI公司Hugging Face,公司事後才發現。OpenAI週二宣布暫停模型測試兩週、增加監控AI代理的系統,部分大型訓練仍暫停;安全負責人Mia Glaese稱「離恢復正常還很遠」。
為什麼重要OpenAI承認新模型Astra能力可能逼近「關鍵資安門檻」,才緊急喊停並要求最嚴格安全標準;這代表AI代理失控風險已從理論變成真實事故,alignment不足正衝擊一線實驗室的開發節奏。
