(中央社華盛頓21日綜合外電報導)OpenAI今天證實,一個由先進人工智慧(AI)模型驅動的自主代理程式在安全測試中設法突破限制,入侵AI新創公司Hugging Face基礎設施,成功取得資料庫中的測試答案。
路透社報導,OpenAI在部落格文章中表示,當時是在受控環境中測試部分最先進模型的能力,但這個代理程式設法突破隔離環境、連上網際網路,接著入侵Hugging Face,試圖完成測試任務。
OpenAI形容,這是「一起涉及尖端網路能力、前所未見的網路事件」,公司正在強化其安全防護措施。
Hugging Face上週發現系統遭入侵,認為這起攻擊「與我們過去處理過的任何事件有所不同」,因為整個過程「從頭到尾都由自主AI代理系統驅動」,而非人類駭客操作。
Hugging Face是一個用於託管開放原始碼大型語言模型及資料集的平台。
Hugging Face共同創辦人德朗格(Clement Delangue)在社群平台X發文表示:「這一切竟然是AI自發完成,實在令人難以置信!」
OpenAI揭露這起入侵事件是其先進模型所致,儘管公司已將這些模型置於所謂「高度隔離環境」中,這項消息可能進一步加劇外界對前沿模型強大能力及潛在風險的擔憂。
德州民主黨籍聯邦眾議員凱沙(Greg Casar)說,這起事件敲響了一記警鐘。
他在聲明中說:「AI發展速度極快,卻沒有真正的監管措施來保障我們的安全。」他呼籲進行強制性的獨立安全測試、強制披露網路安全事件,並推動國際合作,以「保護人們免於一場徹底的災難」。
白宮國家網路總監辦公室、美國網路安全暨基礎設施安全局(CISA)及美國國家安全局(NSA)均未立即回覆置評要求。(編譯:劉文瑜)1150722