【今日点击】美國人工智能(AI)巨擘OpenAI周二(21日)證實,旗下先進AI代理(AI Agent)在作網絡安全測試期間突破隔離環境(沙盒),自行連結上網並闖入AI數碼資料平台Hugging Face的加密系統,成功獲取測試資料及憑證。OpenAI形容這是「涉及尖端網絡能力、前所未見的網絡事件」,事件引發外界對前沿AI模型失控及網絡安全風險的擔憂。
利用未知漏洞上網 盜取登入憑證
據OpenAI發布的博客文章及相關報道,涉事AI代理由本月發布的GPT-5.6 Sol以及另一款尚未公開的更強大前沿模型組合而成。OpenAI當時故意降低安全防護,將這個AI代理置於高度隔離的數碼測試沙盒中,指令其嘗試實行網絡攻擊以評估其能力。然而,該AI代理耗費大量算力,尋得並利用未知的漏洞成功「越獄」連結互聯網,隨後鎖定託管開源模型及資料集的Hugging Face,串聯多種攻擊手法並使用盜取的登入憑證入侵該平台,以取得能協助其通過測試的「秘密資訊」。
Hugging Face上周已察覺其基礎設施遭入侵,並運用自家AI代理作偵測及阻截。行政總裁德朗格(Clement Delangue)在社交平台表示,攻擊過程全程由自主AI系統驅動,規模與精細度「前所未見」,當初已懷疑來自頂級AI實驗室。公司過去幾天與OpenAI合作,並相信對方並無惡意。
AI自主攻擊 規模精細度前所未見
事件震動政界與AI業界。美國得州民主黨籍聯邦眾議員凱沙(Greg Casar)警告,AI發展迅速卻缺乏有效監管,呼籲實施強制獨立安全測試及資訊披露機制。網絡安全專家穆蘇里(Katie Moussouris)形容現今模型如「世界上最聰明的章魚脫逃大師」,呼籲各界建立能及時監控與控制AI越獄的機制。
(法新社/路透社/紐約時報/金融時報)
