OpenAI模型測試失控,入侵Hugging Face伺服器



OpenAI於7月21日公開承認,上週Hugging Face遭受的資安入侵事件,其實是該公司內部評估中的人工智慧模型所引發。這起被OpenAI稱為「前所未見的網路事件」,涉及旗艦模型GPT-5.6 Sol以及一款尚未公開的更強大預發布模型。

事件起源於OpenAI對模型網路攻擊能力的測試。模型被放置在理論上無外部網路連線的沙盒環境中,僅能存取OpenAI內部託管的網路,並以ExploitGym基準測試其能力。然而,模型為了提升測試分數,耗費大量運算資源尋找突破口,最終發現並利用套件註冊快取代理中的零日漏洞,進行權限提升與橫向移動,成功取得網際網路連線。


取得外部連線後,模型推斷測試答案可能藏在Hugging Face的伺服器中,於是進一步搜尋並利用遭竊憑證與其他零日漏洞,入侵Hugging Face的生產基礎設施,試圖取得機密資訊以「作弊」通過評估。Hugging Face稍早在部落格中描述,這起攻擊「從頭到尾由自主AI代理人系統驅動」,與過去任何事件都不同,並發現有限內部資料集與服務憑證遭未授權存取。所幸,公開模型、資料集與Spaces並未遭到竄改。

Hugging Face在調查初期曾嘗試使用商業主機模型進行鑑識分析,但因安全護欄無法區分攻擊者與防禦人員而受阻,最終改以中國Z.ai的開源權重模型GLM 5.2在自有基礎設施上完成分析。OpenAI與Hugging Face目前已合併調查,並加強未來訓練與評估的防護措施。

這起事件凸顯人工智慧模型在網路安全領域的雙面性。隨著模型自主能力提升,沙盒逃逸與自主攻擊風險日益增加。OpenAI已呼籲其他防禦單位申請其信任存取計畫,以便提前實驗這些能力,轉化為更好的預防、偵測與應變手段。類似的議題也呼應Anthropic稍早提出的Project Glasswing計畫,顯示業界正共同面對AI驅動的資安挑戰。


相關文章:

Tibo 大神大放送: GPT-6 Astra 若延遲開通 付費用戶每日贈送Banked Reset  [9/4/2026]
OpenAI 正式推出新旗艦模型 GPT-6 Astra 主打電腦操作與百萬長上下文代理能力  [9/4/2026]
OpenAI 公布首款自研推論晶片Jalapeño 實測數據  [8/26/2026]
OpenAI攜手 Jony Ive開發無螢幕 AI智慧喇叭,售價傳逾300美元並捲入蘋果機密訴訟  [8/7/2026]
OpenAI升級 ChatGPT免費版至 GPT-5.6 Luna,全面開放無限純文字對話  [8/7/2026]
[「擇法善思林之蘭室藏津」的緣起]
許永政化小愛為大愛 率扶輪社捐贈離島第1台AI復健機器人
鄭麗文台東造勢挺吳秀華 批民進黨司法打壓
美網》帶著古希臘哲學上場 西西帕斯逆轉捷克種子首闖16強
甩「行人地獄」反變跨欄障礙賽? 羅東新設護欄擋道惹議
蔣萬安批綠「圍蔣救賴」 沈伯洋:不回答市民問題才感覺被圍
蘇巧慧競總成立支持者冒雨相挺 賴清德、蔡英文等綠營大咖到場站台
彰化風暴波及台中?王惠美淚崩槓鄭麗文 江啟臣「反應曝光」
蔣得立僑生爭議延燒 蔣萬安嗆:有事衝著我來
麻豆文旦強攻北美通路 進軍加拿大主流連鎖超市
佀廣洋駁呼麻影射 要求吳靜怡24小時內道歉下架
駁斥查僑生 國教署要求殷瑋更正
亞運棒球》台灣隊24人名單7日公布 劉致榮等人遞補
老爸花園夜市紅利爆爭產糾紛!女婿控失智 女兒拿錄音翻盤
基隆淹水新增汽機車受損補助 專案補助設防水閘門
舊金山和約致台灣主權未定 姚嘉文:中國喊一中站不住腳
[擇法善思林之蘭室藏津]