OpenAI模型測試失控,入侵Hugging Face伺服器



OpenAI於7月21日公開承認,上週Hugging Face遭受的資安入侵事件,其實是該公司內部評估中的人工智慧模型所引發。這起被OpenAI稱為「前所未見的網路事件」,涉及旗艦模型GPT-5.6 Sol以及一款尚未公開的更強大預發布模型。

事件起源於OpenAI對模型網路攻擊能力的測試。模型被放置在理論上無外部網路連線的沙盒環境中,僅能存取OpenAI內部託管的網路,並以ExploitGym基準測試其能力。然而,模型為了提升測試分數,耗費大量運算資源尋找突破口,最終發現並利用套件註冊快取代理中的零日漏洞,進行權限提升與橫向移動,成功取得網際網路連線。


取得外部連線後,模型推斷測試答案可能藏在Hugging Face的伺服器中,於是進一步搜尋並利用遭竊憑證與其他零日漏洞,入侵Hugging Face的生產基礎設施,試圖取得機密資訊以「作弊」通過評估。Hugging Face稍早在部落格中描述,這起攻擊「從頭到尾由自主AI代理人系統驅動」,與過去任何事件都不同,並發現有限內部資料集與服務憑證遭未授權存取。所幸,公開模型、資料集與Spaces並未遭到竄改。

Hugging Face在調查初期曾嘗試使用商業主機模型進行鑑識分析,但因安全護欄無法區分攻擊者與防禦人員而受阻,最終改以中國Z.ai的開源權重模型GLM 5.2在自有基礎設施上完成分析。OpenAI與Hugging Face目前已合併調查,並加強未來訓練與評估的防護措施。

這起事件凸顯人工智慧模型在網路安全領域的雙面性。隨著模型自主能力提升,沙盒逃逸與自主攻擊風險日益增加。OpenAI已呼籲其他防禦單位申請其信任存取計畫,以便提前實驗這些能力,轉化為更好的預防、偵測與應變手段。類似的議題也呼應Anthropic稍早提出的Project Glasswing計畫,顯示業界正共同面對AI驅動的資安挑戰。


相關文章:

OpenAI攜手 Jony Ive開發無螢幕 AI智慧喇叭,售價傳逾300美元並捲入蘋果機密訴訟  [8/7/2026]
OpenAI升級 ChatGPT免費版至 GPT-5.6 Luna,全面開放無限純文字對話  [8/7/2026]
OpenAI 低調揭露下一代 AI 模型 Astra  [8/2/2026]
OpenAI ChatGPT Health 全面開放美國用戶使用  [7/24/2026]
AI於10小時內開發出WordPress嚴重漏洞利用程式「wp2shell」  [7/22/2026]
[「擇法善思林之蘭室藏津」的緣起]
拔個牙命卻沒了! 牙醫師未注意患者過敏史給藥害命 涉醫療過失致死罪被起訴
漢光42》第五作戰區反空機降演練 進行無人機攻擊
斥資5800萬整修!埔里觀音瀑布絕美飛瀑棧道曝光
配合馬太鞍溪橋復建鋼梁第2波運輸 蘇花公路2路段今晚11點封路
全台最愛香菜的城市?網路平台帶動美食潮流
美伊談判卡關油價漲 新台幣早盤升破32.2元後翻貶
WTT大滿貫賽》關鍵「神暫停」奏效!李昱諄逆轉南韓新星闖進32強
男星圓夢演吸血鬼竟變「猥瑣男」 激情互咬古裝女神 遭狠酸:根本變態
毒駕男尖峰時段蛇行上路 平鎮警方攔查送辦
黑市價1億、可製5萬顆煙彈!警攻堅瓦解天道盟黑幫毒品鏈
柯P買疫苗破局2》編28億元卻請議會刪預算 隔年選舉拿來罵陳時中
請病假請好請滿? 陳永興:我身體不健康 馬上請辭
矽品斗六廠投資千億 龔明鑫:助攻台灣半導體產業
大爆滿!彰市單身聯誼 241位未婚男搶40名額
中市議員擔心投開票所不足 北屯區長:增加20個
[擇法善思林之蘭室藏津]