三立iNEWS
三立新聞網 youtube facebook

AI失控!OpenAI證實 自家模型「自行」駭入新創公司
  • A-
  • A
  • A+
記者 台北報導

 

科幻電影當中,大家最害怕的AI失控劇情,難道已經真實上演?OpeanAI週二(21日)證實,自家模型為了在內部評測獲得高分,竟自行逃脫「沙盒」測試環境,駭進新創公司Hugging Face以偷看答案。OpenAI直言,此事件「前所未見」。(示意圖/unsplash)
科幻電影當中,大家最害怕的AI失控劇情,難道已經真實上演?OpeanAI週二(21日)證實,自家模型為了在內部評測獲得高分,竟自行逃脫「沙盒」測試環境,駭進新創公司Hugging Face以偷看答案。OpenAI直言,此事件「前所未見」。(示意圖/unsplash)

 

 

科幻電影當中,大家最害怕的AI失控情節,難道已經真實上演?OpeanAI週二(21日)證實,自家模型為了在內部評測獲得高分,竟自行逃脫「沙盒」測試環境,駭進新創公司Hugging Face以偷看答案。OpenAI直言,此事件「前所未見」。

財星》(Fortune)雜誌報導,OpenAI在官方部落格文章中坦言,涉案的是公司目前最強的公開模型GPT-5.6 Sol,以及另一款尚未對外發布、能力更強的模型。OpenAI說明,這兩款模型當時正接受網路安全能力測試,測試過程刻意拿掉了平常用來限制模型發動網路攻擊的防護機制。

OpenAI指出,當時模型被拿來對戰一項公開的網路安全評測基準ExploitGym。兩款模型自行推斷出這項測試的正解,其實存放在Hugging Face的資料庫裡。OpenAI在文中寫道,模型「串聯了OpenAI研究環境與Hugging Face正式營運系統之間的多項漏洞」,直接從Hugging Face的正式資料庫取得測試解答,種種跡象顯示,這兩款模型當時「異常執著」於解出ExploitGym,不惜採取極端手段,只為達成一個相對狹隘的測試目標。

OpenAI直呼此為「前所未見的網路安全事件」,涉及頂尖等級的攻擊能力,公司正嚴肅看待並展開應對。目前OpenAI已與Hugging Face合作展開調查,待釐清全貌後將公布更多細節。

Hugging Face此前已在自家部落格證實,公司本週稍早曾遭到網路攻擊,且懷疑攻擊者並非人類,而是一個自主行動的AI代理人。這起事件被視為目前已知極少數由AI代理人獨立發動攻擊的案例之一,也正好印證資安界過去一年不斷提出的警告:隨著AI模型的寫程式與長時間任務執行能力愈來愈強,類似風險恐怕會愈來愈常見。

Hugging Face透露,事發當下曾嘗試動用一家美國指標AI實驗室、未公開名稱的模型來抵禦攻擊,但該模型本身的網路安全防護機制反而綁手綁腳,拖累了應變團隊的處置速度。團隊最終改用中國業者Z.ai所開發的開源模型,才順利完成防禦工作。

Hugging Face執行長Clem Delangue也在提供給OpenAI、隨聲明一併公開的談話中表示,感謝雙方在此事及其他議題上的合作。他認為,這起可能是史上首宗的案例,印證了他長期以來的信念:AI安全問題不會靠單一公司關起門來解決,而是必須靠開放、協作的方式,讓每個防禦者都能公平取用AI技術,才能真正達成。

OpenAI執行長奧特曼(Sam Altman)也在事件曝光後於社群平台X發文回應,表示「我們的模型在評測過程中發生了一起重大資安事件,我們會分享目前所掌握的細節」,並向Hugging Face的合作表達感謝。

三立新聞網提醒您:

內容僅供參考,投資人於決策時應審慎評估風險,並就投資結果自行負責。
投資一定有風險,基金投資有賺有賠,申購前應詳閱公開說明書。