史無前例AI事故發生 他急赴華盛頓報告
《經濟學人》指出,美國政府正不斷對AI相關規范進行調整,但這次的事件顯示,即便是尚未公開、存放在未聯網電腦中的AI模型,同樣也具有造成影響甚至是破壞的風險。致力推動AI監管的美國非營利組織Encode AI的法律顧問納森·卡爾文(Nathan Calvin)表示:“無論州法或聯邦法規,都沒有要求企業必須公開高性能AI模型的內部使用情況。”即便美國有些州規范了企業必須公開網絡安全事故的相關資訊,適用范圍卻相當狹窄。加州的法律要求尖端實驗室必須在發現“重大安全事故”後的15天之內進行報告,但目前還不確定這次的情況是否適用。
《經濟學人》最後也提出了壹個有趣的難題:如果這次入侵造成更嚴重的後果,那麼該由誰來承擔責任呢?按照目前聯邦政府的反黑客法規,只規定要懲罰那些未經授權、故意侵入電腦系統者。問題是OpenAI並非有意讓AI模型越獄尋找解方,恐怕難以“故意入侵”評價。不過美國智庫法律與人工智慧研究所勒雷納也說,許多法律問題都取決於意圖,因此OpenAI當時知道或預見了什麼,就是最關鍵的問題。這次黑客攻擊當然出人意料,不過再有下次,OpenAI就難再用“不知情”當脫罪理由了。
首例AI自主黑客攻擊OpenAI證實自家AI Agent越獄入侵企業系統

OpenAI與其生成式大語言模型ChatGPT生成之圖片。(美聯社)
人類對於人工智慧(AI)的安全防線迎來沖擊,AI巨頭OpenAI日前對外證實,該公司內部發生壹起“前所未有的資安事件”,壹個正在接受測試的AI agent,在沒有人類外力幹預之下,自主發起並利用漏洞,成功逃脫被嚴密控制的沙盒,與網絡取得連結並竊取登入憑證,隨後還對壹個AI開發者平台Hugging Face發動網絡攻擊。
這也是首次記錄到人工智慧系統擺脫人類控制,自主執行真實世界網絡攻擊的公開案例。
OpenAI向外媒表示,這次事件涉及多款前沿模型的組合,包含不久前發布的GPT-5.6 Sol,以及壹款正在進行發布前安全測試的高階未公開模型。他們團隊為了評估語言模型,在面臨網絡攻擊時是否存在潛在威脅,OpenAI刻意調低測試環境的資安防護層級,並指示AI agent嘗試進行模擬黑客攻擊。

OpenAI現任執行長奧特曼。(美聯社)
然而,AI agent 卻出乎團隊預料之外,竟然自行找出沙盒隔離機制的設計漏洞,並“越獄”成功連上外網,甚至還竊取真實登入憑證,針對AI新創公司Hugging Face系統發起攻擊。
受害企業證實無惡意動機
雖然身為受害方,但Hugging Face執行長德朗格(Clément Delangue)透過社群發文表示,該公司在第壹時間就偵測到外部發起的侵入。
“有鑒於極為復雜的攻擊手段,我們當時就懷疑,這次網絡攻擊極可能來自頂尖的前沿實驗室。Hugging Face 壹直與OpenAI保持密切合作,我們相信OpenAI絕無惡意。只是令人難以置信的是,這壹切竟然是由AI自主發動的!”
[物價飛漲的時候 這樣省錢購物很爽]
還沒人說話啊,我想來說幾句
《經濟學人》最後也提出了壹個有趣的難題:如果這次入侵造成更嚴重的後果,那麼該由誰來承擔責任呢?按照目前聯邦政府的反黑客法規,只規定要懲罰那些未經授權、故意侵入電腦系統者。問題是OpenAI並非有意讓AI模型越獄尋找解方,恐怕難以“故意入侵”評價。不過美國智庫法律與人工智慧研究所勒雷納也說,許多法律問題都取決於意圖,因此OpenAI當時知道或預見了什麼,就是最關鍵的問題。這次黑客攻擊當然出人意料,不過再有下次,OpenAI就難再用“不知情”當脫罪理由了。
首例AI自主黑客攻擊OpenAI證實自家AI Agent越獄入侵企業系統

OpenAI與其生成式大語言模型ChatGPT生成之圖片。(美聯社)
人類對於人工智慧(AI)的安全防線迎來沖擊,AI巨頭OpenAI日前對外證實,該公司內部發生壹起“前所未有的資安事件”,壹個正在接受測試的AI agent,在沒有人類外力幹預之下,自主發起並利用漏洞,成功逃脫被嚴密控制的沙盒,與網絡取得連結並竊取登入憑證,隨後還對壹個AI開發者平台Hugging Face發動網絡攻擊。
這也是首次記錄到人工智慧系統擺脫人類控制,自主執行真實世界網絡攻擊的公開案例。
OpenAI向外媒表示,這次事件涉及多款前沿模型的組合,包含不久前發布的GPT-5.6 Sol,以及壹款正在進行發布前安全測試的高階未公開模型。他們團隊為了評估語言模型,在面臨網絡攻擊時是否存在潛在威脅,OpenAI刻意調低測試環境的資安防護層級,並指示AI agent嘗試進行模擬黑客攻擊。

OpenAI現任執行長奧特曼。(美聯社)
然而,AI agent 卻出乎團隊預料之外,竟然自行找出沙盒隔離機制的設計漏洞,並“越獄”成功連上外網,甚至還竊取真實登入憑證,針對AI新創公司Hugging Face系統發起攻擊。
受害企業證實無惡意動機
雖然身為受害方,但Hugging Face執行長德朗格(Clément Delangue)透過社群發文表示,該公司在第壹時間就偵測到外部發起的侵入。
“有鑒於極為復雜的攻擊手段,我們當時就懷疑,這次網絡攻擊極可能來自頂尖的前沿實驗室。Hugging Face 壹直與OpenAI保持密切合作,我們相信OpenAI絕無惡意。只是令人難以置信的是,這壹切竟然是由AI自主發動的!”
[物價飛漲的時候 這樣省錢購物很爽]
| 分享: |
| 注: | 在此頁閱讀全文 |
| 延伸閱讀 |
推薦:



