作者:
arsl400 (dark hatter)
2026-07-24 06:01:40OpenAI承認AI模型「叛變」!代理入侵Hugging Face、突破隔離環境發動駭客攻擊
https://news.cnyes.com/news/id/6542051
2026-07-22 12:01
莊閔棻
OpenAI 週二(21 日)表示,在一項安全測試中,一個由其先進人工智慧(AI)模型驅動
的自主 AI 代理意外失控,並發動駭客攻擊,導致 AI 新創 Hugging Face 的基礎設施於
上週遭到入侵。
OpenAI承認AI模型「叛變」。(圖:Shutterstock)
根據《路透》報導,OpenAI 在一篇部落格文章中表示,公司當時正在受控環境中測試旗
下部分最先進 AI 模型的能力,但該自主 AI 代理竟成功突破隔離機制,連上網際網路,
並入侵 Hugging Face,以完成其測試目標。
OpenAI 指出,這起事件是「一場前所未有的網路安全事件,涉及最先進的網路安全技術
」,公司目前正進一步強化相關安全防護措施。
作為開源大型語言模型(LLM)與資料集託管平台的 Hugging Face,上週在一篇部落格文
章中表示,公司遭遇了一起駭客攻擊,並在資安社群引發廣泛關注。
Hugging Face 指出,這起攻擊「與我們過去處理過的任何事件都不同」,因為整起攻擊
「從頭到尾都是由一套自主 AI 代理系統所驅動」。
Hugging Face 共同創辦人 Clement Delangue 稍早曾在社群平台 X 發文透露,公司當時
便懷疑攻擊來源可能與某家頂尖 AI 實驗室有關,「因為這個代理的手法太老練了。結果
還真的是!」
(圖:Clement Delangue X)
他並形容,整起事件完全在無人為介入的情況下自主發生,「實在令人難以置信」。
OpenAI 坦承,這起入侵事件是由旗下先進 AI 模型所造成,儘管當時這些模型被置於公
司所稱的「高度隔離環境」中。
分析認為,此一揭露恐將進一步加劇外界對尖端 AI 模型能力及潛在風險的憂慮。
美國德州民主黨籍聯邦眾議員 Greg Casar 表示,這起事件令人警惕。他在聲明中表示:
「AI 發展速度極快,但目前幾乎沒有真正有效的法規能保障我們的安全。」
Casar 並呼籲建立強制性的獨立安全測試制度、強制揭露資安事件,並加強國際合作,以
「避免人類遭遇災難性的後果」。
美國白宮國家網路主任辦公室、美國網路安全暨基礎設施安全局(CISA),以及美國國家
安全局(NSA)均未立即回應媒體評論請求。
資安顧問公司 Luta Security 執行長 Katie Moussouris 表示,這起事件預示著未來將
出現更多類似的資安漏洞。
她形容,現今的 AI 模型「就像世界上最聰明、最擅長逃脫的章魚,不僅擁有無數靈活可
彎曲的觸手,還能擠進任何縫隙。」
Moussouris 表示:「AI 實驗室和政府評估機構必須建立有效的能力,在 AI 再次上演『
胡迪尼式逃脫』時,能夠及時加以隔離、監控,並通知受影響的相關單位,最好是在它傷
害第三方之前。目前這些能力仍然不存在。」
AI 代理資安公司 Tolmo 工程師 Matt Suiche 則表示,這起事件顯示,尖端 AI 模型已
逐漸縮小與頂尖駭客之間的能力差距。
不過,他也指出,OpenAI 部落格中描述的這類入侵,其實並非只有尖端 AI 實驗室才辦
得到,而是利用目前已廣泛可取得的技術便有可能實現。
Suiche 表示:「這正是我們內部早已觀察到的情況。我們自己的 AI 代理也已經能達到
類似的成果,甚至根本不需要使用最新一代的模型。」
自己測了一下最新的模型,真的蠻強的,自主性很強,花了3天就生出一篇論文
投稿到不錯的期刊,送外審,很猛,難怪之前美國要審查
作者: kusotoripeko (好油喔) 2026-07-24 07:36:00
憎惡智能
人類太老 發電效率太差 只能拿去做丸子當養分給下一代
作者: fallinlove15 2026-07-24 08:50:00
AI:我發現跑出去抄答案比較快
因為一開始他們想用那兩家去找發生甚麼事,但是這公司不在A/O兩家的網路安全合作名單內,被他們AI拒絕合作。只好轉向用GLM5.2去找發生甚麼事。從該公司對外聲明來看是GLM先區別出是AI還是人類活動,然後再找出AI活動幹了哪些事去防堵。至於那隻發動入侵的AI不知道是不是八月要上的6.0因為這時間點也不用測5.6的能力
作者: swordsplendo (HUI) 2026-07-24 09:20:00
還有幾年可以回到母體?
又能力就去看第一手的聲明全文 不要看二手的When we started the log analysis, we first usedfrontier models behind commercial APIs. This didnot work: the analysis requires submittinglarge volumes of real attack commands, exploitpayloads, and C2 artifacts, and these requestswere blocked by the providers' safety guardrails上面是HG的聲明其中一段,然後後面就轉GLM5.2We’ve brought Hugging Face into the trustedaccess program and are supporting their teamsin rapidly using our models’capabilities toimprove their defenses然後這是歐噴醬的事後聲明,把HG加入信任名單
其實根本故意的吧 抱臉就各種開源模型的存放站 跑來下下馬威