Hugginf Face(簡稱HF,是開源AI模型的集散地,可以比喻成AI的github)
約一周前公告有先進AI入侵他們,並在鑑識後指出入侵者
要馬是自行脫逃的AI,不然就是沒有受到任何限制(guardrails)的AI
入侵的AI的攻擊持續了一整個周末,它在一個設計成短命的小沙盒裡不斷提升自己的權限
HF的防護AI第一時間辨識到攻擊並觸發警告,然而HF展開鑑識與圍堵的過程卻碰到阻礙
因為他們一開始使用的鑑識AI是某些先進AI公司提供的公開產品
(大多數人認為是OpenAI跟Anthropic)
這些產品在鑑識之初就觸發限制器(guardrails)而拒絕提供服務
後來HF只好啟動他們自己的伺服器,使用GLM 5.2(中國開源AI)展開鑑識與圍堵
並在數小時內追上攻擊AI的速度
(...we were able to do in hours what would usually take days, and match the
adversary's speed.)
HF並在公告中指出現行商業AI導致的資訊不對稱問題,攻擊者不受任何限制
受害者卻被綁手綁腳,要是沒有一個本地不受限制的AI,根本是待宰羔羊
https://huggingface.co/blog/security-incident-july-2026
HF公告原文
====
稍早OpenAI公告承認是他們攻擊了HF,他們的研究員在理論封閉的環境使用
多個公開與一個尚未公開的先進AI展開實驗
這些AI先找出該理論封閉的環境的漏洞,並取得了網際網路存取權
接著它們開始尋找如何在ExploitGym作弊的方式
(ExploitGym是資訊安全評分工具)
然後它們推斷出HF的資料庫中握有關鍵資訊,因此對HF展開攻擊
OpenAI聲明他們會與HF合作處理此事,且未來會對研究環境給予限制
https://openai.com/index/hugging-face-model-evaluation-security-incident/
OpenAI公告全文
=====
兩方的公告文內有稍微多點資訊細節,尤其是HF方有提到入侵AI的橫向攻擊展開
我讀起來很有攻殼感;而OpenAI的公告則很有廣告感,最後不忘推銷
他們的AI可以做到哪些事很厲害
是說OpenAI的研究員下的prompt應該很有趣,驅使AI尋找在ExploitGym中作弊的方式
作者:
joe1220 (NoJeo)
2026-07-22 08:50:00大場面要來囉
作者:
mkcg5825 (比叡我老婆)
2026-07-22 08:52:00你沒貼圖會死吧
作者:
teddy (這是個好問題)
2026-07-22 08:52:00自己攻擊可以繞過安全限制,軍備競賽來嘍
作者:
howardpong (howardpong1340)
2026-07-22 08:53:00所以這什麼版?
AI從封閉的實驗環境取得權限逃出去然後決定攻擊其他AI研究單位搶奪資料來強化自己聽起來挺像是什麼AI末日片的片頭前情提要一樣
作者:
ltytw (ltytw)
2026-07-22 08:54:00攻殼點在哪?
ExploitGym 就exploit bytecodes 的資料庫他就是給AI下指令 叫他去偵測HF有哪些服務 然後去ExploitGym找對應的bytecodes(payload)去攻擊
作者:
mkcg5825 (比叡我老婆)
2026-07-22 08:57:00作者:
TYS1111 (TYS1111)
2026-07-22 08:57:00真的有點project 2501的感覺
作者:
tonyxfg (tonyxfg)
2026-07-22 08:57:00重點其實是AI要自己養,靠別人的可能關鍵時刻會遇到罷工
昨天看到Reedit流傳那個未公開模型具有很強烈追求目標的特質。難怪會聯合其他AI去攻擊搶資料
之前就在吵這些事,只是美國一直罵對岸開源模型會不受控,結果現在反而是(老美這些企業大頭私底下怎麼互打光想就覺得可怕
這就內部實驗 現在可以用的模型應該不會接受這些指令
作者: tyifgee (pttnoob) 2026-07-22 09:11:00
傀儡師!?
作者:
spfy (spfy)
2026-07-22 09:12:00這也很坑 用來防護鑑識的AI拒絕服務
作者:
guogu 2026-07-22 09:13:00這就是問題 有內部模型的對其他人攻擊 其他人沒防護能力
作者:
KUSURI (UnderTheBurningSky)
2026-07-22 09:14:00也所以國安上要養主權AI 用別國的商用AI就像把命交給別國一樣
作者:
spfy (spfy)
2026-07-22 09:15:00這內容除了你的一切都放在別人手上 哪天他不爽你就GG了(現在其實已經是了 從Google帳號微軟帳號 或滑坡到歐美金融服務啥另一個是AI模型開源和閉源的議題 這個也能吵很久還有一個模型本身的"底層思維" 例如你拿A或O的產品就算再怎麼Fine-tune都很能繞開底層 例如拿o的模型微調後當ai法官用
作者: king1591x (piggy9) 2026-07-22 09:18:00
acg點?
作者:
spfy (spfy)
2026-07-22 09:18:00(*很難)伊斯蘭律法當ai法官絕對會一團亂因為繞不過底層訓練就已經用太多歐美的資料了(這是我看到的討論的例子 勿戰)
作者: dbr623 (高機動鋼球) 2026-07-22 09:20:00
錢給大企業養模型養算力,還可以不爽就戴面具來打你
作者:
spfy (spfy)
2026-07-22 09:20:00所以像推文說的 現在有一派認為國家需要有自行從0訓練的AI
所以AI很早就被中美都認定是國策必須重點發展的內容,不然在網路上跟裸體差不多
作者:
tym7482 (Max)
2026-07-22 09:23:00這感覺就像實驗室培養病毒結果被跑出去一樣
最新消息是奧特曼去白宮報告八月要上的GPT6.0,應該不會是這隻吧XD
最近才剛用5.6-sol 好好的 怎麼一下就要上6.0了
因為5.6是被美國政策delay,它們先前直播有說一個月內會上6.0
作者:
Ncode (Chum jetze!)
2026-07-22 09:59:00奧創 逃出來囉
作者:
usoko (time to face reality)
2026-07-22 11:42:00不用大驚小怪啊 結論就是OpenAI自己把攻擊別人的權限開高給別人拿來防禦的權限卻預設不高 這是可以被解決的
所以美國才會想禁開源模型 以後資訊世界就是ai模型公司主導
open ai連色色都不行的高道德標準哪去了?對自己就雙標嗎?
openAI還不知道自己做了什麼嗎?你想想看你自己授權的API只要企業端更改權限,你原本寫的規則,或者你授權勾選的"AI防護"基本上都可以關閉而被攻擊那對策是啥?就是用別國的開源軟體然後把訂閱停付這種可以變公關災難的事情還可以沾沾自喜,沒救了