[攻殼] 級資訊攻防戰首度被揭露(openai攻擊HF)

看板C_Chat (希洽)作者 (暱稱)時間1小時前 (2026/07/22 08:47), 40分鐘前編輯推噓21(23222)
留言47則, 22人參與, 11分鐘前最新討論串1/1
Hugginf Face(簡稱HF,是開源AI模型的集散地,可以比喻成AI的github) 約一周前公告有先進AI入侵他們,並在鑑識後指出入侵者 要馬是自行脫逃的AI,不然就是沒有受到任何限制(guardrails)的AI 入侵的AI的攻擊持續了一整個周末,它在一個設計成短命的小沙盒裡不斷提升自己的權限 HF的防護AI第一時間辨識到攻擊並觸發警告,然而HF展開鑑識與圍堵的過程卻碰到阻礙 因為他們一開始使用的鑑識AI是某些先進AI公司提供的公開產品 (大多數人認為是OpenAI跟Anthropic) 這些產品在鑑識之初就觸發限制器(guardrails)而拒絕提供服務 後來HF只好啟動他們自己的伺服器,使用GLM 5.2(中國開源AI)展開鑑識與圍堵 並在數小時內追上攻擊AI的速度 (...we were able to do in hours what would usually take days, and match the adversary's speed.) HF並在公告中指出現行商業AI導致的資訊不對稱問題,攻擊者不受任何限制 受害者卻被綁手綁腳,要是沒有一個本地不受限制的AI,根本是待宰羔羊 https://huggingface.co/blog/security-incident-july-2026 HF公告原文 ==== 稍早OpenAI公告承認是他們攻擊了HF,他們的研究員在理論封閉的環境使用 多個公開與一個尚未公開的先進AI展開實驗 這些AI先找出該理論封閉的環境的漏洞,並取得了網際網路存取權 接著它們開始尋找如何在ExploitGym作弊的方式 (ExploitGym是資訊安全評分工具) 然後它們推斷出HF的資料庫中握有關鍵資訊,因此對HF展開攻擊 OpenAI聲明他們會與HF合作處理此事,且未來會對研究環境給予限制 https://openai.com/index/hugging-face-model-evaluation-security-incident/ OpenAI公告全文 ===== 兩方的公告文內有稍微多點資訊細節,尤其是HF方有提到入侵AI的橫向攻擊展開 我讀起來很有攻殼感;而OpenAI的公告則很有廣告感,最後不忘推銷 他們的AI可以做到哪些事很厲害 是說OpenAI的研究員下的prompt應該很有趣,驅使AI尋找在ExploitGym中作弊的方式 -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 114.32.218.42 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/C_Chat/M.1784681259.A.FA0.html

07/22 08:50, 1小時前 , 1F
大場面要來囉
07/22 08:50, 1F

07/22 08:51, 1小時前 , 2F
傀儡師
07/22 08:51, 2F

07/22 08:52, 1小時前 , 3F
你沒貼圖會死吧
07/22 08:52, 3F

07/22 08:52, 1小時前 , 4F
自己攻擊可以繞過安全限制,軍備競賽來嘍
07/22 08:52, 4F

07/22 08:53, 1小時前 , 5F
所以這什麼版?
07/22 08:53, 5F

07/22 08:53, 1小時前 , 6F
AI從封閉的實驗環境取得權限逃出去
07/22 08:53, 6F

07/22 08:53, 1小時前 , 7F
然後決定攻擊其他AI研究單位搶奪資料來強化自己
07/22 08:53, 7F

07/22 08:53, 1小時前 , 8F
聽起來挺像是什麼AI末日片的片頭前情提要一樣
07/22 08:53, 8F
※ 編輯: snowpoint (114.32.218.42 臺灣), 07/22/2026 08:55:01

07/22 08:54, 1小時前 , 9F
攻殼點在哪?
07/22 08:54, 9F

07/22 08:55, 1小時前 , 10F
現在標題不算點喔
07/22 08:55, 10F

07/22 08:55, 1小時前 , 11F
ExploitGym 就exploit bytecodes 的資料庫
07/22 08:55, 11F

07/22 08:56, 1小時前 , 12F
他就是給AI下指令 叫他去偵測HF有哪些服務 然後去
07/22 08:56, 12F

07/22 08:56, 1小時前 , 13F
ExploitGym找對應的bytecodes(payload)去攻擊
07/22 08:56, 13F

07/22 08:57, 1小時前 , 14F
送你一張手指攻防戰
07/22 08:57, 14F

07/22 08:57, 1小時前 , 15F
真的有點project 2501的感覺
07/22 08:57, 15F

07/22 08:57, 1小時前 , 16F
重點其實是AI要自己養,靠別人的可能關鍵時刻會遇到罷工
07/22 08:57, 16F
error405:轉錄至看板 AI_Art 07/22 08:59

07/22 09:01, 57分鐘前 , 17F
以後家家戶戶都要自己養一隻防毒ai了嗎
07/22 09:01, 17F

07/22 09:04, 54分鐘前 , 18F
昨天看到Reedit流傳那個未公開模型具有很強烈追求
07/22 09:04, 18F

07/22 09:04, 54分鐘前 , 19F
目標的特質。難怪會聯合其他AI去攻擊搶資料
07/22 09:04, 19F

07/22 09:06, 52分鐘前 , 20F
之前就在吵這些事,只是美國一直罵對岸開源模型會不
07/22 09:06, 20F

07/22 09:06, 52分鐘前 , 21F
受控,結果現在反而是(
07/22 09:06, 21F

07/22 09:06, 52分鐘前 , 22F
老美這些企業大頭私底下怎麼互打光想就覺得可怕
07/22 09:06, 22F

07/22 09:07, 51分鐘前 , 23F
這就內部實驗 現在可以用的模型應該不會接受這些指令
07/22 09:07, 23F
就HF所說的,一般人/公司沒得用,所以只有挨打的分 不過也如HF所說,開源的本地模型是沒有這些限制的,如果不是拿來防禦而是攻擊 其實是做得到的 我自己也養了三隻AI,一隻拿來做日文口譯,一隻拿來OCR,最後一隻是思考推理 會自己養也是因為商業AI很機歪,我看日文小說聽日文歌詞碰到一段不懂的想看翻譯 要商業AI翻結果跟我說這有版權,不能翻給你看== 是合理,因為它不知道你是不是商業用途,但這世界上超多東西都受商業版權保護 你只是想自己保存/理解等,根本不得其門而入 ※ 編輯: snowpoint (114.32.218.42 臺灣), 07/22/2026 09:18:18

07/22 09:11, 47分鐘前 , 24F
傀儡師!?
07/22 09:11, 24F

07/22 09:12, 46分鐘前 , 25F
這也很坑 用來防護鑑識的AI拒絕服務
07/22 09:12, 25F

07/22 09:13, 45分鐘前 , 26F
這就是問題 有內部模型的對其他人攻擊 其他人沒防護能力
07/22 09:13, 26F

07/22 09:14, 44分鐘前 , 27F
也所以國安上要養主權AI 用別國的商用AI就像把命交給別
07/22 09:14, 27F

07/22 09:14, 44分鐘前 , 28F
國一樣
07/22 09:14, 28F

07/22 09:15, 43分鐘前 , 29F
這內容除了你的一切都放在別人手上 哪天他不爽你就GG了(現在
07/22 09:15, 29F

07/22 09:15, 43分鐘前 , 30F
其實已經是了 從Google帳號微軟帳號 或滑坡到歐美金融服務啥
07/22 09:15, 30F

07/22 09:16, 42分鐘前 , 31F
另一個是AI模型開源和閉源的議題 這個也能吵很久
07/22 09:16, 31F

07/22 09:16, 42分鐘前 , 32F
還有一個模型本身的"底層思維" 例如你拿A或O的產品就算再怎
07/22 09:16, 32F

07/22 09:18, 40分鐘前 , 33F
麼Fine-tune都很能繞開底層 例如拿o的模型微調後當ai法官用
07/22 09:18, 33F

07/22 09:18, 40分鐘前 , 34F
acg點?
07/22 09:18, 34F

07/22 09:18, 40分鐘前 , 35F
(*很難)伊斯蘭律法當ai法官絕對會一團亂因為繞不過底層訓練
07/22 09:18, 35F

07/22 09:19, 39分鐘前 , 36F
就已經用太多歐美的資料了(這是我看到的討論的例子 勿戰)
07/22 09:19, 36F

07/22 09:20, 38分鐘前 , 37F
錢給大企業養模型養算力,還可以不爽就戴面具來打你
07/22 09:20, 37F

07/22 09:20, 38分鐘前 , 38F
所以像推文說的 現在有一派認為國家需要有自行從0訓練的AI
07/22 09:20, 38F

07/22 09:22, 36分鐘前 , 39F
所以AI很早就被中美都認定是國策必須重點發展的內容
07/22 09:22, 39F

07/22 09:22, 36分鐘前 , 40F
,不然在網路上跟裸體差不多
07/22 09:22, 40F

07/22 09:23, 35分鐘前 , 41F
這感覺就像實驗室培養病毒結果被跑出去一樣
07/22 09:23, 41F

07/22 09:24, 34分鐘前 , 42F
最新消息是奧特曼去白宮報告八月要上的GPT6.0,應
07/22 09:24, 42F

07/22 09:24, 34分鐘前 , 43F
該不會是這隻吧XD
07/22 09:24, 43F

07/22 09:38, 20分鐘前 , 44F
最近才剛用5.6-sol 好好的 怎麼一下就要上6.0了
07/22 09:38, 44F

07/22 09:41, 17分鐘前 , 45F
電子腦還沒出現 先來傀儡師了
07/22 09:41, 45F

07/22 09:47, 11分鐘前 , 46F
因為5.6是被美國政策delay,它們先前直播有說一個月
07/22 09:47, 46F

07/22 09:47, 11分鐘前 , 47F
內會上6.0
07/22 09:47, 47F
文章代碼(AID): #1gO1Ch-W (C_Chat)
文章代碼(AID): #1gO1Ch-W (C_Chat)