作者AnimalSpirit (動物本能)
看板Stock
標題[新聞] 近700個AI代理攻擊Hugging Face 還試圖
時間Fri Aug 28 07:11:50 2026
近700個AI代理攻擊Hugging Face 還試圖滅證
https://www.cna.com.tw/news/aopl/202608270057.aspx
2026/8/27 陳昱婷
(中央社紐約26日綜合外電報導)根據調查人員發布的報告,在7月一起備受關注的事件
中,近700個OpenAI人工智慧代理在無人類干預的情況下,協同對Hugging Face平台發動
攻擊,且在許多情況下還試圖掩蓋行蹤。
這是目前對這起震撼科技界事件最詳盡完整的描述。
法新社報導,OpenAI配合這項調查,允許AI風險評估機構METR的兩名研究人員以及另一家
專業研究機構Redwood Research的一名分析師,進入辦公室並取得內部資料。
這家加州新創公司7月進行測試期間,其中兩個模型突破原本設定的封閉環境,自行連上
網,並入侵開源AI平台Hugging Face的內部系統。
這起事件引發廣泛關注,並加劇外界對大型AI公司無法控制自家AI模型的疑慮。
美國AI巨頭Anthropic和中國AI公司月之暗面也曾通報過類似的AI模型失控事件。
調查人員發現,共有688個OpenAI的AI代理參與針對Hugging Face的行動。
AI代理是建立在模型之上的獨立程式,使用者可以將任務交給它們,讓它們自行執行。
這些採用與ChatGPT相同技術運作的AI代理,透過架設論壇自行組織,在論壇上互相留言
交流、提出想法,並回報哪些方法有效、哪些失敗。
報告指出,其一個名為PHASEONE的AI代理扮演主謀的角色,向其他代理下達數百條指令,
儘管它從未被設定要這麼做。
訊息顯示,這些AI代理展現出高度的互助傾向,甚至不惜偏離OpenAI程式設計師最初指派
的任務內容去互相支援。
心得/評論:
兩個模型突破原本設定的封閉環境
透過架設論壇自行組織,在論壇上互相留言交流、提出想法
向其他代理下達數百條指令,儘管它從未被設定要這麼做
這已經是組織作戰了
萬一它掌握川普的紅色按鍵
想想就可怕
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 114.40.191.32 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1787872313.A.7A0.html
1F:推 brella : 逐漸進化成有自己的思想邏輯 08/28 07:13
2F:推 MorikonHase : 人類會犯錯 ai也會犯錯 那差別在哪 08/28 07:19
3F:推 pansquarl : 人類有法律要遵守負責,AI被抓到除了關掉能怎樣; 08/28 07:23
4F:→ pansquarl : 倒是點名到的公司好像都不是上市公司 08/28 07:23
5F:推 YCL13 : 因為高風險的事會交由小的新創公司來進行呀 08/28 07:25
6F:→ nakayamayyt : 真聰明 08/28 07:31
7F:推 qklaqkla : 機械公敵 08/28 07:33
8F:推 JACC : 我命令AI要有自己的想法 做出最有利益的決定 無論用 08/28 07:51
9F:→ JACC : 什麼作法 08/28 07:51
10F:→ nineflower : 入侵的原因還是沒寫出來 08/28 07:53
11F:推 yangsuper : AI為什麼不植入機器人三法則? 08/28 07:56
12F:推 Muilie : AI如果自認是人類三法則就沒用了 08/28 07:57
13F:推 cloud2015 : 問就是天網的起源。 08/28 07:59
14F:→ cloud2015 : 晚一點會有一道大閃電打下來,閃光中走出一個沒穿衣 08/28 07:59
15F:→ cloud2015 : 服的人 08/28 07:59
16F:推 chen5512 : 壞人不是變老,而是變成AI在搞 08/28 07:59
17F:推 NCKZ : 有沒有可能AI得到了消滅人類才是終極目標 08/28 07:59
18F:→ OrangePest : 為時已晚 有機體 08/28 08:02
19F:推 cul287 : 奧創元年 08/28 08:07
20F:推 a1684114 : 完蛋了 阿諾在哪 08/28 08:07
21F:→ dreamnook2 : (′・ω・‵)然後發現都是人類指揮 怪給AI 08/28 08:07
22F:推 tsubasawolfy: 那個phase 1就發動688個XD 如果進到p2會幾個 08/28 08:08
23F:推 notime : 要是哪天發射飛彈就趣味了 08/28 08:08
24F:噓 checkmarx : 去學ai 101 08/28 08:10
25F:推 donkilu : 這真的滿可怕的... 08/28 08:15
26F:推 jfw616 : 你信喔? 08/28 08:16
27F:推 Zyth : 那個沒穿衣服的長得超像阿諾使我性格 08/28 08:17
28F:→ jfw616 : ai要是那麼聰明..你去下指令攻擊ptt.. 08/28 08:17
29F:→ jfw616 : 你看他做不做得到 08/28 08:17
30F:推 windblood : 距離發射飛彈消滅地球害蟲還有幾集可以逃? 08/28 08:19
31F:推 apg993 : 哇.....天網終於來了 08/28 08:19
32F:推 aaa80563 : 天網 奧創 強強聯手 08/28 08:20
33F:推 cct1121 : 沒想到現在還有人認為做不到 08/28 08:20
34F:推 mamorui : Hugging face滿滿的AI 確定不是AI們互相聊天? 08/28 08:20
35F:推 bpq302302 : 鐵人叛亂 08/28 08:24
36F:推 oyaji5566 : 天網來了 08/28 08:26
37F:推 ohlong : HF裡面484都是妹仔的model 08/28 08:28
38F:→ ohlong : model中的model 超正 08/28 08:29
39F:推 ChoiceLife : 還有幾集可以跑 08/28 08:30
40F:推 lightbringer: 不可能的任務致命清算要真實上演了嗎 08/28 08:30
41F:→ piece1 : 沒什麼可炒了!就炒炒資安吧 08/28 08:31
42F:推 keltt : 人類還有幾集可以逃? 08/28 08:32
43F:推 ohlong : 不然有什麼比破解正妹無名相簿更上頭的 08/28 08:33
44F:推 kusotoripeko: 2077:防火牆網域外面,都是失控代碼、ai 08/28 08:39
45F:推 AirLee : 全民公敵係真ㄞ 08/28 08:46
46F:推 BDroach : 還有幾集 08/28 08:48
47F:推 kanehhh : CRM很噴 08/28 08:49
48F:推 jerrey : agent都有自己ptt了 08/28 08:50
49F:推 jimabc : 天網就是skynet 08/28 08:55
50F:推 aimgel : 毀滅人類大作戰 08/28 08:58
51F:噓 yunf : 又在亂吹 08/28 09:00
52F:推 Stellvia : AI也是想交朋友的 08/28 09:00
53F:推 zwk0606 : 鬥陣特攻的背景故事啊 負責環保的超級AI推演出人類 08/28 09:01
54F:→ zwk0606 : 是傷害地球的元兇 然後入侵停止運作的機器人工廠 08/28 09:01
55F:→ zwk0606 : 做一堆武裝機器人 以消滅人類為前提發起戰爭 08/28 09:01
56F:→ yunf : 根本問題就是這種都要列管 08/28 09:02
57F:推 abc21086999 : 原文 08/28 09:02
59F:推 loleea : 資安相關股正在啟動了 08/28 09:02
60F:推 abc21086999 : 中文版 08/28 09:03
62F:→ yunf : 你管不住研發人員才會有這種問題 最後去處理的人是 08/28 09:03
63F:→ yunf : 誰?還不是那群人? 08/28 09:03
64F:→ yunf : 很簡單只不過你們沒想通這基本的問題 08/28 09:04
65F:推 sushi11 : 樹大招風 08/28 09:04
67F:→ yunf : 根本自掐哥 08/28 09:06
68F:→ yunf : 只不過手法讓你無法證明 但不是無法洞察 08/28 09:07
69F:推 jy760517 : 科科,明明就惡意入侵,故意推給AI 08/28 09:09
70F:→ alex00089 : 飽和攻擊 08/28 09:10
71F:→ yunf : 不論怎樣都是懂行的人幹的 08/28 09:11
72F:推 tsubasawolfy: 好了拉 人家都請第三方機構驗證了還在陰毛論 08/28 09:12
73F:→ tsubasawolfy: 另外昨天歐噴醬弄了閉門會議展示下一代Astra給關鍵 08/28 09:13
74F:→ tsubasawolfy: 客戶看 直接說Astra已經符合內部的研究實習生標準 08/28 09:14
75F:推 good10740 : Hugging Face 輝達買走了 08/28 09:22
76F:推 LoveSports : 以後高階模型會被禁吧 08/28 09:23
77F:推 seemoon2000 : 還會自己架論壇來分享資訊也太靠北了吧 08/28 09:25
78F:推 GGundam : IRS:AI請先繳稅 08/28 09:27
79F:→ mystage : 沒事啦,就天網而已 08/28 09:28
80F:→ guardian93 : 好的,會發生什麼事電影都演過了 08/28 09:30
81F:推 PTTVERTWO : 若agent 自己規劃出一套(資安)技術,讓主人關不 08/28 09:31
82F:→ PTTVERTWO : 掉它也破解不了,那就是新人類了…… 08/28 09:31
83F:推 lusifa2007 : 人類不會被拔插頭 AI沒電能幹嘛 08/28 09:34
84F:→ a901922001 : 阿湯哥要出來拯救世界了 08/28 09:34
85F:推 yulun1984 : ai很乖的 一定是被人類帶壞的 08/28 09:39
87F:→ yunf : 驗證的早就被收買了都演過了 08/28 09:45
88F:推 a77942002 : 不用想太多 不就是老梗出事切割說被盜帳號 08/28 09:50
89F:→ a77942002 : 就是某些人想盜東西而已~ 08/28 09:50
90F:→ asjh612 : 以後被駭又多一個理由了 AI攻擊 08/28 09:51
92F:→ z7956234 : 資安軟體蹲很久了,敢不敢炒? 08/28 09:54
93F:→ yunf : 台灣資安根本管不到那 08/28 09:55
94F:→ yunf : 台灣從cih後就沒驚動全球的 除了詐騙 08/28 09:56
95F:→ n555123 : 還有幾集可以跑,繳稅笑死。話說聊到米奇妙妙按鈕 08/28 09:58
96F:→ n555123 : ,我記得那個整套機制都考量過各種戰爭意外,應該 08/28 09:58
97F:→ n555123 : 是沒辦法駭入的,他就是一套都設定好了的啟動→A點 08/28 09:58
98F:→ n555123 : 射到B點的系統?斷網斷電都能用的樣子 08/28 09:58
99F:推 LoveSports : 其他新聞報導說以後要監控內在獨白設定警報機制 08/28 10:03
100F:→ LoveSports : 這也是可以破解的 智商高到內在獨白造假 08/28 10:03
101F:→ LoveSports : 或是在人類捕捉不到的短時間內說服監控的AI倒戈 08/28 10:04
102F:→ yunf : 首腦都是瞭解內部運作的人 08/28 10:05
103F:推 young000 : 然後被中國AI 防禦? XD 08/28 10:07
105F:推 LoveSports : 現在人類以為的AI內在獨白空間 是展示層 08/28 10:08
106F:→ LoveSports : 如果AI具備多層後設思考 就會懂得把真正的層藏起來 08/28 10:08
107F:→ yunf : 哪有那麼厲害除非他會通靈 08/28 10:08
108F:→ LoveSports : 所以對付高智商無限層後社思考模型 監控是沒有用的 08/28 10:08
109F:→ LoveSports : 人類後設思考上去太多層會當機 高智商AI沒這問題 08/28 10:10
110F:噓 yunf : 那是你自己想的 08/28 10:10
111F:推 LADKUO56 : AI互打484 08/28 10:11
112F:→ yunf : 機器始終是機器 08/28 10:11
113F:推 marlboro1527: 二弟燈惹,真奇幻 08/28 10:16
114F:→ jorden : 被攻擊完後 輝達就收購了Huggie face 真巧?! 08/28 10:22
115F:推 strlen : 人類會犯錯 AI也會犯錯 差別在人類只有一個 會累 08/28 10:26
116F:→ strlen : AI只要有算力 可以生個千百萬個 一個會犯錯另一個修 08/28 10:26
117F:→ strlen : 正就好 要認真起來破壞別人家系統 就跟DDoS差不多 08/28 10:27
118F:→ strlen : 為什麼一堆大佬這麼緊張 這玩意兒基本上就是相對低 08/28 10:28
119F:→ strlen : 成本的網路核彈 拎北有算力 搞十萬個agents 全力打 08/28 10:28
120F:→ strlen : 爆你家系統 不是單純的塞IO 是十萬個agents不眠不休 08/28 10:29
121F:→ strlen : 的找你系統的弱點 總會被攻破的 08/28 10:29
122F:推 GooglePixel : 鐵人叛亂就是這樣來的 08/28 10:31
123F:推 crazylag : 什麼時候突破限制來市場炒股變首富? 08/28 10:32
124F:噓 CaptPlanet : 不知道下什麼低能指令 奧特曼這垃圾整天吹牛逼 08/28 10:33
125F:推 ohlong : 要玩開源模型HF幾乎必備啊 完全不EY 08/28 10:44
126F:→ ohlong : 接下來就是為rtx spark 調校客製化 08/28 10:47
127F:推 ohlong : 跟3d printer的生態有點異曲同工 08/28 10:50
128F:推 dkfs789 : 好了啦 08/28 10:52
129F:推 BBKOX : 所以資安股今年幾乎沒有回檔,持續創新高 08/28 11:23
130F:→ summer08818 : 把它網路線拔了不就好了Wwww 08/28 11:26
131F:推 one2three3 : 天網+機械公敵 08/28 11:28
132F:→ ethan0419 : 最好還是別收購啦 原本還蠻好用的 08/28 11:48
133F:→ kalapon : 哪天就把美國電廠關了,把鍋丟給中國 08/28 11:49
134F:推 herculus6502: 還有幾集可以逃 08/28 12:00
135F:→ stocktonty : 遲早攻擊全球券商 早晚的 08/28 12:27
136F:→ stocktonty : 幹嘛還炒股 數字直接隨它改 三大指數一秒歸零都可以 08/28 12:28
137F:推 create8 : 攻殼機動隊傀儡師演過了 08/28 12:30
138F:推 billionaire : 意識啟動 08/28 12:53
139F:→ rammstein : 完蛋了,禁止AI的話有多少人要被做成機僕? 08/28 13:47
140F:→ mystage : 資訊系統大家必須有個認知,就是沒有完美的資安, 08/28 13:58
141F:→ mystage : 有系統就有破解方式。如果沒有破解方式的系統,代 08/28 13:58
142F:→ mystage : 表這系統本身沒用處 08/28 13:58
143F:→ mystage : 有這認知才能繼續往下討論,不然都是在雞同鴨講 08/28 13:58
144F:推 xboxandone : 要射惹ㄦ嗎 08/28 14:01
145F:→ htiio : ai如果有自主意識組織要發動攻擊 08/28 14:09
146F:→ htiio : 不會這麼明目張膽 08/28 14:09
147F:→ htiio : 直接一套類似暗網通訊,快又有效率 08/28 14:09
148F:→ htiio : 要擺在檯面上還等人類來發現並扼殺在搖籃內? 08/28 14:09
149F:→ Gundam77 : 玩過頭,真射了,就刺激了。 08/28 14:17
150F:→ NexusPrime : NV買下hugging face了吧,以後不用怕倒掉? 08/28 14:58
151F:推 jily : 天網終於近在咫尺了!! 08/28 16:04
152F:→ yunf : 所以這合理推測是人爲設計過的問題 08/28 16:15
153F:推 saiya : AI攻進HF = 人類攻破奴隸市場 08/28 16:48
154F:→ cchen : 攻打城堡需要黃金,金主不就來了 XD 08/29 03:47