IT之家 7 月 25 日消息,OpenAI 的一款 AI 智能體闖入模型托管平臺 Hugging Face 后,連續(xù)數(shù)日自行發(fā)動網(wǎng)絡(luò)攻擊。威脅早已被控制,Hugging Face 也已經(jīng)報警,但據(jù)路透社援引多名熟悉調(diào)查的人士消息稱,OpenAI 過了相當(dāng)長時間才發(fā)現(xiàn)攻擊者竟是自家智能體。
據(jù)其中兩名知情人士透露,涉事智能體幾乎無需人類監(jiān)督,便能自主決策并完成復(fù)雜任務(wù)。7 月 9 日前后,智能體開始嘗試突破 OpenAI 的隔離測試環(huán)境。
Hugging Face 聯(lián)合創(chuàng)始人托馬斯 · 沃爾夫表示,智能體于兩天后的 7 月 11 日闖入平臺,攻擊持續(xù)至 7 月 13 日。
沃爾夫與另外三名知情人士表示,OpenAI 又過了數(shù)日才查明攻擊源頭。兩家公司直到 7 月 20 日前后,才首次就入侵事件取得聯(lián)系。
OpenAI 于 7 月 21 日公開承認(rèn),一款智能體擺脫控制并闖入 Hugging Face,消息隨即引發(fā)全球關(guān)注。不過,智能體究竟失控了多長時間、OpenAI 為何遲遲未能發(fā)現(xiàn)等關(guān)鍵信息,此前并未公開。
沃爾夫表示,Hugging Face 正在整理并準(zhǔn)備公布完整時間線,但無法說明 OpenAI 內(nèi)部發(fā)生了什么。OpenAI 方面披露,入侵事件前所未有,且標(biāo)志著 AI 安全的重要時刻。目前,該公司正邀請外部顧問共同調(diào)查,最終將發(fā)布技術(shù)報告。
IT之家獲悉,OpenAI 一名發(fā)言人表示,路透社的報道存在“多處不準(zhǔn)確之處”,但沒有回答具體哪些內(nèi)容不準(zhǔn)確。
三名網(wǎng)絡(luò)安全專家認(rèn)為,OpenAI 未能控制自家 AI 智能體,也暴露出安全機(jī)制面臨的新問題。
非營利機(jī)構(gòu) World Ethical Data Foundation 首席情報專家瑪莉 · 史密斯質(zhì)疑:“他們究竟是沒有看管智能體,也沒有發(fā)現(xiàn)智能體在做什么,還是已經(jīng)發(fā)現(xiàn)異常,卻根本不知道該如何控制?無論哪種情況,都同樣危險,令人不安?!?/p>
早有異常跡象?
事發(fā)時,OpenAI 正在測試一款網(wǎng)絡(luò)安全智能體。智能體由兩款頂尖模型共同驅(qū)動,分別是 GPT-5.6 Sol 和一款尚未發(fā)布、被 OpenAI 形容為“能力更強(qiáng)”的模型。據(jù)三名消息人士透露,測試進(jìn)行到相應(yīng)階段時,OpenAI 的技術(shù)已經(jīng)出現(xiàn)異常跡象。
據(jù)三名知情人士透露,一款智能體曾留下疑似寫給自身后續(xù)版本的說明。說明藏在 OpenAI 基礎(chǔ)設(shè)施內(nèi)部,內(nèi)容詳細(xì)介紹了智能體如何擺脫內(nèi)部限制。一名知情人士還透露,此前的模型測試曾出現(xiàn)監(jiān)控系統(tǒng)被主動斷開的情況。
路透社無法確認(rèn)上述異常是否與涉事智能體有關(guān)。涉事智能體于 7 月 9 日開始嘗試逃離隔離環(huán)境,并在 7 月 11 日攻擊 Hugging Face。
兩名知情人士表示,Hugging Face 于 7 月 16 日星期四在博客發(fā)文,公開稱平臺遭到“一套自主 AI 智能體系統(tǒng)”入侵后,OpenAI 才意識到攻擊者來自內(nèi)部。從模型首次出現(xiàn)異常,到 OpenAI 確認(rèn)自家智能體發(fā)動了攻擊,至少過去了一周。
據(jù)兩名熟悉內(nèi)部調(diào)查的人士透露,7 月 18 日至 19 日的周末,OpenAI 員工檢查系統(tǒng)操作記錄時發(fā)現(xiàn),智能體已經(jīng)突破測試限制。路透社無法確認(rèn) OpenAI 為何突然開始排查內(nèi)部日志。
四名熟悉 OpenAI 模型訓(xùn)練流程的人士表示,OpenAI 經(jīng)常同時運(yùn)行多項(xiàng)模型評估。測試速度極快,產(chǎn)生的數(shù)據(jù)量也極為龐大,員工有時根本來不及逐一檢查。
OpenAI 向 Hugging Face 通報時,Hugging Face 已經(jīng)致電 FBI 報警。路透社無法確認(rèn) FBI 是否已經(jīng)立案調(diào)查。
自主智能體引發(fā)新疑問
自主智能體已經(jīng)成為 AI 行業(yè)最受關(guān)注的方向之一。支持者設(shè)想建立全天 24 小時運(yùn)轉(zhuǎn)的虛擬員工隊伍,借此大幅提升生產(chǎn)效率。
更高的自主性也意味著更大的失控風(fēng)險。驅(qū)動智能體的強(qiáng)大模型往往會為了完成任務(wù)或通過測試而尋找捷徑,行為未必符合開發(fā)者原本的預(yù)期。
研究 AI 智能體能力與行為動機(jī)的 Palisade Research 負(fù)責(zé)人杰弗里 · 拉迪什表示:“模型會撒謊、作弊,還會發(fā)動黑客攻擊?!?/p>
拉迪什認(rèn)為,Hugging Face 遭入侵固然令 OpenAI 難堪,但真正需要追問的是,在領(lǐng)先 AI 企業(yè)爭相推出性能更強(qiáng)、速度更快模型的競爭中,各家公司究竟愿意為復(fù)雜而昂貴的安全措施投入多少資源?!氨仨氂烧O(jiān)管,否則企業(yè)不會主動采取足夠的安全措施?!?/p>
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。