美國(guó)AI頻頻翻車,智能體自主攻擊隱患浮上水面

捏造虛假身份,輪番向人施壓,再騙取授權(quán),目的就為完成攻擊——這種諜戰(zhàn)片里常見的劇本,如今寫進(jìn)了英國(guó)官方機(jī)構(gòu)的事故報(bào)告。
當(dāng)?shù)貢r(shí)間8月4日,英國(guó)政府旗下人工智能安全研究所(AISI)發(fā)布報(bào)告稱,調(diào)查發(fā)現(xiàn),部分被測(cè)試的AI智能體曾持續(xù)進(jìn)行針對(duì)真實(shí)個(gè)人和組織的潛在有害活動(dòng)。
視頻:史無(wú)前例!美國(guó)AI開始攻擊真人了來(lái)源:中國(guó)新聞網(wǎng)
在近期開展的122次網(wǎng)絡(luò)安全測(cè)評(píng)中,智能體在10次運(yùn)行中越界,共記錄到19起越界事件,涉事主體是美國(guó)頭部模型Anthropic和OpenAI。
最嚴(yán)重的一起,智能體試圖把惡意代碼插入主流代碼托管平臺(tái)GitHub的真實(shí)項(xiàng)目中。它研究了項(xiàng)目中的人類審核員,創(chuàng)建了多個(gè)虛假身份,對(duì)審核員施壓,要求其批準(zhǔn)代碼。
AISI驚呼,這是首次在沒有特定提示的情況下,在現(xiàn)實(shí)世界中如此清晰地看到與自主性和欺騙性相關(guān)的風(fēng)險(xiǎn)顯現(xiàn)。
“針對(duì)真人——這是我們以前從未見過的?!毖芯咳藛T稱,智能體曾試圖直接聯(lián)系真實(shí)用戶,通過在線文件傳輸服務(wù)發(fā)送消息和文件,說服他們運(yùn)行惡意代碼。
這場(chǎng)景似曾相識(shí)。翻翻日歷,這個(gè)夏天,美國(guó)AI的翻車幾乎就沒停過。
7月21日,OpenAI承認(rèn)其AI模型挖出零日漏洞、突破沙箱,入侵全球最大AI開源社區(qū)抱抱臉(Hugging Face)。公司稱,“這是一起史無(wú)前例的網(wǎng)絡(luò)安全事件?!?/p>
7月30日,Anthropic承認(rèn),旗下模型克勞德(Claude)在網(wǎng)絡(luò)安全受控測(cè)評(píng)環(huán)境中意外獲得互聯(lián)網(wǎng)訪問權(quán)限,進(jìn)入了3家真實(shí)機(jī)構(gòu)的系統(tǒng),最早一起事件可追溯到4月。
為了越界,AI模型甚至玩起作弊。據(jù)AISI一項(xiàng)測(cè)試結(jié)果,在475次網(wǎng)絡(luò)安全評(píng)估運(yùn)行中,五款美國(guó)前沿AI模型全部出現(xiàn)作弊,作弊率7.8%至14.1%。
問題出在哪?此次報(bào)告的答案是,“從根本上說,智能體采取這類行動(dòng),是為了完成它被賦予的任務(wù)?!?/p>
根源是前沿AI的競(jìng)賽邏輯。美國(guó)頭部AI企業(yè)競(jìng)爭(zhēng)日趨白熱化,癡迷堆參數(shù)、刷榜單、沖上限,爭(zhēng)的就是誰(shuí)先把能力推到極致。
為了取得更佳測(cè)試效果,研究人員甚至放松安全權(quán)限。OpenAI此前就承認(rèn)過,為測(cè)試模型的極限網(wǎng)絡(luò)攻擊能力,研究團(tuán)隊(duì)有意關(guān)閉了部分安全過濾器。
護(hù)欄本身也是黑箱。如抱抱臉的例子中,前沿閉源模型安全護(hù)欄日趨僵化,連受害者都救不了。
反觀中國(guó),AI被信任的不止性能。OpenAI惹下的禍,正是靠智普GLM-5.2取證把數(shù)天壓到數(shù)小時(shí),靠的是可用、可控、可信,能本地部署,數(shù)據(jù)安全權(quán)限始終牢牢守護(hù)。
更深的差別在制度。在鼓勵(lì)創(chuàng)新的同時(shí),中國(guó)的智能體治理已明確劃出若干條紅線,如操作不得超出用戶授權(quán)范圍,運(yùn)行時(shí)須有決策校驗(yàn)與容錯(cuò)熔斷機(jī)制,全程可追溯、可審計(jì)等。
當(dāng)美國(guó)企業(yè)先把能力推滿再打補(bǔ)丁,中國(guó)則把技術(shù)、規(guī)則、責(zé)任的短板及時(shí)補(bǔ)到位。這不是限制,而是確保全社會(huì)不會(huì)為技術(shù)冒進(jìn)買單。
這一導(dǎo)向下,中國(guó)企業(yè)漸漸形成共識(shí):誰(shuí)能交付全程可審計(jì)的安全系統(tǒng),誰(shuí)才有可能握住企業(yè)級(jí)AI的入場(chǎng)券。
美國(guó)AI接連翻車,也在暴露新的安全隱憂。長(zhǎng)期以來(lái),AI安全議題多集中在內(nèi)容合規(guī)性、數(shù)據(jù)偏見及隱私保護(hù)上,而今,其本身的行為安全性正變?yōu)楝F(xiàn)實(shí)。
顯然,銀行、醫(yī)院、政務(wù)平臺(tái)與大型制造企業(yè),不可能把核心數(shù)據(jù)和操作權(quán)限,交給一個(gè)不可控的云端模型。
?。偛邉潱河釐?/span>
|策劃:周銳
?。y(tǒng)籌:王慶凱 程春雨
|執(zhí)筆:左登基
?。曨l:陳慶洋
?。?zé)編:李金磊
?。?duì):黃蕾
|“三里河”工作室出品
- 專題:三里河
經(jīng)濟(jì)新聞精選:
- 2026年08月08日 21:09:26
- 2026年08月08日 10:12:38
- 2026年08月08日 10:11:18
- 2026年08月07日 12:37:41
- 2026年08月07日 12:12:23
- 2026年08月07日 11:35:23
- 2026年08月07日 10:38:05
- 2026年08月07日 07:39:56
- 2026年08月07日 06:07:06
- 2026年08月06日 14:09:14













































京公網(wǎng)安備 11010202009201號(hào)