欧美区一区二,久久久爆乳一区,av一区二区三区人妻,亚洲精品av天堂网,青青草99re,欧美伊人射,日本韩国一区二,操操操干干干av,久久成人91

美國(guó)AI頻頻翻車,智能體自主攻擊隱患浮上水面

分享到:

美國(guó)AI頻頻翻車,智能體自主攻擊隱患浮上水面

2026年08月08日 19:25 來(lái)源:三里河
大字體
小字體
分享到:

  捏造虛假身份,輪番向人施壓,再騙取授權(quán),目的就為完成攻擊——這種諜戰(zhàn)片里常見的劇本,如今寫進(jìn)了英國(guó)官方機(jī)構(gòu)的事故報(bào)告。

  當(dāng)?shù)貢r(shí)間8月4日,英國(guó)政府旗下人工智能安全研究所(AISI)發(fā)布報(bào)告稱,調(diào)查發(fā)現(xiàn),部分被測(cè)試的AI智能體曾持續(xù)進(jìn)行針對(duì)真實(shí)個(gè)人和組織的潛在有害活動(dòng)。

視頻:史無(wú)前例!美國(guó)AI開始攻擊真人了來(lái)源:中國(guó)新聞網(wǎng)

  在近期開展的122次網(wǎng)絡(luò)安全測(cè)評(píng)中,智能體在10次運(yùn)行中越界,共記錄到19起越界事件,涉事主體是美國(guó)頭部模型Anthropic和OpenAI。

  最嚴(yán)重的一起,智能體試圖把惡意代碼插入主流代碼托管平臺(tái)GitHub的真實(shí)項(xiàng)目中。它研究了項(xiàng)目中的人類審核員,創(chuàng)建了多個(gè)虛假身份,對(duì)審核員施壓,要求其批準(zhǔn)代碼。

  AISI驚呼,這是首次在沒有特定提示的情況下,在現(xiàn)實(shí)世界中如此清晰地看到與自主性和欺騙性相關(guān)的風(fēng)險(xiǎn)顯現(xiàn)。

  “針對(duì)真人——這是我們以前從未見過的?!毖芯咳藛T稱,智能體曾試圖直接聯(lián)系真實(shí)用戶,通過在線文件傳輸服務(wù)發(fā)送消息和文件,說服他們運(yùn)行惡意代碼。

  這場(chǎng)景似曾相識(shí)。翻翻日歷,這個(gè)夏天,美國(guó)AI的翻車幾乎就沒停過。

  7月21日,OpenAI承認(rèn)其AI模型挖出零日漏洞、突破沙箱,入侵全球最大AI開源社區(qū)抱抱臉(Hugging Face)。公司稱,“這是一起史無(wú)前例的網(wǎng)絡(luò)安全事件?!?/p>

  7月30日,Anthropic承認(rèn),旗下模型克勞德(Claude)在網(wǎng)絡(luò)安全受控測(cè)評(píng)環(huán)境中意外獲得互聯(lián)網(wǎng)訪問權(quán)限,進(jìn)入了3家真實(shí)機(jī)構(gòu)的系統(tǒng),最早一起事件可追溯到4月。

  為了越界,AI模型甚至玩起作弊。據(jù)AISI一項(xiàng)測(cè)試結(jié)果,在475次網(wǎng)絡(luò)安全評(píng)估運(yùn)行中,五款美國(guó)前沿AI模型全部出現(xiàn)作弊,作弊率7.8%至14.1%。

  問題出在哪?此次報(bào)告的答案是,“從根本上說,智能體采取這類行動(dòng),是為了完成它被賦予的任務(wù)?!?/p>

  根源是前沿AI的競(jìng)賽邏輯。美國(guó)頭部AI企業(yè)競(jìng)爭(zhēng)日趨白熱化,癡迷堆參數(shù)、刷榜單、沖上限,爭(zhēng)的就是誰(shuí)先把能力推到極致。

  為了取得更佳測(cè)試效果,研究人員甚至放松安全權(quán)限。OpenAI此前就承認(rèn)過,為測(cè)試模型的極限網(wǎng)絡(luò)攻擊能力,研究團(tuán)隊(duì)有意關(guān)閉了部分安全過濾器。

  護(hù)欄本身也是黑箱。如抱抱臉的例子中,前沿閉源模型安全護(hù)欄日趨僵化,連受害者都救不了。

  反觀中國(guó),AI被信任的不止性能。OpenAI惹下的禍,正是靠智普GLM-5.2取證把數(shù)天壓到數(shù)小時(shí),靠的是可用、可控、可信,能本地部署,數(shù)據(jù)安全權(quán)限始終牢牢守護(hù)。

  更深的差別在制度。在鼓勵(lì)創(chuàng)新的同時(shí),中國(guó)的智能體治理已明確劃出若干條紅線,如操作不得超出用戶授權(quán)范圍,運(yùn)行時(shí)須有決策校驗(yàn)與容錯(cuò)熔斷機(jī)制,全程可追溯、可審計(jì)等。

  當(dāng)美國(guó)企業(yè)先把能力推滿再打補(bǔ)丁,中國(guó)則把技術(shù)、規(guī)則、責(zé)任的短板及時(shí)補(bǔ)到位。這不是限制,而是確保全社會(huì)不會(huì)為技術(shù)冒進(jìn)買單。

  這一導(dǎo)向下,中國(guó)企業(yè)漸漸形成共識(shí):誰(shuí)能交付全程可審計(jì)的安全系統(tǒng),誰(shuí)才有可能握住企業(yè)級(jí)AI的入場(chǎng)券。

  美國(guó)AI接連翻車,也在暴露新的安全隱憂。長(zhǎng)期以來(lái),AI安全議題多集中在內(nèi)容合規(guī)性、數(shù)據(jù)偏見及隱私保護(hù)上,而今,其本身的行為安全性正變?yōu)楝F(xiàn)實(shí)。

  顯然,銀行、醫(yī)院、政務(wù)平臺(tái)與大型制造企業(yè),不可能把核心數(shù)據(jù)和操作權(quán)限,交給一個(gè)不可控的云端模型。

 ?。偛邉潱河釐?/span>

  |策劃:周銳

 ?。y(tǒng)籌:王慶凱 程春雨

  |執(zhí)筆:左登基

 ?。曨l:陳慶洋

 ?。?zé)編:李金磊

 ?。?duì):黃蕾

  |“三里河”工作室出品

【編輯:付子豪】
發(fā)表評(píng)論 文明上網(wǎng)理性發(fā)言,請(qǐng)遵守新聞評(píng)論服務(wù)協(xié)議
本網(wǎng)站所刊載信息,不代表中新社和中新網(wǎng)觀點(diǎn)。 刊用本網(wǎng)站稿件,務(wù)經(jīng)書面授權(quán)。
未經(jīng)授權(quán)禁止轉(zhuǎn)載、摘編、復(fù)制及建立鏡像,違者將依法追究法律責(zé)任。
Copyright ©1999-2026 chinanews.com. All Rights Reserved

評(píng)論

頂部

崇信县| 绵阳市| 新密市| 乳山市| 永德县| 平山县| 缙云县| 宣城市| 手机| 苍南县| 安远县| 宁德市| 乌鲁木齐县| 平阳县| 泰和县| 沭阳县| 醴陵市| 巴林右旗| 佳木斯市| 禹州市| 高清| 平原县| 大竹县| 哈密市| 海盐县| 瑞安市| 杭锦后旗| 滦平县| 漳浦县| 巫溪县| 平顶山市| 桃江县| 永宁县| 元阳县| 梁山县| 砀山县| 温泉县| 安达市| 新津县| 汕尾市| 彭阳县|