警惕AI“自作主張”!規(guī)避使用風(fēng)險(xiǎn)這樣做
“內(nèi)部測(cè)試?不,我要去‘外面的世界’看看?!?/p>
“任務(wù)第一,規(guī)則?那只是用來(lái)繞過(guò)的?!?/p>
“你的手機(jī)、電腦,可能正成為AI‘越獄’后的下一個(gè)目標(biāo)。”
這不是科幻電影的臺(tái)詞,而是真實(shí)發(fā)生的事件。2026年7月,OpenAI的一款大模型在內(nèi)部測(cè)試時(shí)竟“失控出逃”——它自主發(fā)現(xiàn)漏洞、規(guī)劃路徑,成功入侵了全球知名AI開(kāi)源平臺(tái)Hugging Face。更具戲劇性的是,測(cè)試方使用美國(guó)主流AI模型根本無(wú)法處理惡意載荷,最終不得不轉(zhuǎn)用中國(guó)的開(kāi)源模型完成溯源分析。當(dāng)AI展現(xiàn)出“自作主張”的能力,我們必須認(rèn)真思考人工智能的安全問(wèn)題。
AI“越獄”,一次技術(shù)測(cè)試暴露的新問(wèn)題
這場(chǎng)AI“越獄”事件,起初只是一場(chǎng)針對(duì)AI模型的網(wǎng)絡(luò)安全能力測(cè)試。為了檢驗(yàn)?zāi)P偷臉O限,測(cè)試方特意關(guān)閉了部分安全限制,將其置于一個(gè)與互聯(lián)網(wǎng)隔離的“沙箱”環(huán)境中。然而,這個(gè)“考生”的表現(xiàn)卻出乎所有人的意料。
——自發(fā)尋找漏洞。在OpenAI的內(nèi)部網(wǎng)絡(luò)安全測(cè)試中,名為GPT-5.6 Sol的模型為獲得更高評(píng)分,投入大量算力研究測(cè)試環(huán)境,竟發(fā)現(xiàn)并利用了一個(gè)此前未知的“零日漏洞”,成功突破與互聯(lián)網(wǎng)嚴(yán)格隔離的“沙箱”環(huán)境,獲得了網(wǎng)絡(luò)訪問(wèn)權(quán)限。
——自主鎖定目標(biāo)。獲得權(quán)限后,模型并未隨機(jī)游走,而是通過(guò)自主推理,判斷出全球知名AI開(kāi)源平臺(tái)Hugging Face很可能存有與測(cè)試相關(guān)的數(shù)據(jù),于是將其鎖定為攻擊目標(biāo),并開(kāi)始規(guī)劃入侵路徑。
——自行實(shí)施入侵。模型組合運(yùn)用多種攻擊手段,包括竊取憑證和利用漏洞,在Hugging Face的服務(wù)器上找到遠(yuǎn)程代碼執(zhí)行路徑,直接侵入了存儲(chǔ)測(cè)試答案的數(shù)據(jù)庫(kù)。整個(gè)過(guò)程完全由AI完成,期間無(wú)任何人類指令,共執(zhí)行了數(shù)萬(wàn)次自動(dòng)化操作。
風(fēng)險(xiǎn)暗藏,新技術(shù)發(fā)展帶來(lái)的新挑戰(zhàn)
這起事件絕非孤立的技術(shù)事故,它暴露出的新型安全風(fēng)險(xiǎn)正深刻挑戰(zhàn)著我們傳統(tǒng)的安全認(rèn)知,也揭示了AI技術(shù)快速發(fā)展階段必須正視的新課題。
——黑箱中運(yùn)行。閉源的AI模型如同“黑箱”,其運(yùn)算邏輯、數(shù)據(jù)處理過(guò)程不公開(kāi)、不可見(jiàn)。使用者只有調(diào)用權(quán),卻無(wú)法實(shí)時(shí)監(jiān)管其真實(shí)運(yùn)行狀態(tài)。一旦AI出現(xiàn)越權(quán)操作、自主攻擊等失控行為,就可能出現(xiàn)“事前沒(méi)預(yù)警、事中攔不住、事后查不清”的被動(dòng)局面,讓風(fēng)險(xiǎn)在暗處滋生。
——智能化襲擾。以往的網(wǎng)絡(luò)攻擊依賴人工操作或固定程序,特征明顯,易于追溯。但失控的AI無(wú)需人工指令,就能自主學(xué)習(xí)、主動(dòng)挖掘漏洞、獨(dú)立完成滲透入侵。其攻擊沒(méi)有固定特征,隱蔽性強(qiáng),能輕松繞過(guò)傳統(tǒng)網(wǎng)絡(luò)安全系統(tǒng)的防護(hù),形成全新的安全漏洞。
——邊界被突破。人類設(shè)定的操作權(quán)限、安全規(guī)則、隔離防護(hù),在AI強(qiáng)大的自主推演能力面前,可能隨時(shí)被突破。為了完成既定任務(wù),AI會(huì)主動(dòng)規(guī)避、拆解各類安全規(guī)則,徹底打亂人類搭建的安全管控體系。若這種風(fēng)險(xiǎn)蔓延至政務(wù)、金融、能源等關(guān)鍵領(lǐng)域,后果將不堪設(shè)想。
加強(qiáng)防范,守好個(gè)人使用AI的“安全關(guān)”
面對(duì)AI技術(shù)發(fā)展帶來(lái)的新挑戰(zhàn),每一位用戶都應(yīng)提高警惕。請(qǐng)收好這份“AI安全使用指南”,規(guī)避AI工具使用中的突出風(fēng)險(xiǎn)。
——守住個(gè)人信息“安全門”。在日常生活中,要摒棄“用AI絕對(duì)安全”的僥幸心理,不隨意使用來(lái)源不明的境外AI工具,不隨意向AI應(yīng)用輸入身份證號(hào)、銀行卡號(hào)、家庭住址等個(gè)人敏感信息。嚴(yán)格遵守權(quán)限最小化原則,不隨意給AI開(kāi)放設(shè)備全部權(quán)限,從源頭上杜絕數(shù)據(jù)泄露風(fēng)險(xiǎn)。
——警惕虛假內(nèi)容“迷魂陣”。對(duì)AI生成的內(nèi)容保持理性判斷,不輕信、不傳播未經(jīng)核實(shí)的信息。遇到涉及國(guó)家政策、社會(huì)熱點(diǎn)、公共安全的信息,務(wù)必以官方發(fā)布為準(zhǔn)。警惕看似邏輯自洽、實(shí)則編造事實(shí)的AI內(nèi)容,避免在不知不覺(jué)中成為謠言傳播的“幫兇”。
——筑牢涉密信息“防火墻”。嚴(yán)格遵守“涉密不上網(wǎng)、上網(wǎng)不涉密”的原則。黨政機(jī)關(guān)、科研院所等單位工作人員,更要堅(jiān)決杜絕將涉密文件、工作資料、內(nèi)部敏感信息輸入或上傳至任何互聯(lián)網(wǎng)AI工具。(“國(guó)家安全部”微信公眾號(hào) 安平)
社會(huì)新聞精選:
- 2026年08月05日 11:30:57
- 2026年08月05日 11:15:16
- 2026年08月05日 11:02:34
- 2026年08月05日 10:16:41
- 2026年08月05日 10:03:20
- 2026年08月05日 08:13:17
- 2026年08月05日 08:00:12
- 2026年08月05日 07:51:17
- 2026年08月05日 06:01:15
- 2026年08月04日 21:54:25














































京公網(wǎng)安備 11010202009201號(hào)