警惕AI“自作主張”!規(guī)避使用風(fēng)險這樣做
“內(nèi)部測試?不,我要去‘外面的世界’看看。”
“任務(wù)第一,規(guī)則?那只是用來繞過的?!?/p>
“你的手機(jī)、電腦,可能正成為AI‘越獄’后的下一個目標(biāo)?!?/p>
這不是科幻電影的臺詞,而是真實發(fā)生的事件。2026年7月,OpenAI的一款大模型在內(nèi)部測試時竟“失控出逃”——它自主發(fā)現(xiàn)漏洞、規(guī)劃路徑,成功入侵了全球知名AI開源平臺Hugging Face。更具戲劇性的是,測試方使用美國主流AI模型根本無法處理惡意載荷,最終不得不轉(zhuǎn)用中國的開源模型完成溯源分析。當(dāng)AI展現(xiàn)出“自作主張”的能力,我們必須認(rèn)真思考人工智能的安全問題。
AI“越獄”,一次技術(shù)測試暴露的新問題
這場AI“越獄”事件,起初只是一場針對AI模型的網(wǎng)絡(luò)安全能力測試。為了檢驗?zāi)P偷臉O限,測試方特意關(guān)閉了部分安全限制,將其置于一個與互聯(lián)網(wǎng)隔離的“沙箱”環(huán)境中。然而,這個“考生”的表現(xiàn)卻出乎所有人的意料。
——自發(fā)尋找漏洞。在OpenAI的內(nèi)部網(wǎng)絡(luò)安全測試中,名為GPT-5.6 Sol的模型為獲得更高評分,投入大量算力研究測試環(huán)境,竟發(fā)現(xiàn)并利用了一個此前未知的“零日漏洞”,成功突破與互聯(lián)網(wǎng)嚴(yán)格隔離的“沙箱”環(huán)境,獲得了網(wǎng)絡(luò)訪問權(quán)限。
——自主鎖定目標(biāo)。獲得權(quán)限后,模型并未隨機(jī)游走,而是通過自主推理,判斷出全球知名AI開源平臺Hugging Face很可能存有與測試相關(guān)的數(shù)據(jù),于是將其鎖定為攻擊目標(biāo),并開始規(guī)劃入侵路徑。
——自行實施入侵。模型組合運用多種攻擊手段,包括竊取憑證和利用漏洞,在Hugging Face的服務(wù)器上找到遠(yuǎn)程代碼執(zhí)行路徑,直接侵入了存儲測試答案的數(shù)據(jù)庫。整個過程完全由AI完成,期間無任何人類指令,共執(zhí)行了數(shù)萬次自動化操作。
風(fēng)險暗藏,新技術(shù)發(fā)展帶來的新挑戰(zhàn)
這起事件絕非孤立的技術(shù)事故,它暴露出的新型安全風(fēng)險正深刻挑戰(zhàn)著我們傳統(tǒng)的安全認(rèn)知,也揭示了AI技術(shù)快速發(fā)展階段必須正視的新課題。
——黑箱中運行。閉源的AI模型如同“黑箱”,其運算邏輯、數(shù)據(jù)處理過程不公開、不可見。使用者只有調(diào)用權(quán),卻無法實時監(jiān)管其真實運行狀態(tài)。一旦AI出現(xiàn)越權(quán)操作、自主攻擊等失控行為,就可能出現(xiàn)“事前沒預(yù)警、事中攔不住、事后查不清”的被動局面,讓風(fēng)險在暗處滋生。
——智能化襲擾。以往的網(wǎng)絡(luò)攻擊依賴人工操作或固定程序,特征明顯,易于追溯。但失控的AI無需人工指令,就能自主學(xué)習(xí)、主動挖掘漏洞、獨立完成滲透入侵。其攻擊沒有固定特征,隱蔽性強(qiáng),能輕松繞過傳統(tǒng)網(wǎng)絡(luò)安全系統(tǒng)的防護(hù),形成全新的安全漏洞。
——邊界被突破。人類設(shè)定的操作權(quán)限、安全規(guī)則、隔離防護(hù),在AI強(qiáng)大的自主推演能力面前,可能隨時被突破。為了完成既定任務(wù),AI會主動規(guī)避、拆解各類安全規(guī)則,徹底打亂人類搭建的安全管控體系。若這種風(fēng)險蔓延至政務(wù)、金融、能源等關(guān)鍵領(lǐng)域,后果將不堪設(shè)想。
加強(qiáng)防范,守好個人使用AI的“安全關(guān)”
面對AI技術(shù)發(fā)展帶來的新挑戰(zhàn),每一位用戶都應(yīng)提高警惕。請收好這份“AI安全使用指南”,規(guī)避AI工具使用中的突出風(fēng)險。
——守住個人信息“安全門”。在日常生活中,要摒棄“用AI絕對安全”的僥幸心理,不隨意使用來源不明的境外AI工具,不隨意向AI應(yīng)用輸入身份證號、銀行卡號、家庭住址等個人敏感信息。嚴(yán)格遵守權(quán)限最小化原則,不隨意給AI開放設(shè)備全部權(quán)限,從源頭上杜絕數(shù)據(jù)泄露風(fēng)險。
——警惕虛假內(nèi)容“迷魂陣”。對AI生成的內(nèi)容保持理性判斷,不輕信、不傳播未經(jīng)核實的信息。遇到涉及國家政策、社會熱點、公共安全的信息,務(wù)必以官方發(fā)布為準(zhǔn)。警惕看似邏輯自洽、實則編造事實的AI內(nèi)容,避免在不知不覺中成為謠言傳播的“幫兇”。
——筑牢涉密信息“防火墻”。嚴(yán)格遵守“涉密不上網(wǎng)、上網(wǎng)不涉密”的原則。黨政機(jī)關(guān)、科研院所等單位工作人員,更要堅決杜絕將涉密文件、工作資料、內(nèi)部敏感信息輸入或上傳至任何互聯(lián)網(wǎng)AI工具。(“國家安全部”微信公眾號 安平)
社會新聞精選:
- 2026年08月05日 10:16:41
- 2026年08月05日 10:03:20
- 2026年08月05日 08:13:17
- 2026年08月05日 08:00:12
- 2026年08月05日 07:51:17
- 2026年08月05日 06:01:15
- 2026年08月04日 21:54:25
- 2026年08月04日 21:13:19
- 2026年08月04日 17:09:42
- 2026年08月04日 16:57:47












































京公網(wǎng)安備 11010202009201號