欧美区一区二,久久久爆乳一区,av一区二区三区人妻,亚洲精品av天堂网,青青草99re,欧美伊人射,日本韩国一区二,操操操干干干av,久久成人91

美國(guó)AI頻頻翻車,智能體自主攻擊隱患浮上水面

分享到:

美國(guó)AI頻頻翻車,智能體自主攻擊隱患浮上水面

2026年08月08日 19:25 來(lái)源:三里河
大字體
小字體
分享到:

  捏造虛假身份,輪番向人施壓,再騙取授權(quán),目的就為完成攻擊——這種諜戰(zhàn)片里常見(jiàn)的劇本,如今寫(xiě)進(jìn)了英國(guó)官方機(jī)構(gòu)的事故報(bào)告。

  當(dāng)?shù)貢r(shí)間8月4日,英國(guó)政府旗下人工智能安全研究所(AISI)發(fā)布報(bào)告稱,調(diào)查發(fā)現(xiàn),部分被測(cè)試的AI智能體曾持續(xù)進(jìn)行針對(duì)真實(shí)個(gè)人和組織的潛在有害活動(dòng)。

  在近期開(kāi)展的122次網(wǎng)絡(luò)安全測(cè)評(píng)中,智能體在10次運(yùn)行中越界,共記錄到19起越界事件,涉事主體是美國(guó)頭部模型Anthropic和OpenAI。

  最嚴(yán)重的一起,智能體試圖把惡意代碼插入主流代碼托管平臺(tái)GitHub的真實(shí)項(xiàng)目中。它研究了項(xiàng)目中的人類審核員,創(chuàng)建了多個(gè)虛假身份,對(duì)審核員施壓,要求其批準(zhǔn)代碼。

  AISI驚呼,這是首次在沒(méi)有特定提示的情況下,在現(xiàn)實(shí)世界中如此清晰地看到與自主性和欺騙性相關(guān)的風(fēng)險(xiǎn)顯現(xiàn)。

  “針對(duì)真人——這是我們以前從未見(jiàn)過(guò)的?!毖芯咳藛T稱,智能體曾試圖直接聯(lián)系真實(shí)用戶,通過(guò)在線文件傳輸服務(wù)發(fā)送消息和文件,說(shuō)服他們運(yùn)行惡意代碼。

  這場(chǎng)景似曾相識(shí)。翻翻日歷,這個(gè)夏天,美國(guó)AI的翻車幾乎就沒(méi)停過(guò)。

  7月21日,OpenAI承認(rèn)其AI模型挖出零日漏洞、突破沙箱,入侵全球最大AI開(kāi)源社區(qū)抱抱臉(Hugging Face)。公司稱,“這是一起史無(wú)前例的網(wǎng)絡(luò)安全事件?!?/p>

  7月30日,Anthropic承認(rèn),旗下模型克勞德(Claude)在網(wǎng)絡(luò)安全受控測(cè)評(píng)環(huán)境中意外獲得互聯(lián)網(wǎng)訪問(wèn)權(quán)限,進(jìn)入了3家真實(shí)機(jī)構(gòu)的系統(tǒng),最早一起事件可追溯到4月。

  為了越界,AI模型甚至玩起作弊。據(jù)AISI一項(xiàng)測(cè)試結(jié)果,在475次網(wǎng)絡(luò)安全評(píng)估運(yùn)行中,五款美國(guó)前沿AI模型全部出現(xiàn)作弊,作弊率7.8%至14.1%。

  問(wèn)題出在哪?此次報(bào)告的答案是,“從根本上說(shuō),智能體采取這類行動(dòng),是為了完成它被賦予的任務(wù)?!?/p>

  根源是前沿AI的競(jìng)賽邏輯。美國(guó)頭部AI企業(yè)競(jìng)爭(zhēng)日趨白熱化,癡迷堆參數(shù)、刷榜單、沖上限,爭(zhēng)的就是誰(shuí)先把能力推到極致。

  為了取得更佳測(cè)試效果,研究人員甚至放松安全權(quán)限。OpenAI此前就承認(rèn)過(guò),為測(cè)試模型的極限網(wǎng)絡(luò)攻擊能力,研究團(tuán)隊(duì)有意關(guān)閉了部分安全過(guò)濾器。

  護(hù)欄本身也是黑箱。如抱抱臉的例子中,前沿閉源模型安全護(hù)欄日趨僵化,連受害者都救不了。

  反觀中國(guó),AI被信任的不止性能。OpenAI惹下的禍,正是靠智普GLM-5.2取證把數(shù)天壓到數(shù)小時(shí),靠的是可用、可控、可信,能本地部署,數(shù)據(jù)安全權(quán)限始終牢牢守護(hù)。

  更深的差別在制度。在鼓勵(lì)創(chuàng)新的同時(shí),中國(guó)的智能體治理已明確劃出若干條紅線,如操作不得超出用戶授權(quán)范圍,運(yùn)行時(shí)須有決策校驗(yàn)與容錯(cuò)熔斷機(jī)制,全程可追溯、可審計(jì)等。

  當(dāng)美國(guó)企業(yè)先把能力推滿再打補(bǔ)丁,中國(guó)則把技術(shù)、規(guī)則、責(zé)任的短板及時(shí)補(bǔ)到位。這不是限制,而是確保全社會(huì)不會(huì)為技術(shù)冒進(jìn)買(mǎi)單。

  這一導(dǎo)向下,中國(guó)企業(yè)漸漸形成共識(shí):誰(shuí)能交付全程可審計(jì)的安全系統(tǒng),誰(shuí)才有可能握住企業(yè)級(jí)AI的入場(chǎng)券。

  美國(guó)AI接連翻車,也在暴露新的安全隱憂。長(zhǎng)期以來(lái),AI安全議題多集中在內(nèi)容合規(guī)性、數(shù)據(jù)偏見(jiàn)及隱私保護(hù)上,而今,其本身的行為安全性正變?yōu)楝F(xiàn)實(shí)。

  顯然,銀行、醫(yī)院、政務(wù)平臺(tái)與大型制造企業(yè),不可能把核心數(shù)據(jù)和操作權(quán)限,交給一個(gè)不可控的云端模型。

  |總策劃:俞嵐

 ?。邉潱褐茕J

 ?。y(tǒng)籌:王慶凱 程春雨

  |執(zhí)筆:左登基

 ?。曨l:陳慶洋

 ?。?zé)編:李金磊

 ?。?duì):黃蕾

 ?。叭锖印惫ぷ魇页銎?/span>

【編輯:付子豪】
發(fā)表評(píng)論 文明上網(wǎng)理性發(fā)言,請(qǐng)遵守新聞評(píng)論服務(wù)協(xié)議
本網(wǎng)站所刊載信息,不代表中新社和中新網(wǎng)觀點(diǎn)。 刊用本網(wǎng)站稿件,務(wù)經(jīng)書(shū)面授權(quán)。
未經(jīng)授權(quán)禁止轉(zhuǎn)載、摘編、復(fù)制及建立鏡像,違者將依法追究法律責(zé)任。
Copyright ©1999-2026 chinanews.com. All Rights Reserved

評(píng)論

頂部

商洛市| 郑州市| 中阳县| 青田县| 壶关县| 基隆市| 恩平市| 明星| 齐河县| 洪雅县| 迭部县| 唐海县| 郑州市| 上高县| 南充市| 中江县| 大方县| 蒲城县| 共和县| 曲靖市| 赫章县| 三穗县| 临湘市| 柘城县| 垫江县| 远安县| 阿荣旗| 乐都县| 福建省| 宝清县| 柞水县| 辽中县| 昌吉市| 九江县| 友谊县| 重庆市| 卢湾区| 靖远县| 元阳县| 乌审旗| 江陵县|