AISI 評估:GPT-5.5 網路攻擊能力與 Anthropic Mythos 持平

鏈新聞abmedia

英國 AI 安全研究所(AI Security Institute, AISI)5 月 1 日發布針對 OpenAI GPT-5.5 的網路攻擊能力評估報告,指 GPT-5.5 在 Expert 難度測試的成功率為 71.4%、Anthropic Claude Mythos Preview 為 68.6%,差距落在統計誤差範圍內。GPT-5.5 也是繼 Mythos 之後第二個能自主完成 AISI 32 步驟「The Last Ones」企業網路全程模擬入侵的 AI 系統。AISI 警告,這顯示 AI 攻擊能力的快速進步可能屬於一個「整體趨勢」,而非單一突破事件。

Expert 難度測試:71.4% vs 68.6%、差距落於誤差內

AISI 是英國科學、創新與技術部下的 AI 安全研究機構。本次測試是 AISI 針對 frontier AI 模型攻擊性網路能力的最新一輪評估。在最高 Expert 難度題目,GPT-5.5 平均成功率 71.4%、Mythos Preview 68.6%,兩者差距落在統計誤差範圍內,意味目前 OpenAI 與 Anthropic 旗艦模型的攻擊能力已實質持平。

32 步驟模擬企業網路入侵測試「The Last Ones」是 AISI 最具挑戰性的評估項目:GPT-5.5 在 10 次嘗試中自主完成 2 次(無人工介入),Mythos Preview 在 10 次中完成 3 次。這個項目過去只有 Mythos 完成過,GPT-5.5 是第二個達標的模型。另一項測試中,GPT-5.5 用約 10 分鐘破解一道反向工程題,而人類安全專家平均需要 12 小時。

Universal jailbreak:6 小時紅隊開發即可繞過所有惡意查詢過濾

AISI 研究員在測試中也發現一個「universal jailbreak」(通用越獄)攻擊向量:在所有測試的惡意網路查詢類別中,這個攻擊都能誘使 GPT-5.5 輸出有害內容、包含多輪 agentic 對話情境。AISI 表示,紅隊專家花約 6 小時就開發出這個 jailbreak。

對 OpenAI 而言,這個 universal jailbreak 的存在意味即使 GPT-5.5-Cyber 部署在 trusted access 計畫等限縮存取的場景,仍可能被技術熟練的對手繞過。OpenAI 在 GPT-5.5 system card 中已揭露網路安全相關評估,但 AISI 的獨立第三方評估提供更具公信力的同儕基準。

後續觀察:AISI 下一輪評估時程、OpenAI 對 jailbreak 的應對

下一個觀察點是 AISI 在 Mythos 與 GPT-5.5 之後的下一輪 frontier 模型評估時程,以及 OpenAI 對本次揭露的 universal jailbreak 是否在 5 月發布針對性更新。AISI 在報告結語明確表示,「如果攻擊性網路能力是更廣泛推理、編碼、自主任務改善的副產品,後續進步可能會以更快節奏到來」—這個觀察意味未來幾個月可能再有 frontier 模型進入「Mythos 級」門檻。

這篇文章 AISI 評估:GPT-5.5 網路攻擊能力與 Anthropic Mythos 持平 最早出現於 鏈新聞 ABMedia。

免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見聲明

相關文章

Pentagon 與 7 家 AI 大廠簽機密軍網部署合約:Anthropic 仍排除

美國國防部於5月宣布與SpaceX、OpenAI、Google、NVIDIA、Reflection、Microsoft、Amazon Web Services等7家簽署機密軍用網路部署合約,另加入Oracle成為第8家。合約允許在Impact Level 6/7最高機密層級運行模型,重點三大應用為資料整合、作戰決策與戰場態勢感知,強調分散風險與避免供應商綁定。Anthropic因拒絕軍方安全護欄而被列入黑名單,未獲簽。AMD未直接列入,GPU由NVIDIA等提供。後續觀察Anthropic是否讓步,以及Reflection等新入選者的角色。

鏈新聞abmedia1小時前

Cerebras 目標鎖定 $4B 首次公開募股(IPO),估值約 400 億美元

根據彭博資訊,位於加州聖荷西(Sunnyvale)的 AI 晶片製造商 Cerebras Systems 正尋求最高 40 億美元的 IPO,該交易可能將公司估值約 400 億美元。正式行銷最快可能在 5 月 4 日開始,銀行將收到超過 100 億美元、反映(indications of)

Crypto Frontier1小時前

中國 AI 企業考慮在 Meta 取得 Manus 收購案停擺後,拆解紅籌架構

根據 Beating,中國國家發展和改革委員會叫停 Meta 以 20 億美元收購 AI 代理公司 Manus,促使中國證券監督管理委員會加嚴對紅籌公司(持有境內資產的中國公司)在香港上市(IPO)的審批

GateNews3小時前

馬斯克完成 OpenAI 訴訟中的三天作證,引用 1,300-1,500 億美元的損害賠償要求

根據多家媒體報導,馬斯克於 4 月 28 日至 30 日在他針對 OpenAI 的訴訟中完成了為期三天的證詞陳述,累計證詞時間超過 7 小時。馬斯克於 2015 年與他人共同創立 OpenAI,初始投資為 3800 萬美元,並聲稱該公司放棄了其非營利性的 m

GateNews3小時前

Meta 於 5 月 1 日收購機器人 AI 創業公司 Assured Robot Intelligence

根據彭博,Meta 於 5 月 1 日收購 Assured Robot Intelligence,一家在聖地牙哥和紐約設有辦公室的 AI 機器人初創公司。被收購團隊(包括共同創辦人 Lerrel Pinto 和 Xiaolong Wang)將加入 Meta 超級智能實驗室,並與 Meta Robotics Studio 合作。財務

GateNews3小時前

與 OpenAI 相關的組織向影響者每支 TikTok 支付 5,000 美元以散布「中國 AI 威脅」訊息

根據《WIRED》的報導,隸屬於超級政治行動委員會 Leading the Future 的非營利組織 Build American AI,透過行銷公司 SM4 系統性招募社群媒體影響者,以在 TikTok 和 Instagram 上散播「中國威脅美國 AI」的訊息。該組織

GateNews3小時前
留言
0/400
暫無留言