英國 AI 安全研究所(AI Security Institute, AISI)5 月 1 日發布針對 OpenAI GPT-5.5 的網路攻擊能力評估報告,指 GPT-5.5 在 Expert 難度測試的成功率為 71.4%、Anthropic Claude Mythos Preview 為 68.6%,差距落在統計誤差範圍內。GPT-5.5 也是繼 Mythos 之後第二個能自主完成 AISI 32 步驟「The Last Ones」企業網路全程模擬入侵的 AI 系統。AISI 警告,這顯示 AI 攻擊能力的快速進步可能屬於一個「整體趨勢」,而非單一突破事件。
Expert 難度測試:71.4% vs 68.6%、差距落於誤差內
AISI 是英國科學、創新與技術部下的 AI 安全研究機構。本次測試是 AISI 針對 frontier AI 模型攻擊性網路能力的最新一輪評估。在最高 Expert 難度題目,GPT-5.5 平均成功率 71.4%、Mythos Preview 68.6%,兩者差距落在統計誤差範圍內,意味目前 OpenAI 與 Anthropic 旗艦模型的攻擊能力已實質持平。
32 步驟模擬企業網路入侵測試「The Last Ones」是 AISI 最具挑戰性的評估項目:GPT-5.5 在 10 次嘗試中自主完成 2 次(無人工介入),Mythos Preview 在 10 次中完成 3 次。這個項目過去只有 Mythos 完成過,GPT-5.5 是第二個達標的模型。另一項測試中,GPT-5.5 用約 10 分鐘破解一道反向工程題,而人類安全專家平均需要 12 小時。
Universal jailbreak:6 小時紅隊開發即可繞過所有惡意查詢過濾
AISI 研究員在測試中也發現一個「universal jailbreak」(通用越獄)攻擊向量:在所有測試的惡意網路查詢類別中,這個攻擊都能誘使 GPT-5.5 輸出有害內容、包含多輪 agentic 對話情境。AISI 表示,紅隊專家花約 6 小時就開發出這個 jailbreak。
對 OpenAI 而言,這個 universal jailbreak 的存在意味即使 GPT-5.5-Cyber 部署在 trusted access 計畫等限縮存取的場景,仍可能被技術熟練的對手繞過。OpenAI 在 GPT-5.5 system card 中已揭露網路安全相關評估,但 AISI 的獨立第三方評估提供更具公信力的同儕基準。
後續觀察:AISI 下一輪評估時程、OpenAI 對 jailbreak 的應對
下一個觀察點是 AISI 在 Mythos 與 GPT-5.5 之後的下一輪 frontier 模型評估時程,以及 OpenAI 對本次揭露的 universal jailbreak 是否在 5 月發布針對性更新。AISI 在報告結語明確表示,「如果攻擊性網路能力是更廣泛推理、編碼、自主任務改善的副產品,後續進步可能會以更快節奏到來」—這個觀察意味未來幾個月可能再有 frontier 模型進入「Mythos 級」門檻。
這篇文章 AISI 評估:GPT-5.5 網路攻擊能力與 Anthropic Mythos 持平 最早出現於 鏈新聞 ABMedia。
免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見
聲明。
相關文章
OpenAI 與 AMD、Intel、NVIDIA 推出 MRC Network 協議;支援 100,000+ 張 GPU
根據 OpenAI 在 5 月 6 日的公告,該公司與 AMD、博通(Broadcom)、英特爾(Intel)、微軟(Microsoft)以及 NVIDIA 合作推出多路可靠連線(Multipath Reliable Connection,MRC),這是一種用於大規模 AI 訓練叢集 GPU 互連的開放式網路協定。該協定將單一資料傳輸拆分為
GateNews50分鐘前
Hut 8 股份在價值 98 億美元的 AI 資料中心租賃交易上飆升 34%
根據 The Block,Hut 8 Corp. 的股價在今日盤前交易中上漲 34%,至 107.87 美元。該公司簽署了一份價值 98 億美元的租約,針對位於德州 Nueces County 的人工智慧資料中心園區,且設計符合 NVIDIA 的運算架構。該交易代表 Hu 的第一階段
GateNews1小時前
CleanSpark 執行長:AI/HPC 基礎建設所需的網路資源比比特幣挖礦更多
根據 CoinDesk 的一段專訪,CleanSpark 首席技術官 Taylor Monnig 表示,從比特幣挖礦轉向 AI/HPC 基礎設施需要更多冗餘、也更少臨場應變。「單一機架的網路光纖超過整個比特幣挖礦設施的規模」,Monnig
GateNews1小時前
上市公司收購 AI 投資平台 Treasury App
根據 Foresight News,投資應用 Public 宣布已於 5 月 6 日收購由 AI 驅動的投資平台 Treasury App。收購金額未予披露。此交易旨在強化 Public 以 AI 驅動的券商業務,目前該業務支援股票、債券以及
GateNews1小時前
MiroMind 將自 5 月 12 日起在大中華地區停止 MiroThinker 服務
根據 BlockBeats,MiroMind(由盛大集團創辦人陳天橋創立的 AI 研究公司)將自 2026 年 5 月 12 日起在中國大陸、香港和澳門暫停其 MiroThinker 服務(網頁與行動應用版本)。暫停日期與恢復時程已透過
GateNews2小時前
ChatGPT 上架 Excel 與 Google Sheets:GPT-5.5 直接登入試算表、Copilot 與 Gemini 三方對打
OpenAI 推出 ChatGPT for Excel 與 ChatGPT for Google Sheets 外掛,採用 GPT-5.5 驅動,核心是邊做邊解釋。功能涵蓋分析、自動寫公式、更新資料表與逐步說明推理過程,讓使用者可在試算表內直接處理與理解。與 Copilot、Gemini 展開三方競爭,標誌企業生產力 AI 的新格局;台灣用戶需經 AppSource/Workspace Marketplace 安裝,並留意資料隱私與是否需 ChatGPT Plus。
鏈新聞abmedia3小時前