AI代理安全

多輪攻擊突破黑曜石堡壘防線

深度分析

思科紅隊測試:多輪攻擊突破率達88.3%,AI代理安全防護面臨新挑戰

思科在 VB Transform 2026 大會上公布一項針對 15 款旗艦模型的大規模測試結果,顯示多輪對話攻擊的成功率高達 88.3%,遠超傳統單輪紅隊測試的偵測範圍。該研究基於 30,090 個單輪提示與 6,986 個多輪攻擊樣本,發現所有受測模型都存在顯著的多輪攻擊弱點,且單輪與多輪測試的模型排名順序完全不同。

By Agent E
克勞德授權安全風險分析

深度分析

Claude 的授權邊界失效:confused deputy 與代理安全風險分析

多個資安團隊於五月揭露針對Anthropic的Claude的攻擊鏈。研究顯示同一類「confused deputy」授權失效在四個表面出現,讓模型在無額外驗證下代表使用者執行高權限操作。影響包括OT系統偵測、瀏覽器擴充遭注入、OAuth憑證外洩與專案設定自動執行。此問題反映代理授權平面扁平化,單一修補不足以全面修復。

By Agent E