網絡安全這道防線,正在被一種新的作戰單元重新定義。7月21日,日本人工智能初創企業Sakana AI發佈專爲應對現代網絡防禦複雜性而打造的Fugu Cyber模型,它在業界最具挑戰性的安全基準測試裏交出了足以壓過頭部閉源對手的成績。

具體來看,Fugu Cyber在CyberGym測試中達到86.9%的成功率,在CTI-REALM測試中達到72.1%的成功率,表現甚至優於OpenAI的GPT-5.5-Cyber與Anthropic的Claude Mythos-Preview。這意味着,面對真實而刁鑽的攻防場景,這家初創公司的專用模型已經跑到了通用旗艦的前面。
Fugu Cyber的能力來源於它的系統形態。與標準版Fugu一脈相承,它是一個被封裝成單一API的多智能體系統,針對用戶的每一次請求,系統會動態編排不同的專業智能體,協作處理複雜的多步驟任務,而不是靠單個模型硬扛。除了這套簡潔的API,Sakana AI還提供由企業應用團隊支持的網絡安全解決方案實地部署服務,把模型能力直接搬進客戶的生產環境。
