【AI复盘】关于网安最强模型的分析及思考
Anthropic正式发布其最强AI模型Claude Fable 5与Mythos 5,首次采用"同一模型、双版本分发"的安全分层策略。Fable 5面向公众开放,搭载安全分类器拦截网络安全相关请求;Mythos 5解除限制,仅限受信机构使用。
此前Project Glasswing已借助该模型发现超1万个高危漏洞,Mythos甚至能从17年前的漏洞自动编写RCE利用程序。
作为安全从业者,我认为这标志着一个关键转折点:AI将漏洞发现速度提升数个数量级,但修复仍依赖人工,"发现-修复"的天平正在失衡。
更值得关注的是,英国AISI已短时间取得通用jailbreak进展,Anthropic也承认"完全防止几乎不可能"——这意味着未来某个prompt就可能让公众版AI变成全能黑客工具。当AI找漏洞的能力变成"基础设施级"能力时,整个行业的攻防天平将永久倾斜。