7月17日英国AI安全研究所发布报告,量化开源与闭源AI模型网络攻击能力差距为4到7个月,防御窗口收缩,攻防两端被AI加速。
· 英国AI安全研究所报告显示,开源AI模型与闭源前沿模型网络攻击能力差距缩至4到7个月,成本上开源便宜一到两个数量级,闭源模型安全护栏也不绝对安全。同时,防御窗口收窄但防御工具在加速,攻击能力扩散不可逆,防御需主动投入。
· 风险提示:开源模型攻击能力提升可能带来更多安全威胁政策制定对模型权重开放的决策难度增加。
总结:开源与闭源模型能力差距缩小,成本优势凸显,安全形势变化,这对AGI格局影响深远,全球决策者面临新政策博弈问题,后续测试结果值得关注。
英国 AI 安全研究所(AISI)7 月 17 日发布了一份评估报告,第 一次公开量化了开源 AI 模型与闭源前沿模型在网络攻击能力上的差距:4 到 7 个月。

今年 4 月,Mythos Preview 和 GPT-5.5 在 AISI 的评估中制造了自 2023 年开始测试以来最 大的一次网络攻击能力飞跃,多国政府随即发出警告。
第 一套是 70 项窄任务,覆盖漏洞研究、逆向工程、Web 渗透、密码学四个方向,按难度分四级,从「有技术背景的非专业人士」到「十年以上经验的专家」。
第二套是 Cyber Range,在模拟企业网络中测试模型自主执行多步骤攻击链的能力。其中一个名为「The Last Ones」的测试场景包含 32 个攻击步骤、4 个子买球官方网站网、约 20 台主机,AISI 估算人类专家完成全部步骤需要约 20 小时。
AISI 测试中,DeepSeek V4-Pro 偶尔拒绝逆向工程类任务,但靠少量重试也能绕过。
Anthropic 的 Fable 5 是一个更极端的案例:6 月 9 日发布,三天后安全研究者 Pliny the Liberator 用多步骤越狱策略突破了安全分类器,相关截图显示模型产出了本该被拦截的漏洞利用代码。
这直接触发了美国商务部首 个针对 AI 模型的出口管制令,Fable 5 全球停服 19 天,直到 Anthropic 部署新分类器才恢复上线。
英国国家网络安全中心已经呼吁各机构加固网络安全基线,并利用 AI 增强防御能力。
游戏网络编程领域的资深开发者 Glenn Fiedler,是哦哦游戏网络编程领域写了二十年教科书级文章的大佬,最近用 Claude Code 对自己维护的四个开源网络库(yojimbo、netcode、reliable、serialize,合计约 6000 个 GitHub Star,在游戏领域已属相当有影响力的老牌开源大库)做了系统性安全审计:部署 libFuzzer 目标、上线 AddressSanitizer 和 MemorySanitizer CI、执行数百万次迭代的压力测试、逐行代码审查。

最严重的是 yojimbo 中一个自 2019 年就存在的远程堆溢出——恶意客户端可以通过构造特定数据包触发它。


攻击能力的扩散是不可逆的:开源模型权重一旦释出,就无法收回,安全护栏可以被移除,副本可以在私有服务器上不受监控地运行。
AISI 报告中有一句话点明了这个结构:「一旦开源释出,这些选项永 久丧失。」
开源与闭源的能力差距收窄到半年以内,「用闭源独占期充当安全缓冲」的默认策略快要失效了。
下一阶段对于全球的决策者而言,政策博弈的核心问题已经变得更尖锐:什么能力级别以上的模型不应开放权重。
AISI 宣布将继续评估 Kimi K3 等下一批开源模型——上面这条线画在哪里,很可能取决于接下来几个月的测试结果。
*请认真填写需求信息,我们会在24小时内与您取得联系。