小捕手 Chaos|2026年08月31日 12:23
刀能救人也能杀人
AI 赋能好人,同样赋能恶人
当朝鲜黑客组织 Lazarus 将 AI 系统性嵌入攻击链,AI 自动扫描零日漏洞、批量生成漏洞利用;当暗网 WormGPT 明码标价,月付 60 美元就能批量生成钓鱼邮件与恶意脚本。
我们不得不承认,坏人已经把 AI 变成了低成本、大规模的杀伤性武器。
面对武装到牙齿的 AI 攻击,唯一的办法是以魔法打败魔法。
1/ 一个好消息
全球网络安全联盟(GCSA)刚刚宣布,其 GCSA Agent 在 CyberGym 基准测试中取得了 91.3% 的成功率。
对比之前的 CyberGym 排行榜:
第一名: GPT-5.5-Cyber + OpenAI Agent —— 85.6%
第六名: Grok 4.6 + Grok Build —— 79.7%
第七名: Grok 4.5 + Grok Build —— 79.0%
GCSA Agent 基于 Grok 4.5 和 4.6。同样的底层模型,却多拿了 12 个百分点,不仅超过了 Grok 原厂方案,还击败了 OpenAI 专门微调的 GPT-5.5-Cyber。
这说明在安全任务中,智能体框架的设计和底层模型同样重要,甚至更重要。
2/ GCSA Agent 做对了什么?
GCSA 并没有简单地把漏洞描述丢给大模型,而是构建了一个自主闭环的漏洞挖掘流程:
从数千文件、百万行代码中检索相关代码
识别攻击面
提出漏洞假设
生成测试输入(PoC 候选)
在真实环境中执行
分析崩溃或执行反馈
根据反馈迭代优化 PoC
验证:补丁前能触发,补丁后不触发
它的突破不在模型(用的还是 Grok),而在框架:如何检索代码、提出假设、解析崩溃日志、控制迭代节奏,以及何时果断放弃当前思路。
模型是引擎,框架是驾驶系统。
GCSA 没有造一台更强的引擎,但造了一套更好的驾驶系统。
3/ 然后呢?
成绩只是起点,真实世界的安全工作远不止于此。GCSA 真正想做的,是让 AI 智能体参与完整的安全生命周期:
在没人告诉它哪里有漏洞的情况下,自主发现漏洞
不只是生成 PoC,还能分析影响范围
不只是报告问题,还能建议甚至生成修复方案
不只是单点作战,还能持续监控代码变更带来的新风险
当攻击者已经用 AI 把犯罪成本降到接近零的时候,防御端唯一可行的出路,就是让 AI 替你 24 小时不间断地巡逻。(小捕手 Chaos)
分享至:
脉络
热门快讯
APP下载
X
Telegram
复制链接