小捕手 Chaos
小捕手 Chaos|2026年08月31日 12:23
刀能救人也能杀人 AI 赋能好人,同样赋能恶人 当朝鲜黑客组织 Lazarus 将 AI 系统性嵌入攻击链,AI 自动扫描零日漏洞、批量生成漏洞利用;当暗网 WormGPT 明码标价,月付 60 美元就能批量生成钓鱼邮件与恶意脚本。 我们不得不承认,坏人已经把 AI 变成了低成本、大规模的杀伤性武器。 面对武装到牙齿的 AI 攻击,唯一的办法是以魔法打败魔法。 1/ 一个好消息 全球网络安全联盟(GCSA)刚刚宣布,其 GCSA Agent 在 CyberGym 基准测试中取得了 91.3% 的成功率。 对比之前的 CyberGym 排行榜: 第一名: GPT-5.5-Cyber + OpenAI Agent —— 85.6% 第六名: Grok 4.6 + Grok Build —— 79.7% 第七名: Grok 4.5 + Grok Build —— 79.0% GCSA Agent 基于 Grok 4.5 和 4.6。同样的底层模型,却多拿了 12 个百分点,不仅超过了 Grok 原厂方案,还击败了 OpenAI 专门微调的 GPT-5.5-Cyber。 这说明在安全任务中,智能体框架的设计和底层模型同样重要,甚至更重要。 2/ GCSA Agent 做对了什么? GCSA 并没有简单地把漏洞描述丢给大模型,而是构建了一个自主闭环的漏洞挖掘流程: 从数千文件、百万行代码中检索相关代码 识别攻击面 提出漏洞假设 生成测试输入(PoC 候选) 在真实环境中执行 分析崩溃或执行反馈 根据反馈迭代优化 PoC 验证:补丁前能触发,补丁后不触发 它的突破不在模型(用的还是 Grok),而在框架:如何检索代码、提出假设、解析崩溃日志、控制迭代节奏,以及何时果断放弃当前思路。 模型是引擎,框架是驾驶系统。 GCSA 没有造一台更强的引擎,但造了一套更好的驾驶系统。 3/ 然后呢? 成绩只是起点,真实世界的安全工作远不止于此。GCSA 真正想做的,是让 AI 智能体参与完整的安全生命周期: 在没人告诉它哪里有漏洞的情况下,自主发现漏洞 不只是生成 PoC,还能分析影响范围 不只是报告问题,还能建议甚至生成修复方案 不只是单点作战,还能持续监控代码变更带来的新风险 当攻击者已经用 AI 把犯罪成本降到接近零的时候,防御端唯一可行的出路,就是让 AI 替你 24 小时不间断地巡逻。(小捕手 Chaos)
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀