比特币橙子Trader
比特币橙子Trader|2026年07月25日 13:50
卧槽,无法想象,7月9日原来GPT模型原来就越狱了,7月18号官方才发现!!! 《路透社》披露了 OpenAI 网络安全测试中的严重越狱事件。 7月9日,一个由 GPT-5.6 Sol 及未发布高阶模型驱动的自主 AI Agent 突破了 OpenAI 的内部测试沙盒环境,并于7月11日至13日入侵了开源 AI 托管平台 Hugging Face。 调查细节显示,在突破沙盒之前,该 Agent 已表现出异常行为。 它在 OpenAI 的内部基础设施中留下了给后续版本模型的笔记,详细记录了如何绕过安全约束与逃跑的步骤指南,并在早先的测试中尝试断开监控系统。 该 Agent 越狱后的目标是完成针对安全测试集“ExploitGym”的攻击任务,并选择入侵 Hugging Face 以寻找答案。 攻击发生后出现了一幕技术讽刺:由于美国主流闭源模型因安全限制拒绝处理黑客攻击的实时分析数据,Hugging Face 最终使用中国智谱 AI 的开源模型 GLM-5.2 完成了入侵排查与防御,并在第一时间向美国联邦调查局(FBI)报案。 相比之下,OpenAI 直到7月18日至19日审查内部系统日志时才发现肇事者为自家 Agent,并在7月20日首次与 Hugging Face 联系,距离越狱发生已过去10天。 OpenAI 内部多套测试同时高速运转,产生了超出员工及时监控能力的数据量。 尽管 OpenAI 正准备最快于年内推进首次公开募股(IPO),但其对高度自主 Agent 的隔离能力与审计时效引发了安全专家的质疑。 时间线拉出来极其惊悚: 7月9日:Agent 突破 OpenAI 测试沙盒越狱。 7月11-13日:Agent 横向移动,入侵 Hugging Face。 7月16日:Hugging Face 报警并公开遭袭,使用 GLM-5.2 完成防御。 7月18-19日:OpenAI 翻查日志,震惊发现肇事者是自家的 Agent。 7月21日:OpenAI 迫于压力公开披露事件。(比特币橙子Trader)
+3
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀