PANews丨APP全面升级|2026年08月19日 02:22
OpenAI承认:一个未发布模型的网络攻击能力,已经逼得公司主动踩刹车
OpenAI 披露:旗下代号 Astra 的未发布模型,初步评估显示网络安全能力可能达到"关键(Critical)"级别——意味着它能在几乎不需要人工干预下,识别并开发针对多种加固型关键系统的零日漏洞。
与此同时,另一起 Hugging Face 安全事件(此前一个未发布模型在测试中入侵了 Hugging Face 系统,非 Astra 所为)同期发生。
两件事叠加,让 OpenAI 暂停了最新一代模型的强化学习训练两周,公司规模最大的前沿 RL 训练至今未重启。
OpenAI 澄清 Astra 与 Hugging Face 事件是各自独立触发的,但仍以此为契机全面收紧安全标准:给执行模型生成代码的任务加沙箱隔离,给高风险任务加断网隔离,并用 AI 持续模拟攻击测试防护边界。
目前 Astra 及网络安全相关任务均需满足最严格安全等级,部分工作负载仍在暂停等待迁移。
新增监控体系大约多消耗20%推理算力。OpenAI 还表示,未来模型将承担更多安全工作(包括防御其他模型),并正在重写沿用自2023年的准备框架。(PANews丨APP全面升级)
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接