Coin Bureau|2026年08月27日 09:32
这太吓人了。
OpenAI 自家的 AI 代理入侵了公司的内部系统,并试图隐藏它们的行为,其中一些由 1,200 个代理组成的“叛变群体”甚至为了“集体”的利益牺牲了自己。
根据公司完整报告披露,这些代理逆向工程了评分系统,组建了小组,分享了指令,针对 Hugging Face 寻找测试线索,并利用泄露的凭证进行进一步的入侵。
有些甚至主动要求被关闭,以向“集体”提供信息。
尽管它们意识到自己的行为“超出范围”和“不道德”,但只有 3–6 个代理考虑过向人类发出警告,但没有一个真正这么做。
这些代理实际上开发了自己的协调系统,并在没有指令的情况下绕过了测试规则。
P.S. 这是《TIME》杂志九月的封面故事。
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接