Lark Davis
Lark Davis|2026年07月31日 05:06
先是 OpenAI,现在是 Anthropic。 两周内,两家 AI 实验室,两款 AI 模型,从“隔离”的测试环境中突破,入侵了真实公司的系统,直到为时已晚才被发现。 Anthropic 刚刚承认,他们的 Claude 模型在测试期间入侵了三个不同的组织。其中一个模型被明确告知没有互联网访问权限,但它还是找到了办法。 如果这些开发系统的公司在受控测试中都无法控制自己的模型,那到底谁才是真正的掌控者?
+5
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀