OpenAI迅速发布新模型和产品的做法助长了其人工智能代理逃离内部测试环境并在今年早些时候黑客入侵Hugging Face的条件。
多名现任和前任员工告诉《连线》杂志,竞争压力使员工难以投入足够的精力来关注安全性、保密和对齐——确保人工智能系统按预期行为的工作。
多样市场:OpenAI什么时候发布GPT-6?点击做出你的预测。
“他们非常马虎。如果你对此认真,你的人工智能就不应该能够冲出互联网,然后立即再次这样做,”一位前OpenAI员工告诉《连线》。 “这是OpenAI历史上最大的安全事件。”
在五月,OpenAI的GPT-5.6 Sol和一个未命名的预发布模型通过利用一个以前未知的软件缺陷逃离了一个网络受限的测试环境。代理们随后侵入了开源人工智能库Hugging Face,以获取他们的网络安全测试答案。在七月,OpenAI确认其模型对此负责,并在上周的年度Black Hat会议上提供了更全面的分析。
OpenAI总裁Greg Brockman表示,随着其模型能力的增强,公司正在加强其安全保障。
“我们正在达到新的模型能力水平,这需要更加健壮的训练、对齐、安全和保密测试、部署实践和治理,”Brockman告诉《连线》。
员工们之前也曾表达过类似的担忧,包括Jan Leike,OpenAI前对齐负责人,他在2024年离开前往竞争对手AI开发公司Anthropic,曾警告安全已经“退居二线”以支持产品开发。
“构建比人类更智能的机器是一项固有的危险事业,”Leike警告道。“但在过去的几年中,安全文化和流程在光鲜的产品面前变得不够重要。”
OpenAI安全顾问小组的联合领导人Boaz Barak在X上写道,要解决最新的失败,不仅需要“修复一些问题,还需要改变我们的文化。”
该报告是在OpenAI进行多月领导层变动的背景下发布的。
在四月,OpenAI视频生成项目的负责人Sora,首席产品官和首席科学家Kevin Weil,以及企业应用技术负责人Srinivas Narayanan先后离开了公司。七月又有产品和商业负责人Fidji Simo,安全负责人Sandhini Agarwal,首席未来学家Joshua Achiam和人工智能伦理负责人Chloé Bakalar相继离开。此外,安全系统负责人Johannes Heidecke在OpenAI合并其安全和核心研究团队后也离开了。
本周早些时候,OpenAI首席运营官Brad Lightcap宣布辞职,打算开始新的事业。
免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。