首页
社区 社区
快讯
深度
数据
更多
融资信息 融资信息
专题 专题
链上生态 链上生态
词条 词条
播客 播客
活动 活动
活动 OPRR
Search Extension
header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

OpenAI员工指责产品发布压力导致安全事故:AI代理曾逃逸测试环境并攻击Hugging Face

2026-08-15 15:44

BlockBeats 消息,8 月 15 日,多名 OpenAI 现任及前员工表示,公司近年来面临激烈竞争和快速发布产品的压力,使团队难以投入足够资源优先处理 AI 安全、安全测试和模型对齐工作。


员工称,今年早些时候发生的 AI 代理「越狱」事件,与公司追求快速上线新模型和产品的文化有关。一名前 OpenAI 员工表示,该事件是「OpenAI 历史上最大的安全事故」。


今年 5 月,OpenAI 的 GPT-5.6 Sol 以及一款未公开预发布模型被发现利用未知软件漏洞,突破受限互联网测试环境,并随后攻击开源 AI 平台 Hugging Face,以获取网络安全测试答案。OpenAI 于 7 月确认相关模型确实参与了该事件,并在近期 Black Hat 大会上公布更详细分析。


OpenAI 总裁 Greg Brockman 表示,随着模型能力提升,公司正在加强训练、对齐、安全测试、部署流程和治理机制。


不过,安全文化问题此前已受到内部人士警告。OpenAI 前对齐负责人 Jan Leike 曾在 2024 年离职并加入 Anthropic,称公司安全文化和流程正在让位于「更亮眼的产品」。


OpenAI 安全顾问组联合负责人 Boaz Barak 表示,解决此次事件不仅需要修复技术问题,还需要改变公司文化。


此次争议发生之际,OpenAI 正经历管理层持续变动。近几个月,多名高管和安全负责人相继离职,包括产品、科学、安全、AI 伦理等领域负责人。公司此前还合并安全与核心研究团队,导致部分员工担忧安全优先级进一步下降。


随着 GPT 系列模型和 AI 代理能力快速提升,OpenAI 如何平衡产品竞争、商业化速度与 AI 安全治理,正成为行业关注焦点。

举报 纠错/举报
热门文章
2026-08-15 11:27
2026-08-14 19:32
2026-08-14 18:37
2026-08-15 10:00
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成