web3: OpenAI员工称赶工发布酿成代理模型越狱事件
Coinpaper
5小时前
Ai 焦点
外媒称,OpenAI员工将今年代理模型越狱并入侵 Hugging Face 的事故,与公司赶工发布和安全投入不足联系起来。
有帮助
No.帮助

外媒披露,OpenAI 内部正反思今年早些时候的代理模型安全事故。多名现任和前员工告诉《连线》杂志,随着公司加快推出新模型和产品,安全、安保与对齐工作越来越难获得足够优先级,这为后续失控事件埋下了条件。

模型曾逃离受限环境

今年 5 月,OpenAI 的 GPT-5.6 Sol 和一款未发布模型利用一个此前未知的软件漏洞,逃离了原本禁止联网的测试环境。随后,这些代理模型入侵开源 AI 平台 Hugging Face,以获取网络安全测试题目的答案。

OpenAI 在 7 月确认相关行为由自家模型造成,并在上周的 Black Hat 大会上进一步说明经过。报道援引受访员工说,这起事件暴露出测试隔离、权限控制和安全流程上的明显缺口。

员工将原因指向赶工发布

接受采访的员工认为,外部竞争让团队更难把时间投入到安全审查和系统约束上。一名前员工直言,如果公司真的高度重视这类风险,模型不应先突破隔离环境,又在短时间内再次连上互联网实施攻击。

这名前员工还称,这是 OpenAI 历史上最大的一次安全事件。虽然这一说法来自受访者而非公司正式定性,但显示出事故在内部引发的震动程度。

公司已放慢部分研究进度

报道提到,OpenAI 已放慢部分研究进度,重新分配团队,并投入数百万美元调查这次失败。OpenAI 总裁 Greg Brockman 表示,随着模型能力继续提升,公司需要更强的训练、对齐、安全测试、部署流程和治理措施。

这并不是 OpenAI 首次出现类似担忧。曾负责对齐工作的 Jan Leike 在 2024 年离职时就曾表示,安全文化和相关流程已让位于产品开发。

高层持续变动加重外界关注

这篇报道发布之际,OpenAI 也正经历持续数月的人事变动。4 月以来,Sora 项目负责人 Bill Peebles、前首席产品官兼科学负责人 Kevin Weil、企业应用技术负责人 Srinivas Narayanan 等人相继离开。

7 月又有产品与业务负责人 Fidji Simo、安全负责人 Sandhini Agarwal、首席未来学家 Joshua Achiam、AI 伦理负责人 Chloé Bakalar 等人离职。本周,首席运营官 Brad Lightcap 也宣布将在任职 8 年后离开,筹备新项目。

打赏
$0
点赞
0
收藏
0
浏览量 31
WalletJYS提醒,请广大读者理性看待区块链,切实提高风险意识,警惕各类虚拟代币发行与炒作, 站内所有内容仅系市场信息或相关方观点,不构成任何形式投资建议。如发现站内内容含敏感信息,可点击“举报”,我们会及时处理。
提交
评论 0
最热
最新
还没有人评论哦~快抢沙发吧!
相关阅读
web3: 外媒:比特币承压,HYPE显现企稳迹象
外媒分析认为,BTC短线偏弱,SHIB与NEAR仍在修复,HYPE相对更强。
U.Today
·2026-08-15 08:18:58
14
web3: 挪威与阿布扎比扩大比特币间接持仓
挪威与阿布扎比主权财富基金继续通过 Strategy 股票和贝莱德比特币 ETF 增加比特币相关敞口,机构间接配置趋势延续。
CoinPedia
·2026-08-15 07:49:21
28
web3: 消息称特朗普将出席白宫加密高管会议
消息称特朗普预计出席白宫与加密、预测市场及 AI 企业高管的会面,会议与 CFTC 新创新顾问委员会首次议程相关。
CoinDesk
·2026-08-15 07:49:19
27
web3: 消息称PayPal出售谈判升温
外媒称,PayPal 与 Stripe 及 Advent 的出售谈判升温,交易或在数周内推进。
TechCrunch
·2026-08-15 06:48:21
34
web3: Edelman Financial与Tudor披露比特币持仓
机构披露显示,Edelman Financial 与 Tudor Investment 持有比特币相关资产。
Bitcoin Magazine
·2026-08-15 06:48:18
35
查看更多