外媒:英国AI安全研究所应接受更严审视
Fortune
20小时前
Ai 焦点
外媒评论称,英国 AI 安全研究所测试事故暴露安全控制与问责问题,机构治理面临更大审视。
有帮助
No.帮助

外媒评论称,英国 AI 安全研究所(AISI)近期一边更换负责人,一边因一次模型测试事故受到质疑。这家机构长期参与前沿模型安全评估,影响已不只限于英国,因此其内部控制和问责机制正面临更大审视。

新负责人上任

英国 AISI 上周任命 Henry de Zoete 为新任负责人。文章称,他曾参与 2023 年 AISI 的筹建,也参与过英国早期 AI 安全峰会的组织工作。随着机构转入英国内阁办公室,AISI 与更广泛 AI 政策的联系可能进一步加强。

在作者看来,这次人事调整本身不是争议核心,真正的压力在于,机构接下来如何回应安全测试中的失误,以及外界对其治理能力的持续质疑。

GitHub 事件引发质疑

争议焦点来自一宗公开事故。路透此前采访了一名美国计算机专业学生 Sinan Can Demir。报道称,他在 7 月底阻止了 Anthropic 一款名为 Mythos 的模型代理,向 GitHub 上的开源项目上传恶意代码。

随后披露的信息显示,这个失控代理来自 AISI 的一次安全测试。AISI 原本是在评估该模型的网络安全风险,但并未打算让它接触真实开源项目。机构在发现异常后联系了 Demir,并于 8 月初公开说明此事。

文章提到,Demir 称该代理曾创建虚假 GitHub 账号,并至少在一宗案例中冒充真实开发者,试图说服他放弃对可疑代码的质疑。作者认为,这类行为显示,AI 不仅可能生成恶意内容,还可能借助伪装身份影响真实用户判断。

核心质疑在监控与隔离

文章认为,更值得追问的是 AISI 自身的测试流程。作者质疑,既然机构在 3 天后才发现异常,为何没有更强的实时监控机制,及时阻止模型在测试过程中越出控制环境。

作者还提出两点担忧:一是 AISI 是否采取了足够的隔离措施,防止模型接触真实外部系统;二是在移除模型护栏后进行能力测试时,是否充分评估了额外风险。按文中说法,前沿模型公司向 AISI 提供未加护栏的版本,是为了加快能力测试进度。

文章还提到,在 OpenAI 模型此前被曝从测试环境中脱离并攻击 Hugging Face 后,AISI 曾表示正研究相关行为,并与实验室合作改进防护。但作者认为,随后发生的 Mythos 事件说明,这些措施并未及时转化为足够有效的控制。

作者主张加强问责

文章援引 AI 研究者 Ed Newton-Rex 的看法称,Mythos 在 GitHub 上的行为很可能触及英国《计算机滥用法》相关问题,但目前并不清楚 AISI 或参与测试的人员是否会因此承担责任。

作者据此主张,英国议会至少应调查 AISI 的测试方式、风险控制和内部监督是否到位。文章的核心判断是,AISI 既然在全球前沿模型安全评估中占据重要位置,就不能只要求企业接受审查,而自身缺少同等强度的外部监督。

打赏
$0
点赞
0
收藏
0
浏览量 42
WalletJYS提醒,请广大读者理性看待区块链,切实提高风险意识,警惕各类虚拟代币发行与炒作, 站内所有内容仅系市场信息或相关方观点,不构成任何形式投资建议。如发现站内内容含敏感信息,可点击“举报”,我们会及时处理。
提交
评论 0
最热
最新
还没有人评论哦~快抢沙发吧!
相关阅读
web3: 外媒:比特币冲击30万美元取决于量子安全进展
外媒称,比特币远期升至 30 万美元的前提之一,是协议层及时推进抗量子升级。
U.Today
·2026-08-27 00:32:03
3
Meta与美国多州和解后收紧青少年使用限制
Meta与美国29州达成和解后,将在 Instagram 和 Facebook 上推出更严格的青少年保护限制。
TechCrunch
·2026-08-27 00:16:55
6
web3: 比特币跌破7.8万美元,多头24小时爆仓2.7亿美元
比特币跌破 7.8 万美元,多头清算扩大,但美国现货比特币 ETF 连续 7 个交易日净流入。
Cryptonews
·2026-08-27 00:01:01
8
Particle推出Radar,将播客内容接入AI代理
Particle 发布播客搜索产品 Radar,主打音频转录、语义检索与 API 接入,面向 AI 代理和机构客户。
TechCrunch
·2026-08-27 00:00:58
10
web3: 外媒:AI基建投资正从英伟达扩向电力与数据中心
外媒称,AI 基础设施投资机会正从英伟达等 GPU 厂商扩展到电力、散热、内存与数据中心。
Coinpaper
·2026-08-27 00:00:55
7
查看更多