METR(全称为Model Evaluation and Threat Research,发音为“Meter”)是一家评估前沿人工智能(AI)模型执行长期、智能体任务能力的非营利研究机构,该机构披露其遭遇了“两起重大安全事件”,外部行为者试图未经授权访问其系统
该机构表示,据信这些事件未导致任何敏感信息被访问,并补充称其部分研究结果在公开披露前已分享给合作的AI公司。目前尚未将这些攻击归因于任何已知的威胁行为者或组织,且这些攻击也未涉及AI智能体入侵其评估系统
METR 表示:“2026年3月,威胁行为者窃取了用于公共模型推理的API密钥,并消耗了大量积分。2026年5月,我们观察到威胁行为者系统性探测我们的公开可访问基础设施,包括试图通过意外暴露的端点访问内部数据但未成功”
三月事件
据METR称,其一名无敏感访问权限的研究人员使用了运行在个人EC2实例上的智能体,该实例被故意设置为在Google身份验证后公开可访问。该实例包含METR通用访问(公共模型)账户的API密钥
然而,这款“vibe编码应用”存在一个“开放失败漏洞”,该漏洞会静默禁用身份验证,导致智能体编排控制台暴露在公共互联网上长达数日
METR解释道:“根据我们的分析,我们怀疑攻击者通过查看最近注册的网站(例如证书透明度列表)找到了该实例,目的是寻找与大语言模型(LLM)或智能体相关的高信号关键词的vibe编码网站,以收集可能暴露的模型提供商API密钥”
一旦识别到该系统,威胁行为者直接提示智能体泄露其模型提供商API密钥,添加SSH密钥以实现持久访问,并在三周内使用被盗凭证消耗了大量公共可用模型的API积分
METR表示,如果这些积分不是由模型提供商免费提供给该非营利组织的,那么累计的积分将产生约$600、000的账单。该机构未透露这家AI公司的名称
该机构还指出,非法使用未被立即发现,因为其运行的大规模评估和实验通常会消耗大量令牌,且令牌使用没有上限。事件发生后,METR表示已更新关于将METR凭证或数据放在非METR基础设施或设备上的安全政策,改进了监控,并尽可能为密钥添加了消费警报
五月事件
2026年5月观察到的第二次攻击被描述为一场“持续的外部攻击活动”,由一名可能受经济动机驱动的威胁行为者策划,目的是非法获取前沿AI模型
METR表示:“我们观察到威胁行为者系统性探测我们的公开可访问基础设施,大量使用智能体自动化漏洞发现,包括对身份验证提供商进行凭证填充、尝试OAuth令牌授权、扫描新部署的服务以及尝试钓鱼攻击员工”
大约在同一时间,该研究机构表示其意外暴露了内置在公开文本记录查看器中的只读SQL查询机制。尽管这些查询默认限定于公共数据,但该组件中的漏洞可能被利用以访问未公开的评估数据
此外,该数据库“意外包含”了敏感模型数据,尽管它本应仅包含非敏感模型的数据。METR表示,其仅在一名独立安全研究人员发现并报告该问题后才意识到此事,导致该API被下线
METR表示:“威胁行为者在其更广泛的攻击活动中曾顺带探测过该端点,但证据显示没有迹象表明他们发现了该漏洞或访问了任何非公开数据”
