媒体称研究人员借Claude攻破OpenAI账户并访问代码库

浏览:1次阅读
没有评论

媒体称研究人员借Claude攻破OpenAI账户并访问代码库插图

多家媒体近日报道称,安全研究人员借助 Anthropic 的 Claude 发现并利用了 OpenAI 系统中的漏洞,并在约 72 小时内接管员工账户、访问内部代码仓库,随后将问题报告给 OpenAI。部分报道还提到研究人员获得 6500 美元漏洞赏金,但目前尚未看到相关公司公开完整技术细节。

这起事件的重点并不只是“哪家模型攻破了哪家公司”,而是大模型已经能够参与漏洞发现、验证和攻击链组织,企业账号体系与内部开发基础设施因此面临新的自动化风险。由于现有信息主要来自媒体转述,本文将对已披露事实与尚待核实内容作出区分。

约 72 小时完成从发现到访问

根据 TechCrunch 及其他媒体的转述,研究人员使用 Claude 协助分析 OpenAI 相关系统,发现可被利用的安全缺陷,并进一步取得员工账户控制权,最终访问到内部代码仓库。报道将整个过程概括为约 72 小时,但没有公开完整的漏洞编号、受影响系统、权限边界或具体攻击步骤。

随后,研究人员按照漏洞披露流程向 OpenAI 报告问题。部分报道援引 6500 美元漏洞赏金这一数字,但目前缺少 OpenAI 官方公告或公开漏洞报告对金额、漏洞等级和支付条件的确认,因此这一数字只能作为媒体报道内容,不能视为已核实的公司信息。

需要特别区分:现有线索显示的是“使用 Claude 辅助发现和利用 OpenAI 系统漏洞”,并不等于 Claude 自身存在被证实的安全漏洞,也不能据此断言 Anthropic 参与或授权了针对 OpenAI 的攻击。

真正的变化是攻击流程被模型压缩

这起事件最值得重视的地方,在于大模型可能把原本需要较多人工经验的安全工作,压缩为更短的试错流程。模型可以协助研究人员阅读文档、理解代码结构、生成测试方案、整理错误信息,并在人工监督下反复调整验证路径。即使最终突破仍依赖研究人员判断,模型也可能显著降低信息搜集和脚本编写的时间成本。

这并不意味着模型能够独立完成所有入侵活动。账号权限、网络隔离、多因素认证、访问审计和漏洞披露流程仍然决定了攻击是否能够扩大影响。但当模型成为攻击链中的“协作者”后,传统以攻击者数量和人工速度为基础的风险评估可能低估真实压力。

企业防守重点将从单点漏洞转向权限链

报道涉及员工账户和内部代码仓库,说明安全风险可能并非停留在单一接口或单个漏洞上,而是沿着身份认证、会话管理、内部权限和代码托管系统逐步扩展。对企业而言,修补最初漏洞只是第一步,还需要核查账户是否被接管、令牌是否泄露、仓库访问是否异常,以及相关凭据是否在其他系统中复用。

AI 公司还需要重新评估内部测试环境的隔离方式。用于安全研究的模型代理如果能够访问浏览器、终端或企业工具,就必须配套最小权限、操作审批、敏感数据脱敏和全量审计。否则,模型虽然提高了防守方的自动化能力,也可能让一次低权限入口更快演变成跨系统事件。

这不是简单的“模型对模型”对决

将事件描述为 Anthropic 的 Claude“攻破”OpenAI,虽然具有传播效果,但容易掩盖攻击成立所依赖的人、系统和权限条件。模型只是工具链的一部分,实际结果还取决于研究人员的目标选择、OpenAI 系统配置、漏洞披露机制以及访问控制设计。

因此,这起事件更准确的行业含义是:通用大模型正在进入网络安全攻防的操作环节,安全评估不能只测试模型会不会生成恶意代码,还要测试模型在真实工具环境中能否持续执行侦察、验证、凭据处理和权限扩展任务。对模型厂商来说,防滥用策略也需要覆盖“协助攻击第三方系统”的组合式行为,而不只是拦截某一条危险指令。

后续需要等待哪些官方信息

  • OpenAI 是否确认受影响的具体系统、漏洞类型、修复时间和账户访问范围。
  • OpenAI 是否确认 6500 美元赏金,以及该金额对应的漏洞等级和披露条款。
  • Anthropic 是否说明 Claude 在事件中的使用边界,以及是否触发了相关安全监测或滥用处置机制。
  • 研究人员是否公开经过脱敏的技术报告,以便外界判断事件是单点漏洞、权限配置问题,还是完整攻击链。

信息来源与核验说明

本文依据新浪财经、TechCrunch、Pasquale Pillitteri、Cryptopolitan、NAI500、凤凰网科技及其他线索中提供的媒体报道整理。现有材料未提供 OpenAI 或 Anthropic 的完整官方公告,关于“约 72 小时”和“6500 美元”的内容均采用“据报道”表述;具体漏洞细节、影响范围及赏金金额,仍应以两家公司后续公告、漏洞披露报告或原始技术材料为准。

正文完
 0
评论(没有评论)