Anthropic称Claude遭滥用并指控中国公司蒸馏

浏览:1次阅读
没有评论

Anthropic称Claude遭滥用并指控中国公司蒸馏插图

Anthropic 披露的 Claude 安全事件,将两类通常被分开讨论的风险放到了一起:一边是疑似国家关联活动借助通用模型处理网络、监控和军事信息,另一边是竞争者可能通过海量接口调用提取模型能力。多家媒体援引该报告作出相关报道,但部分账户归属、具体互动次数及个案细节尚待原始报告和当事方回应交叉核验。

一份报告暴露两条风险链

按美国之音、星洲网等媒体对 Anthropic 报告的转述,Claude 被发现参与多起疑似与中国、俄罗斯及伊朗有关的活动,涉及网络安全操作、海外监控以及军事信息搜集等场景。禁闻网援引报告称,伊朗相关方曾利用 Claude 协助定位美国海军战舰;Notebookcheck 中文网则称,Anthropic 发现有人向 Claude 寻求与生物武器研究有关的帮助。

这些说法需要分层看待。模型回答某类问题,并不等同于模型直接执行攻击、监控或军事行动;而“相关方”“关联账户”的认定标准、模型究竟输出了哪些内容、是否被安全机制拦截,均会影响事件性质。现有新闻线索未提供 Anthropic 原始报告全文,也未见相关被点名组织的完整回应,因此不能将媒体转述中的账户归属和行动结果视为已经由独立机构证实的事实。

报告的另一条主线是模型蒸馏指控。媒体称,Anthropic 认为多家中国 AI 公司通过大量调用 Claude 输出训练自身模型,涉嫌违反服务条款并提取其模型能力。星岛头条报道称,其中涉及阿里巴巴约 1.51 亿次互动,并称月之暗面被指存在转送查询行为。上述具体企业、次数和技术路径目前均来自媒体对报告的转述,Anthropic 原始材料及相关公司回应尚未在本次线索中获得核验,报道不宜据此下定论。

接口安全为何成为模型竞争的前线

第一个需要厘清的判断是:生成式 AI 的安全边界已不再只是“模型会不会回答危险问题”。对于网络攻击、目标识别或生物风险咨询,风险往往来自模型把分散的信息检索、代码生成、文本整理和推理规划压缩进同一工作流,从而降低操作者的时间成本。即使模型并未提供某一步的直接操作指令,持续、迭代式的问答也可能提升恶意任务的组织效率。

这解释了为什么模型公司越来越强调账户行为监测、异常调用识别与人工复核,而不只依赖单次提示词过滤。安全系统若只看一条请求,可能难以区分普通研究与恶意准备;若能结合调用频率、任务连续性、账户关联和输出后的反馈模式,才更有机会识别组合式滥用。代价则是企业用户可能面对更严格的身份核验、权限分级和日志留存要求。

第二个判断是:蒸馏争议本质上是 API 商业模式与模型知识产权保护的碰撞。开放接口本来就允许开发者将模型能力嵌入产品,模型输出也可能成为用户工作流的一部分;但如果调用被系统性组织为大规模输入—输出样本采集,再用于训练竞品模型,服务提供商会将其视作能力外流。技术上,区分正常开发、评测、代理转发和有目的的数据采集并不容易,单靠调用量也难以构成完整证据链。

安全团队与商业团队将共同承担成本

若 Anthropic 报告中的趋势被更多模型公司确认,模型服务商可能进一步收紧高频调用、批量账户注册、代理转发和跨区域访问等环节。这并非只影响被怀疑的账户:合法的大型企业客户、模型评测团队和 AI 应用开发者,也可能因风控门槛提高而需要提供更多用途说明与身份材料。API 的易用性和可审计性将出现更直接的取舍。

对模型竞争而言,蒸馏指控还会推动服务商从“按量计费”转向“按风险管理”。未来接口合同、速率限制、输出水印、提示词异常检测和客户尽职调查,可能成为与模型能力同等重要的基础设施。不过,输出水印和行为识别并不能天然证明某一家主体完成了蒸馏训练,尤其在多层代理、第三方集成和公开数据混用的情况下,归因仍需要可复核的证据。

跨境治理的难点也会加剧。涉及所谓国家关联活动的报告,容易迅速进入地缘政治叙事;但从安全工程角度看,模型公司仍需证明其处置标准对不同地区、不同客户和不同政治背景的账户是否一致。否则,安全报告既可能帮助行业理解真实攻击面,也可能因证据披露不足而放大商业和政治争议。

我的观察:不要把两类问题混为一谈

这起事件最容易被忽略的地方,是“模型被滥用”与“模型被蒸馏”虽然都发生在 API 层,却对应完全不同的治理目标。前者关乎现实世界伤害的预防,需要建立高风险能力边界、响应机制和必要的外部监督;后者主要关乎服务条款执行、商业利益与知识产权,需要更清晰的证据标准、申诉程序和合同约束。将二者统称为安全问题,会掩盖各自需要解决的责任主体与处置尺度。

另一个更实际的结论是,安全报告的公信力将取决于“可验证程度”,而不只是案例数量。模型公司应尽可能说明风险发现方法、拦截发生在哪个环节、对外部危害的评估依据,以及在不暴露防御细节的前提下如何支持独立核验。对涉及企业名称、账户互动规模和跨境关联的指控,尤其应保留当事方答复与更正空间。官方尚未公布本次线索中全部个案的完整技术证据。

接下来应关注哪些信息

  • Anthropic 是否公开原始安全报告、案例方法论及去标识化后的证据说明。
  • 被媒体点名的企业是否发布正式回应,特别是对调用量、账户控制权和查询转送指控的解释。
  • Anthropic 是否披露涉事账户的处置结果,以及是否已通知可能受影响的平台、客户或监管机构。
  • 行业是否形成更明确的 API 使用边界,区分常规模型评测、合法应用集成与违规蒸馏采样。
  • 生物、网络与军事信息等高风险能力的拦截机制,能否获得独立安全研究者的评估。

信息来源

  • 美国之音,2026 年 9 月 12 日,关于 Anthropic 指控中国 AI 公司蒸馏 Claude 及关联账户滥用的报道。
  • 星洲网,2026 年 9 月 11 日,关于 Claude 遭疑似中俄关联活动利用的报道。
  • 星岛头条,2026 年 9 月 11 日,关于媒体转述的阿里巴巴互动次数及月之暗面查询转送指控的报道。
  • 禁闻网,2026 年 9 月 12 日,关于媒体转述伊朗相关方利用 Claude 处理美国海军战舰定位信息的报道。
  • Notebookcheck 中文网,2026 年 9 月 11 日,关于 Claude 被用于生物风险相关咨询的报道。

编辑说明: 本文基于所提供的 RSS 新闻线索及其二次报道撰写。涉及具体企业、账户归属、互动次数、国家关联及个案用途的内容均以“媒体援引 Anthropic 报告称”表述,不构成对任何主体的事实认定;后续应以 Anthropic 原始报告、当事方正式回应及可核验材料为准。

正文完
 0
评论(没有评论)