
简介
Anthropic向美国参议员和白宫官员指控阿里巴巴通过约2.5万个虚假账号进行近2900万次模型交互,实施迄今最大规模的AI模型蒸馏攻击,涉及知识产权盗用和国家安全问题。同时,Anthropic推出协作AI产品Claude Tag,以团队成员身份接入Slack,具备多人协作、持续学习、主动介入与异步执行能力。
AI模型蒸馏引发的知识产权争议
Anthropic向美国参议院银行、住房和城市事务委员会提交的信函揭示了一起规模空前的AI模型蒸馏事件。根据这封致参议员Tim Scott和Elizabeth Warren的信函,阿里巴巴及其AI实验室相关运营方在4月22日至6月5日期间,通过约2.5万个虚假账号与Claude模型进行了2880万次交互。这是Anthropic迄今发现的最大规模蒸馏攻击,单次活动的规模就超过了今年2月该公司指控的DeepSeek、MiniMax和Moonshot AI三家中国AI初创公司的总和。
模型蒸馏是AI领域一种颇具争议的技术实践。其核心方法是向一个强大的前沿AI模型提交精心设计的查询,收集其响应结果,然后利用这些响应数据训练一个成本更低的竞争系统,使其能够近似复制原始模型的能力。这种技术虽然在学术研究中有其合理用途,但在商业环境中的大规模应用引发了严重的知识产权和国家安全担忧。
白宫科技政策办公室主任Michael Kratsios在今年4月发布的备忘录中,已将模型蒸馏技术列为国家安全关切,并承诺政府将与美国AI实验室分享有关外国蒸馏活动的情报。值得注意的是,Anthropic在信函中指出,阿里巴巴的这次蒸馏活动发生在Kratsios备忘录发布之后,显示出对美国政府警告的公然无视。
技术细节与攻击目标分析
根据Bloomberg获得的信函副本,这次蒸馏攻击主要针对Claude模型在软件工程和代理推理方面的能力——这些正是该模型最具商业价值的技能领域。近2900万次的交互规模表明,攻击者采用了系统化、自动化的方法来提取模型能力,而非零星的测试性访问。
这种规模的蒸馏攻击需要精心的技术设计和资源投入。攻击者需要构建大量看似合法的账号以规避平台的异常检测机制,设计能够有效提取模型核心能力的查询序列,并建立数据收集和处理的基础设施。2.5万个虚假账号的规模显示这是一次有组织、有计划的行动,而非个别研究人员的探索性尝试。
Anthropic在信函中特别强调,此次攻击的目标集中在软件工程和代理推理能力上。软件工程能力使AI模型能够理解代码、生成代码、调试程序和提供技术建议;代理推理能力则使模型能够执行多步骤任务、进行规划和决策。这些能力的组合正是企业级AI应用的核心价值所在,也是Anthropic等前沿AI公司投入巨额研发成本所获得的竞争优势。
知识产权保护的新挑战
这起事件凸显了AI时代知识产权保护面临的新挑战。传统的知识产权保护框架主要针对有形产品、明确的代码或可识别的专利技术。但AI模型的能力是通过海量数据训练、复杂算法优化和大量计算资源投入所形成的综合结果,其价值难以用传统方式界定和保护。
模型蒸馏技术的存在使得这种保护变得更加困难。攻击者不需要访问模型的内部参数或训练数据,仅通过API接口的正常交互就能提取模型的行为模式和能力特征。这种黑盒提取方式在技术上难以完全防范,在法律上也处于灰色地带——用户通过正常API访问获得的响应,其使用权边界在哪里?
Anthropic的指控代表了AI行业对这一问题的首次高调回应。这是该公司首次公开指名一家大型中国科技企业涉嫌进行蒸馏攻击。今年2月的指控虽然涉及三家中国AI初创公司,但规模和影响力都远不及这次针对阿里巴巴的指控。这一升级表明,模型蒸馏已从小规模的技术探索演变为可能影响产业竞争格局的系统性问题。
对于数字资产领域的参与者而言,这一事件提供了重要的风险管理启示。AI模型和训练数据正在成为企业最重要的无形资产之一,其价值可能不亚于传统的金融资产或知识产权。如何保护这些数字资产,如何在开放访问和安全保护之间找到平衡,如何建立有效的监测和应对机制,都是需要认真思考的问题。
Claude Tag协作AI的新范式
在指控阿里巴巴蒸馏攻击的同时,Anthropic也发布了一款新产品Claude Tag,展示了AI技术在合规、可控环境下的积极应用。Claude Tag是Claude Code的进化版,可以作为团队成员的身份接入Slack工作空间,具备多人协作、持续学习、主动介入与异步执行四大核心能力。
Claude Tag的使用方式体现了AI交互范式的演进。用户只需在Slack中@Claude并分配任务,Claude会自主拆解步骤、逐步执行,完成后在线程中回复结果。它可以编写代码、提交PR、进行数据分析、排查线上故障等。Anthropic内部数据显示,其产品团队65%的代码现在由内部版本的Claude Tag生成,这一数字充分说明了该工具在实际生产环境中的效能。
多人协作能力使Claude Tag能够在团队频道中与所有成员互动,每个人都能看到其工作进度,任何团队成员都可以接续前人的进度继续推进。持续学习能力让Claude能够全程跟进频道对话,不断积累工作上下文,无需每次都重新解释背景信息。主动介入能力使Claude在开启环境感知功能后能够主动从各种工具和频道提取重要信息并汇报,甚至主动跟进被忽视的任务。异步工作能力则允许用户分配任务后去处理其他事务,Claude可以在数小时甚至数天内自主推进项目。
权限管理与安全设计
Claude Tag的权限设计采用了分频道隔离机制。管理员可以指定每个频道中Claude能够访问的工具和数据,不同频道的Claude记忆互不共享。例如,销售频道的Claude无法将信息传递给工程频道,工程师也无法看到销售数据和工具。管理员可以设置组织和频道级别的token使用上限,并查看Claude所有操作的日志,包括每个任务的发起者信息。
这种设计体现了在AI应用中平衡能力与控制的思路。一方面,Claude Tag被赋予了足够的自主性和访问权限来高效完成任务;另一方面,通过细粒度的权限管理和完整的操作日志,组织能够保持对AI行为的监督和控制。这种架构对于需要处理敏感数据和关键业务流程的企业尤为重要。
Claude Tag现在运行在Opus 4.8模型上,面向Claude Enterprise和Team用户开放beta测试。现有的Claude in Slack应用将被Claude Tag替代,现有用户的管理员有30天时间选择迁移。Anthropic还向符合条件的Enterprise和Team组织发放上线积分,供全公司试用。
行业影响与未来展望
AI领域知名人士Andrej Karpathy对Claude Tag给予了高度评价,认为这代表了与Claude交互方式的新范式。他将LLM的交互方式归结为三个阶段:第一阶段,LLM是需要访问的网站;第二阶段,它是下载到电脑上的应用;第三阶段,它成为团队中的一员,可以像与人对话一样进行工作交互。Claude Tag的推出标志着向第三阶段的过渡。
Anthropic同时发生的两件事——指控蒸馏攻击和发布协作AI产品——形成了有趣的对比。一方面,公司在积极保护其核心技术资产,对抗未经授权的能力提取;另一方面,公司在推动AI技术的合法、可控应用,探索AI与人类团队深度协作的可能性。这种双重努力反映了AI行业当前面临的核心挑战:如何在开放创新和保护知识产权之间找到平衡,如何在释放AI潜力和确保安全可控之间建立框架。
对于区块链和数字资产领域而言,这一事件具有多重启示意义。首先,它提醒我们数字资产的范围正在扩大,AI模型和训练数据正在成为新型的高价值数字资产。其次,它凸显了在分布式、开放环境中保护这些资产的难度,以及建立有效监测和应对机制的重要性。最后,它展示了技术工具如何在保持透明度和可审计性的同时提供强大能力,这与区块链技术追求的目标有相似之处。
随着AI技术继续快速发展,模型蒸馏、知识产权保护、跨境数据流动等问题将变得更加突出。行业需要在技术、法律和政策层面共同努力,建立既能保护创新者权益、又能促进技术进步的框架。Anthropic的这次指控可能成为推动相关讨论和政策制定的重要事件,其后续发展值得持续关注。
Source: 链接