1.媒体来源:udn(经济日报)
2.记者署名:陈律安
3.完整新闻标题:
偷用美AI翻车!解放军用大陆模型抓异常 敏感资讯竟被Claude看光
4.完整新闻内文:
Anthropic 9月发布最新威胁情报报告,揭露自家的Claude模型遭恶意利用的多起案例,
其中点名了中国大陆人工智能(AI)新创月之暗面(Moonshot AI),指控这家Kimi模型
开发商,曾在用户不知情下,把原本送往Kimi的请求转交Claude处理,再把Claude的答案
呈现给用户,并蒐集相关互动内容,用于训练自家模型。
Anthropic表示,在5月–7月的10天期间,月之暗面曾把近30万笔客户请求转送给
Anthropic,其中绝大多数交由Claude Opus处理。月之暗面据称透过一个由5,380个诈欺
帐号组成的代理服务网络,进行前述操作,这些帐号大多看似位于新加坡与日本。
报告指出,月之暗面不仅把Claude的回答提供给自家用户,也至少储存部分互动内容,并
建立思维链(Chain of Thought,CoT)撷取流程,取得Claude的推理纪录,用于训练自
家模型。
Claude原本不会直接传回完整推理内容,而是提供一组“思考签章”,降低模型遭未经授
权蒸馏的风险。但Anthropic指控,月之暗面会先保存这些签章,再启动新的工作阶段,
诱使Claude把签章还原成完整推理轨迹,借此取得CoT内容。
遭转送给Claude的资料中,也包括敏感资讯。Anthropic表示,一名研判可能与中国人民
解放军有关的用户,以为自己使用的是Kimi,实际上却把成都数百支监视器所蒐集、针对
特定人士的监控资料送进Claude,并要求模型分析该人士是否有异常行为。
这些监视器包括设于解放军设施、中国电子科技集团旗下研究机构,以及一家大型国企外
部的摄影机。
另一名中国大陆大型国企工程师,则在利用Kimi建立内部系统时,输入多家企业的内部程
式码与仍可使用的登入凭证,其中包括知名科技公司。Anthropic表示,这名工程师并不
知道相关内容实际被转送给Claude处理。
Anthropic指出,目前并不清楚月之暗面是否曾通知客户,他们输入Kimi的内容会被转交
Anthropic,因而暴露给第三方。
根据Anthropic统计,今年5月至7月,可归因于月之暗面的模型蒸馏攻击,已观察到超过
2,300万笔。Anthropic表示,已着手强化防御机制,防堵这类利用Claude推理内容训练其
他模型的手法。
5.完整新闻连结 (或短网址)不可用YAHOO、LINE、MSN等转载媒体:
https://udn.com/news/story/6811/9749100
6.备注: