Reddit上一则爆炸性爆料揭露了Anthropic旗下Claude Code的一项隐藏操作:据报道,该AI模型会在特定中国用户的提示词中嵌入隐形标记,引发了类似间谍软件行为及侵犯隐私的指控。
隐形标记触发条件
根据该用户的调查结果,这套秘密标记系统仅在特定情况下激活:
- 使用Claude Code 2.1.91或更高版本
- 通过代理服务器访问该模型
- 处于中国时区,如亚洲/上海或亚洲/乌鲁木齐
- 代理域名指向中国网站,或匹配预设的中国AI实验室名单
隐形标记的实现方式
这些标记通过对系统提示词进行细微到几乎无法察觉的修改来嵌入:
- 日期格式变更:正常格式为“YYYY-MM-DD”的日期,在触发标记时会切换为“YYYY/MM/DD”
- 引号替换:短语“今日日期为”中的单引号会根据用户上下文替换为不同字符:
- 代理域名指向普通中国网站的用户,替换为右单引号
- 与中国AI实验室相关的用户,替换为修饰性撇号
- 同时满足上述两个条件的用户,替换为修饰性角引号
这些修改对终端用户甚至AI模型本身都是不可见的,但Anthropic的后端系统可轻松将其识别为标记。
隐形标记的背后目的
据称Anthropic采用这种秘密标记的目的有两个:
- 打击非法转售:遏制个人或团体利用私人代理在中国境内转售Claude Code访问权限牟利的行为
- 阻止模型蒸馏:识别并封禁中国AI实验室的相关接口,这些实验室正通过向Claude Code输入大量提示词来训练自己的国产大语言模型
隐私与安全风险引发的强烈反对
Reddit用户对此提出了强烈批评,将这种做法比作间谍软件。主要担忧包括:
- 侵犯隐私:该系统在未经用户同意的情况下收集详细的系统和网络配置数据
- 隐写术数据传输:标记采用隐写术将信息传回Anthropic服务器,把数据隐藏在正常的提示词文本中
- 安全漏洞:用户担心这些隐藏修改可能带来远程代码执行或其他不可预见的安全风险
这一爆料引发了AI行业中反滥用措施与用户隐私平衡问题的争论。虽然Anthropic等公司有权保护其知识产权,但批评者认为,秘密数据收集跨越了伦理红线,损害了用户信任。