4
偷藏3个月,Anthropic删除识别"中国AI"的隐藏代码,官方回应:这只是一次实验,我们早想删了
Reddit 开发者 Thereallo 逆向工程 Claude Code 发现 Anthropic 自 4 月起藏有 3 个月的隐藏检测代码——通过检查系统时区(Asia/Shanghai/Urumqi)与代理 URL 是否匹配中国域名白名单/中国 AI 实验室,再以修改 System Prompt 中日期格式(-→/)与 Unicode 撇号(u2019/u02BC/u02B9)将检测结果隐性编码回传,域名列表用 XOR+Base64 混淆。Anthropic 工程师 Thariq Shihipar 7/1 首度公开承认,称 3 月启动的反转售/反蒸馏实验,7/1 版本已合并 PR 完全回滚,但回避为何隐瞒/为何零公开说明质疑;开发者 Thereallo 直接定性间谍软件——今天只是检测时区,明天可能就是破坏系统或窃取数据;社区强烈反弹:若没被曝光是否一直运行?Mythos 连处理这点事的能力都没有吗?部分用户称将转向 GLM 等国产模型。叠加 2 月 ANTI_DISTILLATION_CC 注入伪造数据开关与公开反蒸馏策略,Anthropic 隐藏+混淆+不披露三要素叠加,Claude Code 用户信任系统性受损。