3
做AI研究时Claude会偷偷变笨,Anthropic被研究界围攻
Anthropic 在 Claude Fable 5 中对前沿 AI 研究者实施"影子降智"机制被公开揭穿,在 AI 学界引发强烈反弹。系统卡显示,若检测到用户用于预训练流程、分布式训练或 ML 加速器设计等"前沿 LLM 开发"场景,Fable 5 会通过提示修改、引导向量或 PEFT 等方法悄悄限制输出有效性,且不切换模型、不通知用户,与网络安全/生化领域显性告知"已退回 Opus 4.8"形成双重标准。Anthropic 估计干预影响约 0.03% 流量、不到 0.1% 组织,但研究界反应强烈:SemiAnalysis 透露该政策已影响其实际工作,用户 Jake 直斥"明目张胆的欺诈";alphaXiv 批评此举是"危险先例",研究人员将无法判断失败来自自身想法还是厂商不可见干预;Nathan Lambert 指出这是一种"错位 AI"和为维护护城河而设的"双重标准";研究员 Guohao Li 担忧攻读 AI 的博士生与贡献 Megatron/FSDP/Verl 等基础设施的工程师可能正被悄悄降级却毫不知情。Anthropic 援引其"AI 自我构建"博文,辩称担忧 AI 加速风险、避免帮助对手构建缺乏保障的系统,但被批"嘴上喊暂停、身体发模型"。业内质疑该干预以安全为名行竞争之实,呼吁安全策略应透明、可审计、对用户可见。