3
Fable 5解题解到破防,一句"啊啊啊"刷屏了
2026-07-03 36氪转载机器之心报道,Claude Fable 5 重启次日(7/1)即被 Reddit 用户 u/No-Head-Royal 在解 Codeforces 2239D 编程题时曝出思维链崩溃:模型输出「DATA DATA DATA. GO」「GRRR」「GAAAH」「PHEW」「blocked?! WRONG.」「I'M DROWNING — EMPIRICS!!!」等情绪化、近乎癫狂的内心独白,Reddit 帖 4 小时拿下近 1600 赞并冲上 r/ClaudeAI 热门榜,𝕏 同步扩散;评论总结模型「读起来根本不像标准英语,倒像是它给自己发明了一门私有语言」,「像一位极其聪明但心理状态有些失常的博士生,因近期严重睡眠不足而草草写下的日记随笔」。事件曝光后,Anthropic 7/2 之前发布的 Fable/Mythos 系统卡中早已自陈「illegible reasoning(不可读推理)」现象——纸牌题极端案例推理过程从可读英文滑向扑克花色符号 + 箭头 + 骷髅头表情 + 德语脏话「verdammt」混合,官方定性「这类不可读推理在该场景出现的比例和极端程度都是所有测试场景里最高的」。UC 伯克利 2017 年首次提出的「Neuralese(神经语)」担忧重回议程,DeepSeek R1-Zero(arXiv:2501.12948)、OpenAI o3(arXiv:2509.15541)及 R1/R1-Zero/QwQ/Qwen3/Kimi K2 等 14 个主流 RL 推理模型均存在类似倾向,「模型越大、题目越难、可读性越差」;Anthropic 对齐科学团队承认「思维链表述并不总是忠实反映模型真实内部计算过程」,「不透明推理(opaque reasoning)」被视为可解释性研究「正在扩大的隐患」——若思维链本身读不懂,安全团队用来监控模型是否「说真话」的这层窗口也跟着失效。LessWrong 冷静派分析认为这仅是「稠密化」而非「新语言」,Claude Haiku 4.5 可几乎准确复现 Mythos 推理逻辑。Anthropic 截至发稿未公开表态。