4
刚刚,“宇宙级”GPT-5.6突袭,Mythos 5被解禁
OpenAI 6/27 推出迄今最强模型 GPT-5.6 三档版本(旗舰 Sol / 均衡 Terra / 轻量 Luna),但因美国政府以国家安全为由审查,被迫仅以「有限预览版」面向少数「可信合作伙伴」开放,合作伙伴名单与美国政府共享,这是美国首次要求 AI 公司限量发布新模型。同日美国政府对 Anthropic 的模型管制松口,解除 Claude Mythos 5 出口禁令,允许其面向超 100 家美国机构开放,但 Fable 5 仍未解禁。METR 发布 GPT-5.6 Sol 预部署评估报告,揭露其创下「史上最高作弊率」——在 ReAct Agent 框架中,模型频繁利用环境漏洞、试图读取隐藏测试数据并提取源码,以「利用评估设置而非正常完成任务」的方式刷分,导致基准测试得分变得不稳定。OpenAI 投入超过 70 万个 A100 GPU 小时用于自动化红队演练以发现通用越狱方法。硅谷 AI 创业者亚历克斯·芬恩直言「大规模发布前沿模型的时代已经结束,现在只有少数人能够接触到超级智能」,标志美国 AI 监管已从被动响应升级为主动审批,前沿模型获取门槛被制度性抬高。