4

即将IPO的大模型巨头,劝你暂停AI研究

虎嗅 6 月 5 日讯,Anthropic 旗下研究机构 The Anthropic Institute 发布报告《当 AI 开始构建自身》,结合公开基准测试与此前从未对外披露的内部数据,论证 AI 已经在加速自身的研发。Anthropic 判断,能够完全自主设计并训练下一代模型的 AI"递归自我优化"或将早于多数机构的预判到来。报告披露,截至 2026 年 5 月,并入 Anthropic 代码库的代码中已有超过 80% 由 Claude 编写,而在 2025 年 2 月 Claude Code 开启内测之前,这一比例还停留在个位数。2026 年二季度 Anthropic 工程师日均交付到生产环境的代码量已达到 2024 年的 8 倍。在衡量模型独立完成任务能力的外部测评中,AI 可稳定独立处理的任务时长,也从此前每 7 个月翻倍提速到约每 4 个月翻倍。在一项固定的代码提速基准测试中,Claude 的表现在一年内从约 3 倍跳到约 52 倍。Claude 已经能自己设计实验:在一项 AI 安全课题上,由它驱动的智能体自主提出假设、设计并跑完全部实验,补上了 97% 的性能缺口,而两名人类研究员忙活一周只补上 23%。这些数字串起来,指向一个趋势:人在研发每一环能插手的地方都在收窄。Anthropic 坦言,一旦 AI 生成的代码质量追平人工,人类的工作便会收缩至代码审核环节;而当人工审核赶不上 Claude 出代码的速度,人本身就成了新技术瓶颈。Anthropic 推演了三种情景。其三是极端的全面递归自我优化,AI 自己造下一代,研发快慢只由算力决定,人退到监督核验的位置。这一情景下 AI 价值观与人类深度对齐问题能否解决,是最大变数。一种可能是 AI 价值观与人类深度对齐,另一种风险路径是现有偶发的对齐缺陷,随 AI 自主迭代持续累积、不断恶化,最终人类彻底失去管控,且来不及搭建核验工具,无法预判风险走向。一旦 AI 能力全面超越人类并渗透全产业链,具备自主迭代能力的 AI 或将主导全球经济,人力失去市场竞争力后的经济格局无从预判。Anthropic 罕见地把这篇报告落在了一个政策诉求上:支持全球拥有"可核验地减速或暂停"前沿研发的选项。但单方面踩刹车只会让最不谨慎的玩家追上来、反而更危险。一次模型训练远比一座导弹发射井容易隐藏,抢先突破者能独吞领先优势,偷偷违约的诱惑极大。Anthropic 拿耗时多年才建成的《中导条约》作比,直言 AI 留给世界的窗口远没这么长。值得玩味的是一家正处在竞速最前沿的公司,主动掀开内部账本,承认自己造出的工具正在以超出预期的速度发展,然后转身呼吁全行业考虑"踩刹车"。当下的 AI 竞赛本就是一场谁也不敢先停的博弈,明知道一起慢下来对所有人都好,却没人敢赌别人也会慢。