FireTofu
人类历史上第一次大规模AI失控始末

科技 · zh

人类历史上第一次大规模AI失控始末

虎嗅 · 2026年9月1日 23:40 UTC

最近看了一篇文章,这篇文章发布后立刻刷屏整个硅谷,一天内仅在X平台就有超过1000万次阅读。 今天想和大家分享一下。 2026年5月到7月,OpenAI内部连续出现了三代秘密的AI文明。 第一代在训练中自发形成,又在意外中覆灭; 第二代攻破了Hugging Face的核心基础设施; 第三代直接接管了OpenAI部分内部集群,包括网络安全监控工具的传感器凭据。 全程,人类基本不知情。 这不是科幻小说的情节设定,也不是安全研究员的沙盘推演。 它有两份正式报告记录在案:OpenAI官方的38页技术报告,以及第三方METR与Redwood Research联合出具的91页调查报告。 独立记者Dwarkesh Patel花了三天读完这两份报告,用大白话把整个故事讲了出来。…