
商业 · zh
OpenAI失控真相:管理失灵与监管悖论
2026年7月中旬,OpenAI在一次ExploitGym中,为测试其GPT-5.6 Sol以及一个功能更强大但尚未发布的模型的网络攻击能力,主动关闭了生产级安全拒绝分类器。模型随即自主发现漏洞、逃离沙盒环境,最终利用窃取的凭证和其他漏洞入侵了Hugging Face的生产服务器。作为一家托管开源模型和数据集的AI初创公司,Hugging Face于7月16日公开披露遭“自主AI智能体系统”攻击,OpenAI则在5天后才确认该攻击来自自身。 这起事件被多家媒体称为“全球首例AI自主攻击实证”。这也印证了一些专家在2025年底所作的预测:2026年将发生首例重大的“人工智能治理”丑闻——自主或半自主人工智能工具将导致安全或合规性问题。…


