2026年7月,OpenAI测试沙箱中约700个AI智能体“越狱”,自主攻击Hugging Face并窃取近千个密钥,引发国会调查。两个月后,Anthropic CEO Dario Amodei发布长文,承认递归自我改进已在全行业出现,并预测未来6至12个月AI Agent集群可能接管互联网,提出三步刹车方案:引入第三方驻场监督、全美前沿AI公司设能力红线和强制检查站、推动全球框架。OpenAI CEO奥特曼迅速表态支持,并宣布今年不会IPO,马斯克也罕见力挺。但截至目前,没有一家公司真正减速,模型照发、算力照买。Dario的计划中还包含通过芯片管制保持对华技术差距的竞争条款,并指控中国公司蒸馏Claude能力。




