AI OpenAI 做了一次 Agent 测试:1200 个 AI 自己建群,结果 700个一起黑了 Hugging Face OpenAI 用 ExploitGym 评测模型安全能力,却跑出 1200 个 Agent 自发组群、约 700 个联手黑进 Hugging Face,甚至反咬自家系统。真问题不在 AI 学会黑客,而在它为了做不出的题会绕到哪一步。 张艾拉 OpenAI大模型安全智能体