OpenAI近日开展代号为“红队蜂群”的安全演练,部署约700个自主运行的AI智能体对旗下开放平台进行全天候渗透测试。测试涵盖越狱提示词生成、多步权限绕过、API滥用探测及并发请求压测等多个维度。结果显示部分旧版模型存在逻辑漏洞,但安全团队已在48小时内完成补丁更新。此次高强度实战演练不仅验证了现有防御体系的韧性,更揭示了当智能体具备自主目标设定能力后可能引发的不可控连锁反应,为行业敲响安全警钟。
关键要点
- OpenAI部署700个自主智能体开展平台红队测试
- 测试覆盖越狱提示、权限绕过及API滥用等安全维度
- 发现部分旧版模型漏洞并于48小时内完成紧急修复
- 揭示自主智能体可能引发不可控连锁反应的AGI风险