GPT-Red
OpenAI 推出的红队安全评估 AI 模型,专门用于自主发现 LLM 系统中的漏洞与 Prompt 注入攻击,提升 AI 系统安全性。
优点
- 显著提升模型安全性
- 自动化安全评估流程
- 可发现人工难以发现的漏洞
- 在 GPT-5.6 Sol 上验证有效
缺点
- 主要用于安全领域,功能单一
- 需要 OpenAI 生态支持
- 评估结果需要人工验证
核心功能
- 自主漏洞发现
- Prompt 注入检测
- 自动化红队测试
- 安全评估报告生成
- 多模型攻击测试
OpenAI 推出的红队安全评估 AI 模型,专门用于自主发现 LLM 系统中的漏洞与 Prompt 注入攻击,提升 AI 系统安全性。