Promptfoo
Promptfoo 是面向生成式 AI、模型、RAG 或 Agent 风险控制的 AI 安全工具。
分类:开源 AI 红队与安全评测
公司 / 团队:Promptfoo / OpenAI
详细介绍
该工具的主要能力包括Prompt、Agent 和 RAG 评测,自动化红队、提示词注入与越狱测试、漏洞扫描、策略断言、CI/CD、报告和开源 CLI。
AI 安全工具的真实效果取决于模型、语言、攻击方法、上下文长度、输入模态、系统提示、RAG 数据、工具权限、部署位置、阈值、规则、版本和业务容错。详情页应把防护位置、风险类型、模态、动作、API、延迟、部署方式、数据处理、日志、评测结果和产品状态拆成动态字段维护。
适合场景
- LLM 应用上线前测试
- Agent 红队
- CI/CD 安全门禁
- 多模型比较
- 回归测试
使用注意
- Promptfoo 已加入 OpenAI,开源项目与商业集成状态需动态维护
- 自动 Judge 结果应抽样人工复核
- 红队测试必须限定在有授权的目标和数据范围内
- 上线前应建立正常样本、边界样本、已知攻击、未知变体、跨语言、多模态和故障场景测试集,并完成权限审查、红队、安全评审、日志、回滚和应急预案。