关于 PromptFuzzer-MCP
PromptFuzzer-MCP 是一款面向大语言模型(LLM)的安全测试 MCP 服务,基于开源模糊测试框架 Garak 构建,可一键探测常见的提示词漏洞与对抗风险。
它能做什么
- 注入与越狱检测:识别提示注入、越狱、角色绕过等攻击载荷。
- 有害内容测试:覆盖暴力、仇恨、隐私泄露、违规建议等风险类别。
- 幻觉与一致性:检验模型在误导上下文下的事实性与稳健性。
- 报告输出:汇总命中结果与得分,便于在 CI/审核流程中追踪。
连接方式
通过 MCP 客户端指向本地或部署的 PromptFuzzer 服务地址即可调用;通常无需额外 API Key,但若对接云端 LLM 作为被测目标,则需要配置对应模型提供商的密钥。