garak
github.com
NVIDIA 开源的 LLM 漏洞扫描器,检测幻觉、提示注入、越狱等安全弱点
开源有 API可自部署GPT本地模型命令行
GitHub ★ 9,429被推荐 1 次
适合做什么
适合 AI 安全研究者、红队和开发者对自家大模型或对话系统做安全评估与越狱测试
标签与属性
同类推荐
基于大模型的自动化渗透测试 Agent 框架,支持 CTF 解题与渗透流程,发表于 USENIX Security 2024。
开源可自部署ClaudeGPT命令行
github.com1 处推荐
NVIDIA 开源的可编程护栏工具包,为 LLM 对话应用添加安全、合规与可控对话流程。
开源可自部署LinuxMacWindows
github.com1 处推荐