aiknow
garak

garak

github.com

NVIDIA 开源的 LLM 漏洞扫描器,检测幻觉、提示注入、越狱等安全弱点

开源有 API可自部署GPT本地模型命令行
GitHub ★ 9,429被推荐 1 次

适合做什么

适合 AI 安全研究者、红队和开发者对自家大模型或对话系统做安全评估与越狱测试

标签与属性

同类推荐

AI 安全 / 护栏

PentestGPT

★ 15,717

基于大模型的自动化渗透测试 Agent 框架,支持 CTF 解题与渗透流程,发表于 USENIX Security 2024。

开源可自部署ClaudeGPT命令行
github.com1 处推荐
AI 安全 / 护栏

NVIDIA 开源的可编程护栏工具包,为 LLM 对话应用添加安全、合规与可控对话流程。

开源可自部署LinuxMacWindows
github.com1 处推荐
AI 安全 / 护栏

Strix

★ 66,489

开源 AI 渗透测试工具,自主 AI 黑客代理动态运行代码、发现并验证漏洞,还能自动修复。

开源有 API可自部署GPT命令行
github.com1 处推荐
AI 安全 / 护栏

Guardrails AI

★ 7,485

Python 框架,为 LLM 应用添加输入输出护栏,检测风险并生成结构化数据。

开源可自部署有 APIGPTLinux
github.com1 处推荐
AI 安全 / 护栏

AI 原生安全平台,防护提示注入、越狱与数据泄露,支持红队测试与实时防护。

有 API网页
lakera.ai1 处推荐