aiknow
Inspect AI

Inspect AI

github.com

英国 AI 安全研究所开源的大模型评测框架,内置 200+ 评测,支持提示工程、工具调用与多轮对话。

开源有 API可自部署GPT本地模型命令行
GitHub ★ 2,932被推荐 1 次

适合做什么

适合 AI 研究者、安全团队与工程师做模型能力与安全评测、基准测试和红队测试。

标签与属性

同类推荐

应用评测与监控

开源 AI 工程平台,支持 LLM 与 ML 模型的追踪、评估、监控与部署。

开源可自部署有 API支持 MCPGPT
github.com1 处推荐
应用评测与监控

开源 AI 工程平台,支持 LLM 应用与 Agent 的追踪、评估、监控和提示词优化。

开源有 API可自部署网页Linux
mlflow.org1 处推荐
应用评测与监控

Langfuse

★ 35,370

开源 LLM 工程平台,集追踪、评估、提示词管理与实验于一体,支持自托管。

开源有 API可自部署网页
langfuse.com4 处推荐
应用评测与监控

开源 LLM 评测与红队测试 CLI/库,可对比多模型、扫描漏洞并集成 CI/CD。

开源有 API可自部署GPTClaude
github.com1 处推荐
应用评测与监控

DeepEval

★ 18,627

开源 LLM 评估框架,类似 Pytest,用 G-Eval 等指标本地评测 LLM 应用与 Agent

开源有 API可自部署命令行
github.com1 处推荐
应用评测与监控

Google 官方 Gemini 模型在线试验与开发平台,从提示词快速走向生产。

有 API多模态Gemini网页
aistudio.google.com1 处推荐