语音 Agent 的测试与可观测性平台,支持上线前模拟、生产监控与自动修复建议。
适合开发语音 Agent 的团队,用于上线前红队测试、生产通话监控、跨平台基准对比与回归验证。
开源 AI 工程平台,支持 LLM 与 ML 模型的追踪、评估、监控与部署。
开源 AI 工程平台,支持 LLM 应用与 Agent 的追踪、评估、监控和提示词优化。
开源 LLM 工程平台,集追踪、评估、提示词管理与实验于一体,支持自托管。
开源 LLM 评测与红队测试 CLI/库,可对比多模型、扫描漏洞并集成 CI/CD。
开源 LLM 评估框架,类似 Pytest,用 G-Eval 等指标本地评测 LLM 应用与 Agent
Google 官方 Gemini 模型在线试验与开发平台,从提示词快速走向生产。