研究 LLM 学习心理学的公司,将模型与 harness 联合训练,打造定制化智能体。
适合需要构建高性能定制 AI Agent 的工程团队,尤其是希望同时优化模型权重与 harness 的场景。
开源 AI 工程平台,支持 LLM 与 ML 模型的追踪、评估、监控与部署。
开源 AI 工程平台,支持 LLM 应用与 Agent 的追踪、评估、监控和提示词优化。
开源 LLM 工程平台,集追踪、评估、提示词管理与实验于一体,支持自托管。
开源 LLM 评测与红队测试 CLI/库,可对比多模型、扫描漏洞并集成 CI/CD。
开源 LLM 评估框架,类似 Pytest,用 G-Eval 等指标本地评测 LLM 应用与 Agent
Google 官方 Gemini 模型在线试验与开发平台,从提示词快速走向生产。