全球众包设计模型竞技场,输入创意即可让多个顶级 AI 模型生成并投票评选最佳作品。
适合设计师、开发者与 AI 爱好者对比模型生成效果、发现新模型并挑选最佳创意方案。
众包式 AI 模型评测平台,通过用户盲测投票生成 LLM、图像与代码模型的公开排行榜。
评测大模型与编程 Agent 解决真实 GitHub 软件工程问题的权威基准与官方排行榜。
伯克利开源项目,让大模型准确调用 API 与工具,并维护函数调用排行榜 BFCL。
开源、全面的大模型评测开放平台,提供 LLM 与多模态榜单、评测集社区和竞技场。
独立评测 AI 模型与 API 提供商的基准平台,覆盖质量、价格、速度与延迟等指标。
独立领先的中文通用大模型综合性测评基准,提供多维度能力对比与排行榜单。