API 与算力
共 115 个AI 用户与开发者推荐的API 与算力。
纯配置文件驱动的 LLM API 统一网关,把多家后端转为 OpenAI 格式并支持负载均衡与自动重试。
LLM VRAM Calculator
apxml.com在线计算运行大模型所需显存、KV Cache 与生成速度,支持 Nvidia 与 Apple Silicon。
Will It Run AI
willitrunai.com一键检测你的 GPU 或 Mac 能否本地运行 LLM、图像与视频模型,给出显存、量化与速度评估。
ModelFit
modelfit.io根据你的硬件配置推荐最适合本地运行的 AI 模型,提供速度与质量估算及一行 Ollama 安装命令。
Bifrost
github.com高性能开源 AI 网关,统一 23+ 模型供应商,支持负载均衡、故障转移与语义缓存。
Run This LLM
runthisllm.com查询本地运行各类 AI 模型所需硬件的数据库,收录 295+ 模型的显存需求与性能估算。
better-ccflare
github.comClaude API 多账号智能负载均衡代理,支持多供应商、OAuth 健康监控与请求级分析。
用 llama.cpp 实测多种 NVIDIA GPU 与 Apple Silicon 跑 LLaMA 模型的推理速度,含显存占用与 tokens/s 对比。
Novita AI
novita.ai面向开发者的 AI 云平台,提供 200+ 模型 API、GPU 实例与 Serverless GPU 算力。
llm-verify
github.com单文件命令行工具,从外部探测 LLM 接口,检测模型真伪、计费虚高、中转来源与静默降级,输出 HTML 报告。
LocalMaxxing
localmaxxing.com社区众测的本地大模型推理速度榜,对比不同硬件与引擎的 tokens/s 表现
Manifest LLM Gateway
github.com开源 LLM 网关,把 API Key、订阅和本地模型统一到一个 OpenAI 兼容端点,自动路由到最合适的模型。
Can You Run It? LLM version
huggingface.co选择模型和 GPU 配置,估算推理、全量训练与 LoRA 微调所需显存,判断能否本地运行。
ai-model-verifier
github.com检测 AI API 中转站是否真的提供所声称的模型,识别模型替换、计费虚高与签名剥离。
SiliconFlow
siliconflow.com面向开发者的 AI 云平台,提供 200+ 大模型与多模态模型的推理、微调与部署 API。
Claude Code Router
github.com本地模型网关与控制台,为 Claude Code 等编程 Agent 统一路由、故障转移和扩展模型能力。
硅基流动
siliconflow.cn一站式大模型 API 与 AI 云服务平台,覆盖语言、语音、图片、视频模型,按量计费。
notAcalculator Local LLM VRAM Guide
notacalculator.com一份讲解本地大模型显存需求的指南,涵盖量化模型大小、2026 年 GPU 选项与能否运行的判断方法。
Bifrost
getmaxim.ai企业级 AI 网关,统一路由 LLM、MCP 与 Agent,提供治理、护栏和可观测性,开源且高性能。
禾维 AI
hvoyai.comAI API 中转站推荐与实测排行榜,用真实 Key 检测 Claude、GPT、Gemini 等接口的连通性、延迟与模型一致性。
Prediction Guard
predictionguard.com自托管 AI 安全与治理平台,在自有基础设施内对模型与 Agent 执行 NIST/OWASP 策略。
基于 one-hub 二次开发的 AI API 中转站源码,支持 Claude Code、Gemini CLI、Codex 等客户端反代与渠道精细管控。