oMLX
github.com
面向 Apple Silicon 的本地 LLM 推理服务器,支持连续批处理与 SSD 分层 KV 缓存,可从 macOS 菜单栏管理。
开源有 API可自部署本地模型命令行桌面客户端
GitHub ★ 22,603被推荐 1 次
适合做什么
适合在 Mac 上本地跑大模型、给 Claude Code 等工具提供本地推理后端的开发者。
标签与属性
同类推荐
高吞吐、省显存的开源 LLM 推理与服务引擎,支持 PagedAttention 与 OpenAI 兼容 API。
开源有 API可自部署DeepSeek通义千问
github.com1 处推荐
本地部署 / 运行最流行的开源大模型本地运行工具,一条命令即可下载并运行 Llama、Qwen、DeepSeek 等模型。
开源可自部署有 API通义千问DeepSeek
ollama.com3 处推荐
Hugging Face 官方 JS 库,让 Transformers 模型直接在浏览器里运行,无需服务器。
开源多模态可自部署本地模型网页
github.com1 处推荐