开源项目oMLX:Mac本地LLM推理服务器jundot/omlxjundot·来源日期:2026.02.12AI 基础设施推理服务收藏概述oMLX是面向Mac优化的本地LLM推理服务器,支持连续批处理与分层KV缓存以提升吞吐,可通过菜单栏应用直接管理服务,也提供CLI配置方式。项目采用Apache-2.0许可,README提供源码安装与服务启动说明,文档含中文版本,并附性能基准。在Apple Silicon上自建推理服务、需要同时服务多个请求的开发者,可用它替代手动配置的推理进程,按基准数据评估吞吐是否满足本地应用需求。