omlx:基于 MLX 生态的本地 LLM 服务管理项目

LLM inference server with continuous batching & SSD caching for Apple Silicon — managed from the macOS menu bar

分支17Tags110

项目介绍

适用于 Apple Silicon 的 LLM 推理服务器,具备连续批处理和 SSD 缓存功能 — 可通过 macOS 菜单栏进行管理【此简介由AI生成】

定制我的领域
9518.22 K1.56 K访问 GitHub