









oMLX est un serveur d'inférence natif pour macOS qui permet d'exécuter des modèles d'IA en local sur les appareils Apple Silicon grâce au framework MLX d'Apple. Il propose une mise en cache paginée des KV sur SSD afin de réduire le délai avant le premier token pour les agents de programmation, ainsi qu'un traitement par lots continu pour améliorer le débit. Il fournit des API compatibles avec OpenAI et Anthropic. oMLX prend en charge les modèles LLM, de vision et langage, d'embeddings et de reranking, ainsi que l'appel d'outils, l'intégration MCP, le service de plusieurs modèles et une application native dans la barre des menus avec tableau de bord web.
Téléchargez le DMG macOS signé et faites glisser oMLX dans le dossier Applications, puis configurez le répertoire des modèles, démarrez le serveur et téléchargez ou sélectionnez un modèle au format MLX. Vous pouvez également l'installer depuis les sources avec Python 3.10 ou une version ultérieure en utilisant les commandes Git fournies, puis exécuter omlx serve avec un répertoire de modèles. Connectez Claude Code, OpenClaw, Cursor ou d'autres clients compatibles via les points de terminaison des API OpenAI ou Anthropic.



7.95%

Écoute des médias sociaux