









oMLX é um servidor de inferência nativo para macOS que permite executar modelos de IA localmente em Apple Silicon, utilizando a framework MLX da Apple. Disponibiliza cache KV paged em SSD para reduzir o tempo até ao primeiro token em agentes de programação, batching contínuo para maior capacidade de processamento e APIs compatíveis com OpenAI e Anthropic. O oMLX suporta modelos LLM, de visão-linguagem, de embeddings e de reranking, além de chamadas a ferramentas, integração com MCP, disponibilização de vários modelos e uma aplicação nativa na barra de menus com painel web.
Transfira o DMG assinado para macOS e arraste o oMLX para a pasta Aplicações. Em seguida, configure o diretório dos modelos, inicie o servidor e transfira ou selecione um modelo em formato MLX. Em alternativa, instale a partir do código-fonte com Python 3.10 ou posterior, utilizando os comandos Git fornecidos, e execute omlx serve com um diretório de modelos. Ligue o Claude Code, OpenClaw, Cursor ou outros clientes compatíveis através dos endpoints de API OpenAI ou Anthropic.



7.95%

Escuta de mídias sociais