vMLX: Servidor de Inferência para Apple Silicon
O vMLX é um servidor de inferência auto-hospedado projetado para modelos de linguagem e geração de imagens em dispositivos Apple Silicon. Ele oferece uma API compatível com OpenAI e Anthropic, permitindo a execução local de LLMs e VLMs sem a necessidade de chaves de API de terceiros. Os usuários podem instalar o software facilmente e iniciar o servidor com um único comando, utilizando modelos prontos disponíveis na comunidade MLX. Além disso, o vMLX inclui um aplicativo desktop nativo, MLX Studio, que fornece uma interface amigável para gerenciamento de modelos e geração de imagens.





