MTPLX · Apple Silicon · v2.11.3
Como rodar Qwen localmente no seu Mac.
Comece escolhendo um modelo que caiba na memória unificada do seu Mac. Depois, instale o aplicativo MTPLX ou a CLI pelo Homebrew. Após baixar o modelo, a inferência acontece no seu próprio Mac.
macOS 14 ou posterior · Apple Silicon · Gratuito e de código aberto
Escolha o modelo pela memória do seu Mac
Os pesos do modelo, o cache de contexto e os outros aplicativos compartilham a memória. O tamanho do download é diferente do consumo durante a execução.
| Memória unificada | Modelo | Uso |
|---|---|---|
| 16 GB+ | Qwen 3.5 4B / 9B | Para Macs com menos memória. |
| 32 GB+ | Qwen 3.8 27B Optimized Speed | Recomendado para programação e conversas diárias. |
| 36 GB+ | Qwen 3.8 27B Optimized Quality | Versão de 8 bits para maior fidelidade ao modelo. |
| 96 GB+ | Qwen 3.8 Flash Next | Para programar em Macs com bastante memória. |
Contextos longos exigem memória adicional. 96 GB é a configuração mínima para Flash Next, sem garantir o contexto máximo. As velocidades apresentadas foram medidas em um M5 Max com 128 GB.
Instale o MTPLX e comece a usar
- Baixe o MTPLX, mova o aplicativo para a pasta Aplicativos e abra-o.
- Escolha um modelo Qwen compatível com sua memória e aguarde o fim do download.
- Inicie o servidor local e use o chat do aplicativo ou conecte sua ferramenta de programação.
Se você usa Homebrew, execute estes comandos no terminal:
brew install youssofal/mtplx/mtplx
mtplx startCom o OpenCode instalado, este comando inicia uma sessão de programação local. O MTPLX também oferece APIs compatíveis com OpenAI e Anthropic.
mtplx start opencodeConfira a execução local
No MTPLX, confira o modelo carregado, a velocidade de geração e o consumo de memória. O servidor usa um endereço local por padrão. O download do modelo exige internet; a busca na web e ferramentas externas também podem acessar a rede.
Teste uma tarefa real, como alterar uma função do seu projeto, e faça outra pergunta em seguida. Observe a velocidade de geração, o tempo até o primeiro token e a espera depois de uma chamada de ferramenta.
O projeto que trouxe MTP para o Mac
Youssof Altoukhi criou o MTPLX e trouxe a previsão nativa de múltiplos tokens para o Mac. O desenvolvimento começou em 27 de abril de 2026, e a primeira versão pública saiu em 2 de maio. O MTPLX executa os módulos MTP do modelo no Apple Silicon e acelera a geração local com amostragem especulativa exata.
Perguntas frequentes
Como executar Qwen mais rápido no Mac?
Escolha um motor compatível com o MTP nativo do modelo e um pacote adequado à memória. O MTPLX oferece MTP no Apple Silicon e publica medições por modelo e tamanho de contexto.
O MTPLX é gratuito?
O MTPLX é gratuito e de código aberto, sob a licença Apache-2.0. Cada modelo mantém sua própria licença.
Quais Macs são compatíveis?
O MTPLX funciona em Macs com Apple Silicon e macOS 14 ou posterior. O modelo depende da memória unificada disponível. Há pacotes compatíveis com FP16 para M1 e M2.