MTPLX · Apple Silicon · v2.11.3
Programe localmente com Qwen 3.8 27B no Mac.
O Qwen 3.8 27B é uma opção prática para programar em Macs com 32 GB ou mais. O MTPLX preserva o módulo MTP e verifica vários tokens propostos em uma única passagem. Optimized Speed é a versão recomendada.
macOS 14 ou posterior · Apple Silicon · Gratuito e de código aberto
Escolha o modelo pela memória do seu Mac
Os pesos do modelo, o cache de contexto e os outros aplicativos compartilham a memória. O tamanho do download é diferente do consumo durante a execução.
| Memória unificada | Modelo | Uso |
|---|---|---|
| 16 GB+ | Qwen 3.5 4B / 9B | Para Macs com menos memória. |
| 32 GB+ | Qwen 3.8 27B Optimized Speed | Recomendado para programação e conversas diárias. |
| 36 GB+ | Qwen 3.8 27B Optimized Quality | Versão de 8 bits para maior fidelidade ao modelo. |
| 96 GB+ | Qwen 3.8 Flash Next | Para programar em Macs com bastante memória. |
Contextos longos exigem memória adicional. 96 GB é a configuração mínima para Flash Next, sem garantir o contexto máximo. As velocidades apresentadas foram medidas em um M5 Max com 128 GB.
Velocidade e versões do modelo 27B
Estas medições representam tarefas diferentes no M5 Max. Reescrever um arquivo recém-gerado permite reutilizar conteúdo, por isso tem condições diferentes da geração de conteúdo inteiramente novo.
| Tarefa | tok/s | Condições |
|---|---|---|
| Reescrita de um arquivo recém-gerado | 87.6 | Optimized Speed · MTPLX 2.10.0 |
| Nova tarefa de programação | 65.2 | Bare Speed · MTPLX 2.7.0 |
| Nova tarefa de programação | 58.7 | Optimized Speed · MTPLX 2.7.0 |
Outro recorde documentado pertence ao Qwen 3.6 27B: 81,74 tok/s em 2 de julho de 2026, em um teste de código com 192 tokens, temperatura 0,6 e profundidade MTP 3. A decodificação comum atingiu 30,37 tok/s no mesmo teste, uma aceleração de 2,69 vezes. Esse resultado é do Qwen 3.6 27B.
Logs do recorde de 81,74 tok/sInstale o MTPLX e comece a usar
- Baixe o MTPLX, mova o aplicativo para a pasta Aplicativos e abra-o.
- Escolha um modelo Qwen compatível com sua memória e aguarde o fim do download.
- Inicie o servidor local e use o chat do aplicativo ou conecte sua ferramenta de programação.
Se você usa Homebrew, execute estes comandos no terminal:
brew install youssofal/mtplx/mtplx
mtplx startCom o OpenCode instalado, este comando inicia uma sessão de programação local. O MTPLX também oferece APIs compatíveis com OpenAI e Anthropic.
mtplx start opencodeO projeto que trouxe MTP para o Mac
Youssof Altoukhi criou o MTPLX e trouxe a previsão nativa de múltiplos tokens para o Mac. O desenvolvimento começou em 27 de abril de 2026, e a primeira versão pública saiu em 2 de maio. O MTPLX executa os módulos MTP do modelo no Apple Silicon e acelera a geração local com amostragem especulativa exata.
Perguntas frequentes
Qual versão do Qwen 3.8 27B devo escolher?
Optimized Speed é recomendada a partir de 32 GB. Com pelo menos 36 GB, você pode escolher Optimized Quality de 8 bits para priorizar a fidelidade ao modelo.
MTP altera a distribuição de amostragem?
O MTPLX usa aceitação por razão de probabilidades e correção residual para preservar a distribuição do modelo carregado. As diferenças de quantização dependem do pacote escolhido.