MTPLX Baixar para Mac

MTPLX · Apple Silicon · v2.11.3

Programe localmente com Qwen 3.8 27B no Mac.

O Qwen 3.8 27B é uma opção prática para programar em Macs com 32 GB ou mais. O MTPLX preserva o módulo MTP e verifica vários tokens propostos em uma única passagem. Optimized Speed é a versão recomendada.

macOS 14 ou posterior · Apple Silicon · Gratuito e de código aberto

Escolha o modelo pela memória do seu Mac

Os pesos do modelo, o cache de contexto e os outros aplicativos compartilham a memória. O tamanho do download é diferente do consumo durante a execução.

Memória unificadaModeloUso
16 GB+Qwen 3.5 4B / 9BPara Macs com menos memória.
32 GB+Qwen 3.8 27B Optimized SpeedRecomendado para programação e conversas diárias.
36 GB+Qwen 3.8 27B Optimized QualityVersão de 8 bits para maior fidelidade ao modelo.
96 GB+Qwen 3.8 Flash NextPara programar em Macs com bastante memória.

Contextos longos exigem memória adicional. 96 GB é a configuração mínima para Flash Next, sem garantir o contexto máximo. As velocidades apresentadas foram medidas em um M5 Max com 128 GB.

Velocidade e versões do modelo 27B

Estas medições representam tarefas diferentes no M5 Max. Reescrever um arquivo recém-gerado permite reutilizar conteúdo, por isso tem condições diferentes da geração de conteúdo inteiramente novo.

Tarefatok/sCondições
Reescrita de um arquivo recém-gerado87.6Optimized Speed · MTPLX 2.10.0
Nova tarefa de programação65.2Bare Speed · MTPLX 2.7.0
Nova tarefa de programação58.7Optimized Speed · MTPLX 2.7.0

Outro recorde documentado pertence ao Qwen 3.6 27B: 81,74 tok/s em 2 de julho de 2026, em um teste de código com 192 tokens, temperatura 0,6 e profundidade MTP 3. A decodificação comum atingiu 30,37 tok/s no mesmo teste, uma aceleração de 2,69 vezes. Esse resultado é do Qwen 3.6 27B.

Logs do recorde de 81,74 tok/s

Instale o MTPLX e comece a usar

  1. Baixe o MTPLX, mova o aplicativo para a pasta Aplicativos e abra-o.
  2. Escolha um modelo Qwen compatível com sua memória e aguarde o fim do download.
  3. Inicie o servidor local e use o chat do aplicativo ou conecte sua ferramenta de programação.

Baixar para Mac

Se você usa Homebrew, execute estes comandos no terminal:

brew install youssofal/mtplx/mtplx
mtplx start

Com o OpenCode instalado, este comando inicia uma sessão de programação local. O MTPLX também oferece APIs compatíveis com OpenAI e Anthropic.

mtplx start opencode

O projeto que trouxe MTP para o Mac

Youssof Altoukhi criou o MTPLX e trouxe a previsão nativa de múltiplos tokens para o Mac. O desenvolvimento começou em 27 de abril de 2026, e a primeira versão pública saiu em 2 de maio. O MTPLX executa os módulos MTP do modelo no Apple Silicon e acelera a geração local com amostragem especulativa exata.

Como o MTP chegou ao Mac (inglês)

Perguntas frequentes

Qual versão do Qwen 3.8 27B devo escolher?

Optimized Speed é recomendada a partir de 32 GB. Com pelo menos 36 GB, você pode escolher Optimized Quality de 8 bits para priorizar a fidelidade ao modelo.

MTP altera a distribuição de amostragem?

O MTPLX usa aceitação por razão de probabilidades e correção residual para preservar a distribuição do modelo carregado. As diferenças de quantização dependem do pacote escolhido.

Fontes e medições