MTPLX · Apple Silicon · v2.11.3
MTPLX e mlx-serve: desempenho no Mac.
As medições publicadas pelo mlx-serve comparam os dois motores no mesmo M5 Max. O MTPLX é mais rápido na decodificação exata tanto com prompt curto quanto com cerca de 16K de contexto. As condições acompanham os resultados para ajudar na escolha.
macOS 14 ou posterior · Apple Silicon · Gratuito e de código aberto
O teste de M5 Max publicado pelo mlx-serve
A fonte é o documento mtp-acceptance-port do mlx-serve v26.9.3. As duas linhas mostram o modo que preserva a distribuição de amostragem.
| Motor | Prompt curto | Cerca de 16K de contexto |
|---|---|---|
| MTPLX | 102.0 tok/s | 90.9 tok/s |
| mlx-serve | 92.5 tok/s | 82.4 tok/s |
O MTPLX gera cerca de 10,3% mais tokens por segundo tanto no prompt curto quanto com aproximadamente 16K de contexto.
Temperatura 1,0, top-p 0,95, profundidade MTP 3, raciocínio desativado e três amostras cronometradas. A versão do MTPLX vem da PR #475. Os pacotes, formatos KV, ordem dos filtros e sequências aleatórias são diferentes. Os resultados representam essas configurações específicas.
Tabela original do mlx-serve (inglês)O que avaliar além da velocidade
A decodificação especulativa exata preserva a distribuição do modelo carregado. As diferenças de quantização continuam existindo, então compare também o pacote, a precisão e a memória necessária.
O MTPLX reúne chat local, gerenciamento de modelos e conexão a ferramentas de programação em um aplicativo nativo de Mac. Os 125,8 tok/s do OpenCode vêm de outra medição, detalhada na página de Flash Next.
O projeto que trouxe MTP para o Mac
Youssof Altoukhi criou o MTPLX e trouxe a previsão nativa de múltiplos tokens para o Mac. O desenvolvimento começou em 27 de abril de 2026, e a primeira versão pública saiu em 2 de maio. O MTPLX executa os módulos MTP do modelo no Apple Silicon e acelera a geração local com amostragem especulativa exata.
Perguntas frequentes
O MTPLX fez esta comparação?
Não. O projeto mlx-serve publicou as medições dos dois motores no mesmo Mac. Esta página inclui o link para a fonte original.
Posso comparar diretamente 125,8 e 92,5 tok/s?
Esses números vêm de tarefas e configurações diferentes. A comparação no mesmo Mac usa 102,0 contra 92,5 e 90,9 contra 82,4 tok/s.