MTPLX Descargar para Mac

MTPLX · Apple Silicon · v2.11.3

Programa en local con Qwen 3.8 27B en tu Mac.

Qwen 3.8 27B es una opción práctica para programar en un Mac con 32 GB o más. MTPLX conserva la cabeza MTP y verifica varios tokens propuestos en una sola pasada. Optimized Speed es la variante recomendada.

macOS 14 o posterior · Apple Silicon · Gratis y de código abierto

Elige el modelo según la memoria de tu Mac

Los pesos del modelo, la caché de contexto y las demás aplicaciones comparten memoria. El tamaño de descarga es distinto del consumo durante la ejecución.

Memoria unificadaModeloUso
16 GB+Qwen 3.5 4B / 9BPara Mac con menos memoria.
32 GB+Qwen 3.8 27B Optimized SpeedRecomendado para programar y chatear a diario.
36 GB+Qwen 3.8 27B Optimized QualityVariante de 8 bits para mayor fidelidad al modelo.
96 GB+Qwen 3.8 Flash NextPara programar en Mac con mucha memoria.

Los contextos largos requieren memoria adicional. 96 GB es la configuración mínima para Flash Next, sin garantizar su contexto máximo. Las velocidades publicadas proceden de un M5 Max con 128 GB.

Velocidad y variantes del modelo 27B

Estas mediciones corresponden a tareas distintas en un M5 Max. Reescribir un archivo recién generado permite reutilizar contenido y no equivale a generar contenido completamente nuevo.

Tareatok/sCondiciones
Reescritura de un archivo recién generado87.6Optimized Speed · MTPLX 2.10.0
Nueva tarea de programación65.2Bare Speed · MTPLX 2.7.0
Nueva tarea de programación58.7Optimized Speed · MTPLX 2.7.0

Otro récord documentado pertenece a Qwen 3.6 27B: 81,74 tok/s el 2 de julio de 2026 en una prueba de código de 192 tokens, temperatura 0,6 y profundidad MTP 3. La decodificación normal alcanzó 30,37 tok/s en la misma prueba, una mejora de 2,69 veces. Este resultado corresponde a Qwen 3.6 27B.

Registros del récord de 81,74 tok/s

Instala MTPLX y empieza a usarlo

  1. Descarga MTPLX, mueve la aplicación a la carpeta Aplicaciones y ábrela.
  2. Elige un modelo Qwen adecuado para tu memoria y espera a que termine la descarga.
  3. Inicia el servidor local y usa el chat de la aplicación o conecta tu herramienta de programación.

Descargar para Mac

Si utilizas Homebrew, ejecuta estos comandos en el terminal:

brew install youssofal/mtplx/mtplx
mtplx start

Con OpenCode instalado, este comando inicia una sesión de programación local. MTPLX también ofrece API compatibles con OpenAI y Anthropic.

mtplx start opencode

El proyecto que llevó MTP al Mac

Youssof Altoukhi creó MTPLX y llevó la predicción nativa de varios tokens al Mac. El desarrollo comenzó el 27 de abril de 2026 y la primera versión pública llegó el 2 de mayo. MTPLX ejecuta las cabezas MTP del modelo en Apple Silicon y acelera la generación local mediante muestreo especulativo exacto.

Cómo llegó MTP al Mac (inglés)

Preguntas frecuentes

¿Qué variante de Qwen 3.8 27B debería elegir?

Optimized Speed es la recomendada desde 32 GB. Con al menos 36 GB, Optimized Quality de 8 bits permite priorizar la fidelidad al modelo.

¿MTP cambia la distribución de muestreo?

MTPLX usa aceptación por cociente de probabilidades y corrección residual para conservar la distribución del modelo cargado. Las diferencias de cuantización dependen del paquete elegido.

Fuentes y mediciones