MTPLX · Apple Silicon · v2.11.3
Programa en local con Qwen 3.8 27B en tu Mac.
Qwen 3.8 27B es una opción práctica para programar en un Mac con 32 GB o más. MTPLX conserva la cabeza MTP y verifica varios tokens propuestos en una sola pasada. Optimized Speed es la variante recomendada.
macOS 14 o posterior · Apple Silicon · Gratis y de código abierto
Elige el modelo según la memoria de tu Mac
Los pesos del modelo, la caché de contexto y las demás aplicaciones comparten memoria. El tamaño de descarga es distinto del consumo durante la ejecución.
| Memoria unificada | Modelo | Uso |
|---|---|---|
| 16 GB+ | Qwen 3.5 4B / 9B | Para Mac con menos memoria. |
| 32 GB+ | Qwen 3.8 27B Optimized Speed | Recomendado para programar y chatear a diario. |
| 36 GB+ | Qwen 3.8 27B Optimized Quality | Variante de 8 bits para mayor fidelidad al modelo. |
| 96 GB+ | Qwen 3.8 Flash Next | Para programar en Mac con mucha memoria. |
Los contextos largos requieren memoria adicional. 96 GB es la configuración mínima para Flash Next, sin garantizar su contexto máximo. Las velocidades publicadas proceden de un M5 Max con 128 GB.
Velocidad y variantes del modelo 27B
Estas mediciones corresponden a tareas distintas en un M5 Max. Reescribir un archivo recién generado permite reutilizar contenido y no equivale a generar contenido completamente nuevo.
| Tarea | tok/s | Condiciones |
|---|---|---|
| Reescritura de un archivo recién generado | 87.6 | Optimized Speed · MTPLX 2.10.0 |
| Nueva tarea de programación | 65.2 | Bare Speed · MTPLX 2.7.0 |
| Nueva tarea de programación | 58.7 | Optimized Speed · MTPLX 2.7.0 |
Otro récord documentado pertenece a Qwen 3.6 27B: 81,74 tok/s el 2 de julio de 2026 en una prueba de código de 192 tokens, temperatura 0,6 y profundidad MTP 3. La decodificación normal alcanzó 30,37 tok/s en la misma prueba, una mejora de 2,69 veces. Este resultado corresponde a Qwen 3.6 27B.
Registros del récord de 81,74 tok/sInstala MTPLX y empieza a usarlo
- Descarga MTPLX, mueve la aplicación a la carpeta Aplicaciones y ábrela.
- Elige un modelo Qwen adecuado para tu memoria y espera a que termine la descarga.
- Inicia el servidor local y usa el chat de la aplicación o conecta tu herramienta de programación.
Si utilizas Homebrew, ejecuta estos comandos en el terminal:
brew install youssofal/mtplx/mtplx
mtplx startCon OpenCode instalado, este comando inicia una sesión de programación local. MTPLX también ofrece API compatibles con OpenAI y Anthropic.
mtplx start opencodeEl proyecto que llevó MTP al Mac
Youssof Altoukhi creó MTPLX y llevó la predicción nativa de varios tokens al Mac. El desarrollo comenzó el 27 de abril de 2026 y la primera versión pública llegó el 2 de mayo. MTPLX ejecuta las cabezas MTP del modelo en Apple Silicon y acelera la generación local mediante muestreo especulativo exacto.
Preguntas frecuentes
¿Qué variante de Qwen 3.8 27B debería elegir?
Optimized Speed es la recomendada desde 32 GB. Con al menos 36 GB, Optimized Quality de 8 bits permite priorizar la fidelidad al modelo.
¿MTP cambia la distribución de muestreo?
MTPLX usa aceptación por cociente de probabilidades y corrección residual para conservar la distribución del modelo cargado. Las diferencias de cuantización dependen del paquete elegido.