MTPLX · Apple Silicon · v2.11.3
MTPLX y mlx-serve: rendimiento en Mac.
Las mediciones publicadas por mlx-serve comparan ambos motores en el mismo M5 Max. MTPLX obtiene mayor velocidad con decodificación exacta tanto en prompts cortos como con unos 16K de contexto. Las condiciones acompañan a los resultados.
macOS 14 o posterior · Apple Silicon · Gratis y de código abierto
La prueba de M5 Max publicada por mlx-serve
La fuente es el documento mtp-acceptance-port de mlx-serve v26.9.3. Ambas filas muestran el modo que conserva la distribución de muestreo.
| Motor | Prompt corto | Unos 16K de contexto |
|---|---|---|
| MTPLX | 102.0 tok/s | 90.9 tok/s |
| mlx-serve | 92.5 tok/s | 82.4 tok/s |
MTPLX genera aproximadamente un 10,3 % más de tokens por segundo tanto con el prompt corto como con unos 16K de contexto.
Temperatura 1,0, top-p 0,95, profundidad MTP 3, razonamiento desactivado y tres muestras cronometradas. La versión de MTPLX procede de la PR #475. Los paquetes, formatos KV, orden de filtros y secuencias aleatorias difieren. Los resultados describen estas configuraciones concretas.
Tabla original de mlx-serve (inglés)Qué mirar además de la velocidad
La decodificación especulativa exacta conserva la distribución del modelo cargado. Las diferencias de cuantización permanecen, por lo que conviene comparar también el paquete, la precisión y la memoria necesaria.
MTPLX integra chat local, gestión de modelos y conexiones a herramientas de programación en una aplicación nativa de Mac. Los 125,8 tok/s de OpenCode proceden de otra medición, cuyas condiciones aparecen en la página de Flash Next.
El proyecto que llevó MTP al Mac
Youssof Altoukhi creó MTPLX y llevó la predicción nativa de varios tokens al Mac. El desarrollo comenzó el 27 de abril de 2026 y la primera versión pública llegó el 2 de mayo. MTPLX ejecuta las cabezas MTP del modelo en Apple Silicon y acelera la generación local mediante muestreo especulativo exacto.
Preguntas frecuentes
¿MTPLX realizó esta comparativa?
No. El proyecto mlx-serve publicó las mediciones de ambos motores en el mismo Mac. Esta página enlaza la fuente original.
¿Se pueden comparar directamente 125,8 y 92,5 tok/s?
Son tareas y configuraciones diferentes. La comparación en el mismo Mac enfrenta 102,0 con 92,5 y 90,9 con 82,4 tok/s.