MTPLX Télécharger pour Mac

MTPLX · Apple Silicon · v2.11.3

MTPLX et mlx-serve : les performances sur Mac.

Les mesures publiées par mlx-serve comparent les deux moteurs sur le même M5 Max. MTPLX arrive en tête en décodage exact avec un prompt court comme avec un contexte d’environ 16K. Les conditions accompagnent les résultats pour vous aider à choisir.

macOS 14 ou ultérieur · Apple Silicon · Gratuit et open source

Le test M5 Max publié par mlx-serve

La source est le document mtp-acceptance-port de mlx-serve v26.9.3. Les deux lignes correspondent au mode qui conserve la distribution d’échantillonnage.

MoteurPrompt courtContexte d’environ 16K
MTPLX102.0 tok/s90.9 tok/s
mlx-serve92.5 tok/s82.4 tok/s

MTPLX génère environ 10,3 % de tokens par seconde supplémentaires avec le prompt court comme avec le contexte d’environ 16K.

Température 1,0, top-p 0,95, profondeur MTP de 3, raisonnement désactivé, trois échantillons chronométrés. La version de MTPLX provient de la PR #475. Les modèles, les formats KV, l’ordre des filtres et les flux aléatoires diffèrent. Les résultats décrivent ces configurations précises.

Tableau original de mlx-serve (anglais)

Ce qui compte au-delà de la vitesse

Le décodage spéculatif exact conserve la distribution du modèle chargé. Il n’efface pas les différences de quantification. Comparez aussi la variante, la précision et la mémoire nécessaire.

MTPLX regroupe le chat local, la gestion des modèles et la connexion aux outils de programmation dans une application Mac native. Les 125,8 tok/s d’OpenCode proviennent d’une mesure distincte, détaillée sur la page Flash Next.

Le projet qui a apporté le MTP au Mac

Youssof Altoukhi a créé MTPLX et apporté la prédiction native de plusieurs tokens au Mac. Le développement a commencé le 27 avril 2026, avec une première version publique le 2 mai. MTPLX exécute les têtes MTP du modèle sur Apple Silicon et accélère la génération locale par échantillonnage spéculatif exact.

L’arrivée du MTP sur Mac (anglais)

Questions fréquentes

MTPLX a-t-il réalisé ce comparatif ?

Non. Le projet mlx-serve a publié ces mesures des deux moteurs sur le même Mac. Le tableau original est accessible depuis cette page.

Peut-on comparer directement 125,8 et 92,5 tok/s ?

Ces valeurs proviennent de tâches et de configurations différentes. Le comparatif sur le même Mac oppose 102,0 à 92,5 et 90,9 à 82,4 tok/s.

Sources et mesures