MTPLX Télécharger pour Mac

MTPLX · Apple Silicon · v2.11.3

Exécutez Qwen plus vite sur votre Mac.

MTPLX est une application Mac native pour les modèles de langage locaux sur Apple Silicon. Elle utilise la prédiction de plusieurs tokens du modèle, ou MTP, pour accélérer la génération. Discutez, écrivez du code et connectez OpenCode, Pi ou Claude Code à votre Mac. Qwen 3.8 Flash Next a atteint 125,8 tok/s sur une requête OpenCode avec un M5 Max.

macOS 14 ou ultérieur · Apple Silicon · Gratuit et open source

Quel modèle choisir pour votre Mac ?

Les poids du modèle, le cache de contexte et les autres applications partagent la mémoire unifiée. La taille du téléchargement diffère de la mémoire nécessaire en fonctionnement.

Mémoire unifiéeModèleUsage
16 GB+Qwen 3.5 4B / 9BPour les Mac ayant moins de mémoire.
32 GB+Qwen 3.8 27B Optimized SpeedRecommandé pour le code et les conversations.
36 GB+Qwen 3.8 27B Optimized QualityVariante 8 bits pour une meilleure fidélité au modèle.
96 GB+Qwen 3.8 Flash NextPour coder sur un Mac doté de beaucoup de mémoire.

Un contexte long exige davantage de mémoire. 96 Go constituent le minimum pour Flash Next et ne garantissent pas l’utilisation de son contexte maximal. Les vitesses présentées ont été mesurées sur un M5 Max de 128 Go.

Vitesse de génération mesurée avec Flash Next

MTPLX 2.11.3, MacBook Pro M5 Max de 128 Go, Optimized Speed. Échantillonnage : température 1,0, top-p 0,95, top-k 20.

Tâchetok/sConditions
Une requête OpenCode125.81 301 tokens générés ; prompt de 18 539 tokens, dont 18 364 issus du cache ; profondeur MTP de 3.
Prompt de code d’environ 9K tokens79.31 500 tokens générés ; essais alternés sur le même Mac. La version 2.11.2 atteignait 62,5 tok/s.
Tour OpenCode de 109K tokens61.8Moyenne de deux essais.
Tour suivant de 200K tokens50.3Cache déjà alimenté ; moyenne de deux essais.

Le résultat de 125,8 tok/s provient d’une seule requête du 16 septembre 2026. La vitesse dépend de la puce, de la variante du modèle, du contexte et de l’état du cache.

Notes de version 2.11.3 (anglais)

Installer MTPLX et commencer

  1. Téléchargez MTPLX, placez l’application dans le dossier Applications et ouvrez-la.
  2. Choisissez un modèle Qwen adapté à votre mémoire et attendez la fin du téléchargement.
  3. Démarrez le serveur local, puis utilisez le chat de l’application ou connectez votre outil de programmation.

Télécharger pour Mac

Avec Homebrew, exécutez ces commandes dans le terminal :

brew install youssofal/mtplx/mtplx
mtplx start

Si OpenCode est installé, cette commande démarre une session de programmation locale. MTPLX fournit aussi des API compatibles OpenAI et Anthropic.

mtplx start opencode

Le projet qui a apporté le MTP au Mac

Youssof Altoukhi a créé MTPLX et apporté la prédiction native de plusieurs tokens au Mac. Le développement a commencé le 27 avril 2026, avec une première version publique le 2 mai. MTPLX exécute les têtes MTP du modèle sur Apple Silicon et accélère la génération locale par échantillonnage spéculatif exact.

L’arrivée du MTP sur Mac (anglais)

Questions fréquentes

Comment faire tourner Qwen plus vite sur Mac ?

Choisissez un moteur utilisant le MTP natif du modèle et une variante adaptée à votre mémoire. MTPLX propose le MTP sur Apple Silicon et publie des mesures par modèle et longueur de contexte.

MTPLX est-il gratuit ?

MTPLX est gratuit et open source, sous licence Apache-2.0. Les modèles conservent leurs propres licences.

Quels Mac sont compatibles ?

MTPLX fonctionne sur les Mac Apple Silicon avec macOS 14 ou ultérieur. Le choix du modèle dépend de la mémoire unifiée. Des variantes compatibles FP16 sont disponibles pour M1 et M2.

Sources et mesures