MTPLX Télécharger pour Mac

MTPLX · Apple Silicon · v2.11.3

Exécutez Qwen 3.8 Flash Next à grande vitesse sur Mac.

Qwen3.8-Flash-Next est un modèle à mélange d’experts de 125 milliards de paramètres. MTPLX conserve sa tête MTP native et accélère la génération avec un décodage spéculatif exact. Il s’adresse aux Mac dotés d’au moins 96 Go de mémoire unifiée et fonctionne avec des outils de développement comme OpenCode.

macOS 14 ou ultérieur · Apple Silicon · Gratuit et open source

Vitesse de génération mesurée avec Flash Next

MTPLX 2.11.3, MacBook Pro M5 Max de 128 Go, Optimized Speed. Échantillonnage : température 1,0, top-p 0,95, top-k 20.

Tâchetok/sConditions
Une requête OpenCode125.81 301 tokens générés ; prompt de 18 539 tokens, dont 18 364 issus du cache ; profondeur MTP de 3.
Prompt de code d’environ 9K tokens79.31 500 tokens générés ; essais alternés sur le même Mac. La version 2.11.2 atteignait 62,5 tok/s.
Tour OpenCode de 109K tokens61.8Moyenne de deux essais.
Tour suivant de 200K tokens50.3Cache déjà alimenté ; moyenne de deux essais.

Le résultat de 125,8 tok/s provient d’une seule requête du 16 septembre 2026. La vitesse dépend de la puce, de la variante du modèle, du contexte et de l’état du cache.

Notes de version 2.11.3 (anglais)

Variantes et besoins en mémoire

Optimized Speed utilise une quantification dynamique sur 4 bits et conserve les projections Qwen Sparse Attention sur 8 bits. C’est la variante recommandée. Bare Speed applique une quantification uniforme sur 4 bits et privilégie la vitesse.

Optimized Speed représente environ 115,1 Go à télécharger, dont une table n-gram de 32 Go lue depuis le SSD. Environ 83 Go de poids restent en mémoire, auxquels s’ajoutent le contexte et les besoins de calcul. Bare Speed représente environ 106,3 Go à télécharger et 74 Go de poids résidents.

Hugging Face: Optimized Speed

Installer MTPLX et commencer

  1. Téléchargez MTPLX, placez l’application dans le dossier Applications et ouvrez-la.
  2. Choisissez un modèle Qwen adapté à votre mémoire et attendez la fin du téléchargement.
  3. Démarrez le serveur local, puis utilisez le chat de l’application ou connectez votre outil de programmation.

Télécharger pour Mac

Avec Homebrew, exécutez ces commandes dans le terminal :

brew install youssofal/mtplx/mtplx
mtplx start

Si OpenCode est installé, cette commande démarre une session de programmation locale. MTPLX fournit aussi des API compatibles OpenAI et Anthropic.

mtplx start opencode

Le projet qui a apporté le MTP au Mac

Youssof Altoukhi a créé MTPLX et apporté la prédiction native de plusieurs tokens au Mac. Le développement a commencé le 27 avril 2026, avec une première version publique le 2 mai. MTPLX exécute les têtes MTP du modèle sur Apple Silicon et accélère la génération locale par échantillonnage spéculatif exact.

L’arrivée du MTP sur Mac (anglais)

Questions fréquentes

Flash Next fonctionne-t-il sur un Mac de 32 Go ?

Les variantes MTPLX actuelles sont destinées aux Mac d’au moins 96 Go. Pour un Mac de 32 Go, choisissez Qwen 3.8 27B Optimized Speed.

Flash Next et Flash-Next désignent-ils le même modèle ?

Oui. Il s’agit de Qwen3.8-Flash-Next. Les dépôts de modèles conservent le nom officiel avec ses traits d’union.

Sources et mesures