MTPLX Für Mac herunterladen

MTPLX · Apple Silicon · v2.11.3

So führst du Qwen lokal auf deinem Mac aus.

Wähle zuerst ein Modell, das in den Arbeitsspeicher deines Macs passt. Installiere anschließend die native MTPLX-App oder die CLI über Homebrew. Nach dem Herunterladen des Modells läuft die Inferenz auf deinem eigenen Mac.

macOS 14 oder neuer · Apple Silicon · Kostenlos und Open Source

Welches Modell passt in deinen Mac?

Modellgewichte, Kontext-Cache und andere Apps teilen sich den Arbeitsspeicher. Downloadgröße und Speicherbedarf im Betrieb sind unterschiedlich.

Gemeinsamer ArbeitsspeicherModellEinsatz
16 GB+Qwen 3.5 4B / 9BFür Macs mit weniger Arbeitsspeicher.
32 GB+Qwen 3.8 27B Optimized SpeedEmpfohlen für Coding und tägliche Chats.
36 GB+Qwen 3.8 27B Optimized Quality8-Bit-Variante für höhere Modelltreue.
96 GB+Qwen 3.8 Flash NextFür Coding auf Macs mit viel Arbeitsspeicher.

Lange Kontexte benötigen zusätzlichen Speicher. 96 GB sind die Einstiegskonfiguration für Flash Next, keine Zusage für das maximale Kontextfenster. Die Geschwindigkeitsmessungen stammen von einem M5 Max mit 128 GB.

Installieren und loslegen

  1. Lade MTPLX herunter, verschiebe die App in den Programme-Ordner und öffne sie.
  2. Wähle ein Qwen-Modell, das zu deinem Arbeitsspeicher passt, und lasse den Download abschließen.
  3. Starte den lokalen Server. Nutze den Chat in der App oder verbinde dein Coding-Tool.

Für Mac herunterladen

Mit Homebrew kannst du diese Befehle im Terminal ausführen:

brew install youssofal/mtplx/mtplx
mtplx start

Wenn OpenCode installiert ist, startet dieser Befehl eine lokale Coding-Sitzung. MTPLX bietet außerdem OpenAI- und Anthropic-kompatible Schnittstellen.

mtplx start opencode

Die lokale Ausführung prüfen

Prüfe in MTPLX das geladene Modell, die Generierungsgeschwindigkeit und den Speicherbedarf. Der Server verwendet standardmäßig eine lokale Adresse. Der Modelldownload braucht Internet; Websuche und externe Tools können ebenfalls auf das Netz zugreifen.

Teste eine echte Aufgabe, etwa die Änderung einer Funktion in deinem Projekt, und stelle danach eine weitere Frage. Achte auf die Generierungsgeschwindigkeit, die Zeit bis zum ersten Token und die Wartezeit nach einem Tool-Aufruf.

Das Projekt, das MTP auf den Mac brachte

Youssof Altoukhi hat MTPLX entwickelt und natives Multi-Token Prediction auf den Mac gebracht. Die Entwicklung begann am 27. April 2026; die erste öffentliche Version erschien am 2. Mai. MTPLX führt die MTP-Köpfe des Modells auf Apple Silicon aus und beschleunigt lokale Generierung mit exaktem spekulativem Sampling.

Wie MTP auf den Mac kam (Englisch)

Häufige Fragen

Wie lässt sich Qwen auf einem Mac beschleunigen?

Wähle eine Engine, die das native MTP des Modells nutzt, und ein Modellpaket, das in den Arbeitsspeicher passt. MTPLX bietet MTP auf Apple Silicon und veröffentlicht Messwerte nach Modell und Kontextlänge.

Ist MTPLX kostenlos?

MTPLX ist kostenlos und unter Apache-2.0 als Open Source verfügbar. Für Modelle gelten die jeweiligen Modelllizenzen.

Welche Macs werden unterstützt?

MTPLX läuft auf Apple-Silicon-Macs mit macOS 14 oder neuer. Das passende Modell hängt vom Arbeitsspeicher ab. Für M1 und M2 stehen entsprechende FP16-kompatible Pakete im Modellkatalog.

Quellen und Messungen