MTPLX · Apple Silicon · v2.11.3
在 Mac 上用 Qwen 3.8 27B 寫程式碼。
Qwen 3.8 27B 是 32 GB 及以上 Mac 的實用的程式開發選擇。MTPLX 保留模型的 MTP 預測頭,一次驗證多個候選 Token,減少生成等待。Optimized Speed 是預設推薦的模型版本。
macOS 14 及以上 · Apple 晶片 · 免費開源
按 Mac 記憶體選擇模型
模型權重、上下文快取和其他應用程式都會佔用統一記憶體。下載大小與執行時記憶體佔用不同。
| 統一記憶體 | 模型 | 適用場景 |
|---|---|---|
| 16 GB+ | Qwen 3.5 4B / 9B | 適合記憶體較小的 Mac。 |
| 32 GB+ | Qwen 3.8 27B Optimized Speed | 推薦用於本機程式設計和日常聊天。 |
| 36 GB+ | Qwen 3.8 27B Optimized Quality | 8-bit 版本,優先保留模型精度。 |
| 96 GB+ | Qwen 3.8 Flash Next | 適合大記憶體 Mac 上的程式開發任務。 |
長上下文需要額外記憶體。96 GB 是 Flash Next 的起步配置,並不代表能在這一配置下使用最大上下文。以下速度來自 M5 Max 128 GB,不能直接套用於所有 Mac。
27B 的速度與模型選擇
以下為 M5 Max 上不同任務的實測結果。檔案改寫可利用已存在的內容,不能當作全新生成的速度。
| 任務 | tok/s | 測試條件 |
|---|---|---|
| 改寫剛剛生成的檔案 | 87.6 | Optimized Speed · MTPLX 2.10.0 |
| 新程式開發任務 | 65.2 | Bare Speed · MTPLX 2.7.0 |
| 新程式開發任務 | 58.7 | Optimized Speed · MTPLX 2.7.0 |
另一個已記錄的成績是 Qwen 3.6 27B 的 81.74 tok/s:2026 年 7 月 2 日,192 Token 程式碼測試,temperature 0.6,MTP 深度 3。同一測試的普通解碼為 30.37 tok/s,提升至 2.69 倍。這一成績屬於 Qwen 3.6 27B。
81.74 tok/s 原始測試紀錄安裝並開始使用
- 下載 MTPLX,將應用放入“應用程式”資料夾並開啟。
- 選擇適合記憶體容量的 Qwen 模型包,等待下載完成。
- 啟動本機服務,在應用程式內聊天,或連線自己的開發工具。
如果使用 Homebrew,可在終端執行:
brew install youssofal/mtplx/mtplx
mtplx start安裝 OpenCode 後,可透過以下命令啟動本機程式設計會話。MTPLX 也提供相容 OpenAI 和 Anthropic 的介面。
mtplx start opencode將 MTP 帶到 Mac 的專案
Youssof Altoukhi 建立了 MTPLX,將原生多 Token 預測帶到 Mac。專案於 2026 年 4 月 27 日開始開發,首個公開版本於 5 月 2 日釋出。MTPLX 在 Apple 晶片上執行模型自身的 MTP 預測頭,並透過精確推測取樣加速本機生成。
常見問題
應該選哪種 Qwen 3.8 27B 模型包?
32 GB 及以上的 Mac 推薦 Optimized Speed。更看重精度且有至少 36 GB 記憶體時,可選擇 8-bit Optimized Quality。
MTP 會改變模型的取樣分佈嗎?
MTPLX 使用機率比接受和殘差校正,保持所載入模型的取樣分佈。量化精度仍由所選模型包決定。