DeepSeek-V4-Flash MXFP4-Quant läuft nativ auf Apple M3 Ultra mit 34–43 tok/s
Warum es zählt
Wer DeepSeek-V4-Flash lokal auf Apple Silicon betreiben will, bekommt mit dem MXFP4-MLX-Quant aktuell die schnellste verfügbare Option – inklusive dspark/MTP-Unterstützung, die die Token-Rate während der Generierung steigert statt senkt.
— Lumeric Redaktion
43 tok/s
Peak-Generierungsgeschwindigkeit auf M3 Ultra
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
DeepSeek-V4-Flash MXFP4-Quant läuft nativ auf Apple M3 Ultra mit 34–43 tok/s
Warum es zählt
Wer DeepSeek-V4-Flash lokal auf Apple Silicon betreiben will, bekommt mit dem MXFP4-MLX-Quant aktuell die schnellste verfügbare Option – inklusive dspark/MTP-Unterstützung, die die Token-Rate während der Generierung steigert statt senkt.
— Lumeric Redaktion
43 tok/s
Peak-Generierungsgeschwindigkeit auf M3 Ultra
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.