MoEspresso 3: Qwen3.8-Flash-Next (125B) mit 12–15 tok/s auf M1 Max
Warum es zählt
Ein 125B-MoE-Modell mit brauchbarer Geschwindigkeit lokal auf einem 32-GB-M1-Max zu betreiben, ist praktisch relevant für Entwickler ohne Cloud-Zugang. Das Custom-Benchmark-Ergebnis (84,3 %) liegt dabei über Claude Opus 4.8 xhigh (80,3 %) und Claude Sonnet-Modellen.
— Lumeric Redaktion
MoEspresso Custom Benchmark (48-Fragen, 6 Kategorien) · Spitzenwert
89.7%
Qwen3.8 Flash (hosted), medium
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
MoEspresso 3: Qwen3.8-Flash-Next (125B) mit 12–15 tok/s auf M1 Max
Warum es zählt
Ein 125B-MoE-Modell mit brauchbarer Geschwindigkeit lokal auf einem 32-GB-M1-Max zu betreiben, ist praktisch relevant für Entwickler ohne Cloud-Zugang. Das Custom-Benchmark-Ergebnis (84,3 %) liegt dabei über Claude Opus 4.8 xhigh (80,3 %) und Claude Sonnet-Modellen.
— Lumeric Redaktion
MoEspresso Custom Benchmark (48-Fragen, 6 Kategorien) · Spitzenwert
89.7%
Qwen3.8 Flash (hosted), medium
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.