Qwen3.8-Flash-Next: Inferenz-Geschwindigkeit auf Apple M3 Ultra gemessen
CompaniesHugging Face
Warum es zählt
Für lokale LLM-Builds auf Apple Silicon zeigt das Modell solide PP-Werte (~559 t/s), aber moderaten TG-Durchsatz (~31 t/s). Nützliche Baseline für Kapazitätsplanung mit llama.cpp auf M3 Ultra.
— Lumeric Redaktion
llama-benchy PP/TG Speed (M3 Ultra) · Spitzenwert
558.83%
Qwen3.8-Flash-Next pp1000
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Qwen3.8-Flash-Next: Inferenz-Geschwindigkeit auf Apple M3 Ultra gemessen
CompaniesHugging Face
Warum es zählt
Für lokale LLM-Builds auf Apple Silicon zeigt das Modell solide PP-Werte (~559 t/s), aber moderaten TG-Durchsatz (~31 t/s). Nützliche Baseline für Kapazitätsplanung mit llama.cpp auf M3 Ultra.
— Lumeric Redaktion
llama-benchy PP/TG Speed (M3 Ultra) · Spitzenwert
558.83%
Qwen3.8-Flash-Next pp1000
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.