Qwen3.8-Flash-Next (NVFP4, 262K Kontext) auf DGX Spark: ~10k Codezeilen in 8h
CompaniesNVIDIA
Warum es zählt
Qwen3.8-Flash-Next läuft als ~180B MoE vollständig lokal auf einem einzigen DGX Spark mit ~35 tok/s – das zeigt, dass leistungsfähige große MoE-Modelle mit NVFP4-Quantisierung nun für lokale Entwickler-Setups praktisch nutzbar sind.
— Lumeric Redaktion
~35 tok/s
Inferenzgeschwindigkeit auf DGX Spark (lokal)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Qwen3.8-Flash-Next (NVFP4, 262K Kontext) auf DGX Spark: ~10k Codezeilen in 8h
CompaniesNVIDIA
Warum es zählt
Qwen3.8-Flash-Next läuft als ~180B MoE vollständig lokal auf einem einzigen DGX Spark mit ~35 tok/s – das zeigt, dass leistungsfähige große MoE-Modelle mit NVFP4-Quantisierung nun für lokale Entwickler-Setups praktisch nutzbar sind.
— Lumeric Redaktion
~35 tok/s
Inferenzgeschwindigkeit auf DGX Spark (lokal)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.