GSQ-RCO GGUFs für Qwen3.8-Flash-Next: Near-Baseline-Qualität bei 68–76 GB
CompaniesHugging Face
Warum es zählt
IQ3_XXS trifft das Baseline-Modell exakt auf AIME25 bei einem Fünftel der BF16-Größe — lokale Deployment-Optionen für leistungsstarke Reasoning-Modelle werden damit deutlich zugänglicher. Q2_0 bietet 3,4× höheren Prompt-Durchsatz gegenüber IQ2_XS für latenz-kritische Anwendungen.
— Lumeric Redaktion
Task Average (Q2_0 vs IQ2_XS vs IQ3_XXS) · Spitzenwert
89.07%
Q2_0
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
GSQ-RCO GGUFs für Qwen3.8-Flash-Next: Near-Baseline-Qualität bei 68–76 GB
CompaniesHugging Face
Warum es zählt
IQ3_XXS trifft das Baseline-Modell exakt auf AIME25 bei einem Fünftel der BF16-Größe — lokale Deployment-Optionen für leistungsstarke Reasoning-Modelle werden damit deutlich zugänglicher. Q2_0 bietet 3,4× höheren Prompt-Durchsatz gegenüber IQ2_XS für latenz-kritische Anwendungen.
— Lumeric Redaktion
Task Average (Q2_0 vs IQ2_XS vs IQ3_XXS) · Spitzenwert
89.07%
Q2_0
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.