Victoria: Qwen3.8-Flash-Next mit 44% Expert-Kürzung erreicht 70% auf Terminal-Bench 2.1
CompaniesHugging Face
Warum es zählt
Victoria kombiniert MoE-Pruning (512→288 Experten/Layer) mit NVFP4-Nachtraining und einem Draft-Head für 2× höheren Durchsatz – ein praxisnaher Ansatz für effizientes lokales Inference. Maple zeigt, wie Domain-Fine-Tuning (länderspezifisch) die Korrektheit von Behördenantworten von 6,6% auf 21,8% treiben kann.
— Lumeric Redaktion
Terminal-Bench 2.1 · Spitzenwert
70%
Victoria (NVFP4, 44% Experts cut)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Victoria: Qwen3.8-Flash-Next mit 44% Expert-Kürzung erreicht 70% auf Terminal-Bench 2.1
CompaniesHugging Face
Warum es zählt
Victoria kombiniert MoE-Pruning (512→288 Experten/Layer) mit NVFP4-Nachtraining und einem Draft-Head für 2× höheren Durchsatz – ein praxisnaher Ansatz für effizientes lokales Inference. Maple zeigt, wie Domain-Fine-Tuning (länderspezifisch) die Korrektheit von Behördenantworten von 6,6% auf 21,8% treiben kann.
— Lumeric Redaktion
Terminal-Bench 2.1 · Spitzenwert
70%
Victoria (NVFP4, 44% Experts cut)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.