Qwen3.8-27B auf JevBench: 84,4% Accuracy mit Open-Source-Stack
CompaniesHugging Face
Warum es zählt
Der Open-Source-Stack erzielt auf dem öffentlichen JevBench-Set eine Accuracy auf dem Niveau proprietärer Systeme (z.B. Jev 1.13.0: 86,6%), bleibt aber beim Composite-Score (68,4) noch hinter dem Leader (75,4). Temporal-numerische Aufgaben (33%) sind der klare Schwachpunkt, den AI-Builder bei ähnlichen Deployments einplanen müssen.
— Lumeric Redaktion
JevBench v1.2 (Public Set, 231 Tasks) · Spitzenwert
86.6%
Jev 1.13.0 (TypeSafe AI)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Qwen3.8-27B auf JevBench: 84,4% Accuracy mit Open-Source-Stack
CompaniesHugging Face
Warum es zählt
Der Open-Source-Stack erzielt auf dem öffentlichen JevBench-Set eine Accuracy auf dem Niveau proprietärer Systeme (z.B. Jev 1.13.0: 86,6%), bleibt aber beim Composite-Score (68,4) noch hinter dem Leader (75,4). Temporal-numerische Aufgaben (33%) sind der klare Schwachpunkt, den AI-Builder bei ähnlichen Deployments einplanen müssen.
— Lumeric Redaktion
JevBench v1.2 (Public Set, 231 Tasks) · Spitzenwert
86.6%
Jev 1.13.0 (TypeSafe AI)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.