Strata-Engine: Qwen3.8 Flash Next mit 50 t/s TG und 1500 t/s PP auf 12 GB VRAM
Warum es zählt
Strata ermöglicht Frontier-Modelle lokal auf Consumer-Laptops mit 12 GB VRAM und 64 GB RAM mit deutlich höherem Durchsatz als llama.cpp-Forks. Derzeit nur für ISTA-DASLab-GGUFs und Nvidia-GPUs verfügbar; AMD-Support ist experimentell.
— Lumeric Redaktion
Token Generation Speed (t/s) – Qwen3.8 Flash Next IQ3_XXS @ 43k Kontext · Spitzenwert
51%
Strata Engine
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Strata-Engine: Qwen3.8 Flash Next mit 50 t/s TG und 1500 t/s PP auf 12 GB VRAM
Warum es zählt
Strata ermöglicht Frontier-Modelle lokal auf Consumer-Laptops mit 12 GB VRAM und 64 GB RAM mit deutlich höherem Durchsatz als llama.cpp-Forks. Derzeit nur für ISTA-DASLab-GGUFs und Nvidia-GPUs verfügbar; AMD-Support ist experimentell.
— Lumeric Redaktion
Token Generation Speed (t/s) – Qwen3.8 Flash Next IQ3_XXS @ 43k Kontext · Spitzenwert
51%
Strata Engine
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.