Qwen3.8-Flash-Next: 137 tok/s bei 512k Kontext auf RTX 5090 – Strata vs. Infernix
CompaniesDeepSeek
Warum es zählt
Infernix NVFP4 ist bei 262k Kontext ~23 % schneller als Strata und ermöglicht 512k-Kontext mit nur 8 % Geschwindigkeitsverlust – alles auf einem einzelnen Consumer-GPU unter Windows. Relevant für lokale Agentic-Workflows mit großem Kontext.
— Lumeric Redaktion
Decode tok/s @ 512k Kontext (RTX 5090) · Spitzenwert
149%
Infernix NVFP4 @ 262k
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Qwen3.8-Flash-Next: 137 tok/s bei 512k Kontext auf RTX 5090 – Strata vs. Infernix
CompaniesDeepSeek
Warum es zählt
Infernix NVFP4 ist bei 262k Kontext ~23 % schneller als Strata und ermöglicht 512k-Kontext mit nur 8 % Geschwindigkeitsverlust – alles auf einem einzelnen Consumer-GPU unter Windows. Relevant für lokale Agentic-Workflows mit großem Kontext.
— Lumeric Redaktion
Decode tok/s @ 512k Kontext (RTX 5090) · Spitzenwert
149%
Infernix NVFP4 @ 262k
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.