llama.cpp: Vulkan INT8 coopmat1 MatMul-Optimierung für AMD RDNA3/RDNA4
ToolsLlama
CompaniesAMD
Warum es zählt
Der pp512-Durchsatz bei gemma4 26B Q4_0 steigt von 3410 auf 4331 t/s (+27 %), Token-Generierung verbessert sich moderat. AMD-Nutzer mit RDNA3/4-GPUs profitieren ohne Hardwarewechsel direkt nach Update.
— Lumeric Redaktion
llama.cpp pp512 – gemma4 26B.A4B Q4_0 (Vulkan, RX 7900 XTX) · Spitzenwert
3410.53%
pp512 (vorher)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
llama.cpp: Vulkan INT8 coopmat1 MatMul-Optimierung für AMD RDNA3/RDNA4
ToolsLlama
CompaniesAMD
Warum es zählt
Der pp512-Durchsatz bei gemma4 26B Q4_0 steigt von 3410 auf 4331 t/s (+27 %), Token-Generierung verbessert sich moderat. AMD-Nutzer mit RDNA3/4-GPUs profitieren ohne Hardwarewechsel direkt nach Update.
— Lumeric Redaktion
llama.cpp pp512 – gemma4 26B.A4B Q4_0 (Vulkan, RX 7900 XTX) · Spitzenwert
3410.53%
pp512 (vorher)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.