GLM-4.7-Flash: MXFP4 vs Q4_K_M vs Q4_K_XL auf AMD Radeon 680M iGPU verglichen
ToolsLlama
Warum es zählt
Für lokale Deployments auf iGPU-Hardware zeigt der Test klare Format-Empfehlungen: Q4_K_XL für Chat/Streaming, MXFP4 für RAG/Long-Context – selbst ohne native FP4-Unterstützung der GPU.
— Lumeric Redaktion
llama-bench pp512 (Prompt Processing, t/s) · Spitzenwert
258.36%
GLM-4.7 MXFP4 MoE
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
GLM-4.7-Flash: MXFP4 vs Q4_K_M vs Q4_K_XL auf AMD Radeon 680M iGPU verglichen
ToolsLlama
Warum es zählt
Für lokale Deployments auf iGPU-Hardware zeigt der Test klare Format-Empfehlungen: Q4_K_XL für Chat/Streaming, MXFP4 für RAG/Long-Context – selbst ohne native FP4-Unterstützung der GPU.
— Lumeric Redaktion
llama-bench pp512 (Prompt Processing, t/s) · Spitzenwert
258.36%
GLM-4.7 MXFP4 MoE
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.