Qwen3.6-35B-A3B-Q6 erreicht 3095 tok/s Prefill auf Strix Halo
ToolsQwen
CompaniesAMD
Warum es zählt
AMD Strix Halo zeigt sich als leistungsfähige lokale Inferenzplattform für große MoE-Modelle. Die Werte von 3095 tok/s Prefill und 190 tok/s Decode machen schnelle, lokale Nutzung von 35B-Modellen auf Consumer-Hardware praktisch möglich.
— Lumeric Redaktion
3095 tok/s
Prefill-Geschwindigkeit auf Strix Halo
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Qwen3.6-35B-A3B-Q6 erreicht 3095 tok/s Prefill auf Strix Halo
ToolsQwen
CompaniesAMD
Warum es zählt
AMD Strix Halo zeigt sich als leistungsfähige lokale Inferenzplattform für große MoE-Modelle. Die Werte von 3095 tok/s Prefill und 190 tok/s Decode machen schnelle, lokale Nutzung von 35B-Modellen auf Consumer-Hardware praktisch möglich.
— Lumeric Redaktion
3095 tok/s
Prefill-Geschwindigkeit auf Strix Halo
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.