Ling-3.0 (BailingMoE3) offiziell in llama.cpp – Benchmarks auf Intel Arc B580
ToolsLlama
Warum es zählt
Ling-3.0-tiny läuft vollständig im 12-GB-VRAM der Arc B580 mit 128K-Kontext und über 110 t/s Generation – das macht das MoE-Modell für Consumer-GPUs ohne große Kompromisse nutzbar. GGUF-imatrix-Quants von bartowski sind bereits verfügbar.
— Lumeric Redaktion
llama-bench (Vulkan, Intel Arc B580) · Spitzenwert
120.76%
pp16384
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Ling-3.0 (BailingMoE3) offiziell in llama.cpp – Benchmarks auf Intel Arc B580
ToolsLlama
Warum es zählt
Ling-3.0-tiny läuft vollständig im 12-GB-VRAM der Arc B580 mit 128K-Kontext und über 110 t/s Generation – das macht das MoE-Modell für Consumer-GPUs ohne große Kompromisse nutzbar. GGUF-imatrix-Quants von bartowski sind bereits verfügbar.
— Lumeric Redaktion
llama-bench (Vulkan, Intel Arc B580) · Spitzenwert
120.76%
pp16384
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.