Ling-3.0-flash-VL: 124B-Parameter Multimodal-MoE mit 256K Kontext in llama.cpp
ToolsLlama
Warum es zählt
Wenn der PR gemergt wird, können Nutzer das effiziente Ling-3.0-flash-VL lokal über llama.cpp mit Bild- und Video-Reasoning betreiben – bei nur 5,5B aktiven Parametern pro Token trotz 124B Gesamtkapazität.
— Lumeric Redaktion
124B / 5.5B aktiv
Gesamtparameter / aktiv pro Token (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Ling-3.0-flash-VL: 124B-Parameter Multimodal-MoE mit 256K Kontext in llama.cpp
ToolsLlama
Warum es zählt
Wenn der PR gemergt wird, können Nutzer das effiziente Ling-3.0-flash-VL lokal über llama.cpp mit Bild- und Video-Reasoning betreiben – bei nur 5,5B aktiven Parametern pro Token trotz 124B Gesamtkapazität.
— Lumeric Redaktion
124B / 5.5B aktiv
Gesamtparameter / aktiv pro Token (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.