Ling 3.0 Modelle in llama.cpp integriert
Mit dem Merge von Pull Request #26608 in das ggml-org/llama.cpp-Repository ist die offizielle Unterstützung für die Ling-3.0-Modellfamilie von inclusionAI in das populäre Inference-Framework integriert worden. Die Familie umfasst zwei Varianten: Ling Tiny mit einer 8B/1B-Konfiguration und Ling Flash mit einer 124B/5B-Konfiguration – wobei die Zahlenpaare vermutlich auf aktivierte bzw. Gesamtparameter eines Mixture-of-Experts-Ansatzes hindeuten. Beide Modelle sind explizit als Reasoning-Modelle konzipiert, was einen Bruch mit der bisherigen Namenskonvention früherer Ling-Versionen darstellt. Die Modellgewichte sind über HuggingFace unter den Repos inclusionAI/Ling-3.0-tiny bzw. inclusionAI/Ling-3.0-flash öffentlich abrufbar. Durch die llama.cpp-Integration können die Modelle nun lokal quantisiert und auf Consumer-Hardware betrieben werden, ohne Cloud-Abhängigkeit. inclusionAI ist ein auf KI-Inklusion ausgerichtetes Forschungsprojekt, dessen Ling-Reihe auf mehrsprachige und reasoning-orientierte Anwendungsfälle zielt. Der Beitrag wurde heute, am 17. August 2026, von Reddit-Nutzer parepeg in r/LocalLLaMA geteilt.
- Ling Tiny: 8B/1B-Parameterkonfiguration – verfügbar unter inclusionAI/Ling-3.0-tiny auf HuggingFace.
- Ling Flash: 124B/5B-Parameterkonfiguration – verfügbar unter inclusionAI/Ling-3.0-flash auf HuggingFace.
- Beide Modelle sind als Reasoning-Modelle ausgelegt – abweichend von der Ausrichtung früherer Ling-Versionen.
- Der Support wurde via Pull Request #26608 im ggml-org/llama.cpp-Repository gemergt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com3w
inclusionAI veröffentlicht Ling 3.0 Flash und Tiny als Open Base Models
- LAUNCHreddit.com3w
AntLing veröffentlicht Dspark-Draft-Modell für Ling-3.0-flash
- BENCHMARKreddit.com0mo
Ling-3.0 (BailingMoE3) offiziell in llama.cpp – Benchmarks auf Intel Arc B580
- LAUNCHreddit.com2w
llama.cpp-Support für Qwen3.8-Flash-Next gemergt
Ling 3.0 Modelle in llama.cpp integriert
Mit dem Merge von Pull Request #26608 in das ggml-org/llama.cpp-Repository ist die offizielle Unterstützung für die Ling-3.0-Modellfamilie von inclusionAI in das populäre Inference-Framework integriert worden. Die Familie umfasst zwei Varianten: Ling Tiny mit einer 8B/1B-Konfiguration und Ling Flash mit einer 124B/5B-Konfiguration – wobei die Zahlenpaare vermutlich auf aktivierte bzw. Gesamtparameter eines Mixture-of-Experts-Ansatzes hindeuten. Beide Modelle sind explizit als Reasoning-Modelle konzipiert, was einen Bruch mit der bisherigen Namenskonvention früherer Ling-Versionen darstellt. Die Modellgewichte sind über HuggingFace unter den Repos inclusionAI/Ling-3.0-tiny bzw. inclusionAI/Ling-3.0-flash öffentlich abrufbar. Durch die llama.cpp-Integration können die Modelle nun lokal quantisiert und auf Consumer-Hardware betrieben werden, ohne Cloud-Abhängigkeit. inclusionAI ist ein auf KI-Inklusion ausgerichtetes Forschungsprojekt, dessen Ling-Reihe auf mehrsprachige und reasoning-orientierte Anwendungsfälle zielt. Der Beitrag wurde heute, am 17. August 2026, von Reddit-Nutzer parepeg in r/LocalLLaMA geteilt.
- Ling Tiny: 8B/1B-Parameterkonfiguration – verfügbar unter inclusionAI/Ling-3.0-tiny auf HuggingFace.
- Ling Flash: 124B/5B-Parameterkonfiguration – verfügbar unter inclusionAI/Ling-3.0-flash auf HuggingFace.
- Beide Modelle sind als Reasoning-Modelle ausgelegt – abweichend von der Ausrichtung früherer Ling-Versionen.
- Der Support wurde via Pull Request #26608 im ggml-org/llama.cpp-Repository gemergt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com3w
inclusionAI veröffentlicht Ling 3.0 Flash und Tiny als Open Base Models
- LAUNCHreddit.com3w
AntLing veröffentlicht Dspark-Draft-Modell für Ling-3.0-flash
- BENCHMARKreddit.com0mo
Ling-3.0 (BailingMoE3) offiziell in llama.cpp – Benchmarks auf Intel Arc B580
- LAUNCHreddit.com2w
llama.cpp-Support für Qwen3.8-Flash-Next gemergt