Thinkingmachines veröffentlicht Inkling-Small: 276B MoE-Modell mit 1M-Kontext
CompaniesHugging Face
Warum es zählt
Das Modell kombiniert einen sehr langen Kontextfenster (1M Token) mit geringem Aktivierungsaufwand (12B aktive Parameter), was lokales Deployment auf Consumer-Hardware potenziell erleichtert. GGUF-Versionen via Unsloth ermöglichen direkten Einsatz mit llama.cpp.
— Lumeric Redaktion
276B / 12B aktiv
Gesamtparameter / aktive Parameter (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Thinkingmachines veröffentlicht Inkling-Small: 276B MoE-Modell mit 1M-Kontext
CompaniesHugging Face
Warum es zählt
Das Modell kombiniert einen sehr langen Kontextfenster (1M Token) mit geringem Aktivierungsaufwand (12B aktive Parameter), was lokales Deployment auf Consumer-Hardware potenziell erleichtert. GGUF-Versionen via Unsloth ermöglichen direkten Einsatz mit llama.cpp.
— Lumeric Redaktion
276B / 12B aktiv
Gesamtparameter / aktive Parameter (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.