Thinkingmachines veröffentlicht Inkling-Small: 276B MoE-Modell mit 1M-Kontext
CompaniesHugging Face
Warum es zählt
Das Modell kombiniert einen sehr langen Kontextfenster (1M Token) mit geringem Aktivierungsaufwand (12B aktive Parameter), was lokales Deployment auf Consumer-Hardware potenziell erleichtert. GGUF-Versionen via Unsloth ermöglichen direkten Einsatz mit llama.cpp.
— Lumeric Redaktion
276B / 12B aktiv
Gesamtparameter / aktive Parameter (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
IFM veröffentlicht K2-Horizon-MoVA-36B-A4B: MoE-Modell mit 512K Kontext
- LAUNCHreddit.com1w
inclusionAI veröffentlicht Ling-3.0-flash-VL: 124B MoE-Modell mit 1M-Token-Kontext
- MEINUNGreddit.com0mo
Ling 3.0 Tiny 8B: 36 Token/s auf Low-End-PC mit nur 4 GB VRAM
- LAUNCHreddit.com3w
Meta veröffentlicht MobileMoE: MoE-Sprachmodelle unter 3 GB für mobile Geräte
Thinkingmachines veröffentlicht Inkling-Small: 276B MoE-Modell mit 1M-Kontext
CompaniesHugging Face
Warum es zählt
Das Modell kombiniert einen sehr langen Kontextfenster (1M Token) mit geringem Aktivierungsaufwand (12B aktive Parameter), was lokales Deployment auf Consumer-Hardware potenziell erleichtert. GGUF-Versionen via Unsloth ermöglichen direkten Einsatz mit llama.cpp.
— Lumeric Redaktion
276B / 12B aktiv
Gesamtparameter / aktive Parameter (MoE)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
IFM veröffentlicht K2-Horizon-MoVA-36B-A4B: MoE-Modell mit 512K Kontext
- LAUNCHreddit.com1w
inclusionAI veröffentlicht Ling-3.0-flash-VL: 124B MoE-Modell mit 1M-Token-Kontext
- MEINUNGreddit.com0mo
Ling 3.0 Tiny 8B: 36 Token/s auf Low-End-PC mit nur 4 GB VRAM
- LAUNCHreddit.com3w
Meta veröffentlicht MobileMoE: MoE-Sprachmodelle unter 3 GB für mobile Geräte