IFM veröffentlicht K2-Horizon-MoVA-36B-A4B: MoE-Modell mit 512K Kontext
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Mit 4B aktiven Parametern bei 36B Gesamtgröße ermöglicht das Modell effiziente lokale Inferenz bei hoher Leistung. Trainingsdaten, Rezept und Code sollen vollständig veröffentlicht werden – relevant für Teams, die eigene MoE-Modelle trainieren oder fine-tunen wollen.
— Lumeric Redaktion
512K Token Kontext
Nativer Kontextumfang ab Midtraining
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com2d
Community diskutiert Einsatzfälle für K2-Horizon-MoVA-36B-A4B
- LAUNCHreddit.com2w
Tencent veröffentlicht Hy4-preview mit 770B Parametern (49B aktiv)
- LAUNCHreddit.com5d
inclusionAI veröffentlicht Ling-3.0-flash-VL: 124B MoE-Modell mit 1M-Token-Kontext
- FORSCHUNGarxiv.org1w
A.X K2: 688B-Parameter MoE-Modell mit Sparse Gated Attention und 256K Kontext
IFM veröffentlicht K2-Horizon-MoVA-36B-A4B: MoE-Modell mit 512K Kontext
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Mit 4B aktiven Parametern bei 36B Gesamtgröße ermöglicht das Modell effiziente lokale Inferenz bei hoher Leistung. Trainingsdaten, Rezept und Code sollen vollständig veröffentlicht werden – relevant für Teams, die eigene MoE-Modelle trainieren oder fine-tunen wollen.
— Lumeric Redaktion
512K Token Kontext
Nativer Kontextumfang ab Midtraining
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com2d
Community diskutiert Einsatzfälle für K2-Horizon-MoVA-36B-A4B
- LAUNCHreddit.com2w
Tencent veröffentlicht Hy4-preview mit 770B Parametern (49B aktiv)
- LAUNCHreddit.com5d
inclusionAI veröffentlicht Ling-3.0-flash-VL: 124B MoE-Modell mit 1M-Token-Kontext
- FORSCHUNGarxiv.org1w
A.X K2: 688B-Parameter MoE-Modell mit Sparse Gated Attention und 256K Kontext