Kimi K3 IQ2-XXS Quant: Modellgröße von 711 GB auf 478 GB reduziert
Warum es zählt
Der Ansatz, sprachspezifische Gewichte gezielt zu entfernen statt nur zu quantisieren, könnte auf andere große MoE-Modelle wie DeepSeek V4 Flash übertragen werden und deren lokale Ausführbarkeit deutlich verbessern.
— Lumeric Redaktion
478 GB
Modellgröße nach Multilingual-Trimming
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Kimi K3 IQ2-XXS Quant: Modellgröße von 711 GB auf 478 GB reduziert
Warum es zählt
Der Ansatz, sprachspezifische Gewichte gezielt zu entfernen statt nur zu quantisieren, könnte auf andere große MoE-Modelle wie DeepSeek V4 Flash übertragen werden und deren lokale Ausführbarkeit deutlich verbessern.
— Lumeric Redaktion
478 GB
Modellgröße nach Multilingual-Trimming
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.