Ling-3.0-tiny als MXFP4 MoE GGUF auf Hugging Face verfügbar
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Eine MXFP4-quantisierte MoE-Variante im kleinen Modellbereich kann lokal sehr hohe Token-Raten ermöglichen. Konkrete t/s-Werte liegen noch nicht vor – Nutzer werden gebeten, ihre Messergebnisse zu teilen.
— Lumeric Redaktion
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com0mo
Ling 3.0 Tiny 8B: 36 Token/s auf Low-End-PC mit nur 4 GB VRAM
- LAUNCHreddit.com2w
MTP-Unterstützung für Qwen3.8-Flash-Next-GGUF veröffentlicht
- LAUNCHreddit.com3w
MTP-Unterstützung für GLM-4.5-Air in llama.cpp verfügbar
- LAUNCHreddit.com5d
Apodex-1.1-mini als GGUF-Modell auf Hugging Face verfügbar
Ling-3.0-tiny als MXFP4 MoE GGUF auf Hugging Face verfügbar
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Eine MXFP4-quantisierte MoE-Variante im kleinen Modellbereich kann lokal sehr hohe Token-Raten ermöglichen. Konkrete t/s-Werte liegen noch nicht vor – Nutzer werden gebeten, ihre Messergebnisse zu teilen.
— Lumeric Redaktion
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com0mo
Ling 3.0 Tiny 8B: 36 Token/s auf Low-End-PC mit nur 4 GB VRAM
- LAUNCHreddit.com2w
MTP-Unterstützung für Qwen3.8-Flash-Next-GGUF veröffentlicht
- LAUNCHreddit.com3w
MTP-Unterstützung für GLM-4.5-Air in llama.cpp verfügbar
- LAUNCHreddit.com5d
Apodex-1.1-mini als GGUF-Modell auf Hugging Face verfügbar