Luth-2: Neue State-of-the-Art French Small Language Models auf Qwen3.5-Basis
CompaniesHugging Face
Warum es zählt
Für Teams mit französischsprachigen Anwendungsfällen bieten diese Modelle SOTA-Qualität bei sehr geringem Ressourcenbedarf – lokal lauffähig als GGUF. Die Ergebnisse zeigen, dass spezialisiertes Post-Training multilinguale SLMs außerhalb des Englischen deutlich verbessern kann.
— Lumeric Redaktion
MGSM-Rev2 (Französisch) · Spitzenwert
72.92%
Luth-2-0.8B
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
Community-Modell: 3,7B Reasoning MoE auf einer einzigen RTX 4090 trainiert
- LAUNCHarxiv.org0mo
Jais 2: Arabisch-zentrierte Open-LLM-Familie mit 8B und 70B Parametern
- FORSCHUNGarxiv.org1d
Feedforward-Graph aus gefrorenen LLMs erreicht 87,3 % auf ARC-Challenge
- LAUNCHreddit.com1w
Neue Eigenarchitektur: Spark-X2.5 in 1,7B und 4B veröffentlicht
Luth-2: Neue State-of-the-Art French Small Language Models auf Qwen3.5-Basis
CompaniesHugging Face
Warum es zählt
Für Teams mit französischsprachigen Anwendungsfällen bieten diese Modelle SOTA-Qualität bei sehr geringem Ressourcenbedarf – lokal lauffähig als GGUF. Die Ergebnisse zeigen, dass spezialisiertes Post-Training multilinguale SLMs außerhalb des Englischen deutlich verbessern kann.
— Lumeric Redaktion
MGSM-Rev2 (Französisch) · Spitzenwert
72.92%
Luth-2-0.8B
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
Community-Modell: 3,7B Reasoning MoE auf einer einzigen RTX 4090 trainiert
- LAUNCHarxiv.org0mo
Jais 2: Arabisch-zentrierte Open-LLM-Familie mit 8B und 70B Parametern
- FORSCHUNGarxiv.org1d
Feedforward-Graph aus gefrorenen LLMs erreicht 87,3 % auf ARC-Challenge
- LAUNCHreddit.com1w
Neue Eigenarchitektur: Spark-X2.5 in 1,7B und 4B veröffentlicht