SupraLabs veröffentlicht Supra2-Medium-Base: 25M-Parameter-Modell konkurriert mit 50M-Vorgänger
CompaniesHugging Face
Warum es zählt
Das Modell zeigt, dass tiny LLMs mit halber Parameterzahl kompetitive Benchmark-Ergebnisse erzielen können – relevant für Edge- und On-Device-Deployments. Nur Base-Modell; eine Instruction-tuned-Version ist in Planung.
— Lumeric Redaktion
25M Parameter
Modellgröße, konkurriert mit 50M-Vorgänger
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
SupraGDN-5M: Winziges GatedDeltaNet-Modell mit nur 2B Trainings-Tokens released
- LAUNCHreddit.com1d
Aurora 1.0-150M: Kleines Open-Source-Sprachmodell auf GPT-2-Small-Niveau
- LAUNCHreddit.com1w
Neue Eigenarchitektur: Spark-X2.5 in 1,7B und 4B veröffentlicht
- MEINUNGreddit.com3w
Community diskutiert: Ist Ling 3 Tiny besser als Qwen3.5 9B?
SupraLabs veröffentlicht Supra2-Medium-Base: 25M-Parameter-Modell konkurriert mit 50M-Vorgänger
CompaniesHugging Face
Warum es zählt
Das Modell zeigt, dass tiny LLMs mit halber Parameterzahl kompetitive Benchmark-Ergebnisse erzielen können – relevant für Edge- und On-Device-Deployments. Nur Base-Modell; eine Instruction-tuned-Version ist in Planung.
— Lumeric Redaktion
25M Parameter
Modellgröße, konkurriert mit 50M-Vorgänger
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
SupraGDN-5M: Winziges GatedDeltaNet-Modell mit nur 2B Trainings-Tokens released
- LAUNCHreddit.com1d
Aurora 1.0-150M: Kleines Open-Source-Sprachmodell auf GPT-2-Small-Niveau
- LAUNCHreddit.com1w
Neue Eigenarchitektur: Spark-X2.5 in 1,7B und 4B veröffentlicht
- MEINUNGreddit.com3w
Community diskutiert: Ist Ling 3 Tiny besser als Qwen3.5 9B?