BetterGPT-150M: Kompaktes 152M-Parameter-Modell auf 15B Tokens trainiert
CompaniesHugging Face
Warum es zählt
Für Edge- und CPU-Inferenz-Szenarien bietet das Modell einen sehr geringen RAM-Footprint bei vertretbarer Leistung. Gewichte und eine Live-Demo auf HuggingFace sind frei verfügbar, Instruction-Finetuning ist noch nicht enthalten.
— Lumeric Redaktion
152M Parameter / 15B Tokens
Modellgröße und Trainingsumfang
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
BetterGPT-150M: Kompaktes 152M-Parameter-Modell auf 15B Tokens trainiert
CompaniesHugging Face
Warum es zählt
Für Edge- und CPU-Inferenz-Szenarien bietet das Modell einen sehr geringen RAM-Footprint bei vertretbarer Leistung. Gewichte und eine Live-Demo auf HuggingFace sind frei verfügbar, Instruction-Finetuning ist noch nicht enthalten.
— Lumeric Redaktion
152M Parameter / 15B Tokens
Modellgröße und Trainingsumfang
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.