MacroStories: 20K-Parameter-Sprachmodell schreibt kohärente Kurzgeschichten
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Das Modell läuft extrem schnell auf CPU ohne GPU-Bedarf und ist ~50× kleiner als TinyStories-1M. Es zeigt, wie weit die Untergrenze kohärenter Textgenerierung durch Gewichts-Sharing und minimale Architektur gedrückt werden kann – relevant für Edge-Deployments.
— Lumeric Redaktion
19.969 Parameter / 81 KB
Modellgröße FP32 (MacroStories)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org3w
Looped GPT-BERT: 12,18M-Parameter-Modell durch Schicht-Wiederholung
- MEINUNGreddit.com1w
50-MB-Modell ersetzt Gemini Flash: 0,06s Inferenz auf CPU
- FORSCHUNGarxiv.org2w
GrainSpeech: 264,8K-Parameter-Modell erreicht 17,9× Echtzeit-TTS auf Microcontroller
- FORSCHUNGarxiv.org3w
Byte-Modelle übertreffen Token-Modelle bei hohem Compute durch Distillation
MacroStories: 20K-Parameter-Sprachmodell schreibt kohärente Kurzgeschichten
ToolsHugging Face
CompaniesHugging Face
Warum es zählt
Das Modell läuft extrem schnell auf CPU ohne GPU-Bedarf und ist ~50× kleiner als TinyStories-1M. Es zeigt, wie weit die Untergrenze kohärenter Textgenerierung durch Gewichts-Sharing und minimale Architektur gedrückt werden kann – relevant für Edge-Deployments.
— Lumeric Redaktion
19.969 Parameter / 81 KB
Modellgröße FP32 (MacroStories)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org3w
Looped GPT-BERT: 12,18M-Parameter-Modell durch Schicht-Wiederholung
- MEINUNGreddit.com1w
50-MB-Modell ersetzt Gemini Flash: 0,06s Inferenz auf CPU
- FORSCHUNGarxiv.org2w
GrainSpeech: 264,8K-Parameter-Modell erreicht 17,9× Echtzeit-TTS auf Microcontroller
- FORSCHUNGarxiv.org3w
Byte-Modelle übertreffen Token-Modelle bei hohem Compute durch Distillation