Community-Entwickler veröffentlicht Shibai-700M-Base auf Hugging Face
CompaniesHugging Face
Warum es zählt
Kontinuierliches Vortraining auf weiteren 5B Token reinen Python-Docstrings ist geplant. Für Entwickler interessant als leichtgewichtige Python-Code-Completion-Basis, jedoch ohne Chat-Finetuning aktuell nur als Base-Modell nutzbar.
— Lumeric Redaktion
700M Parameter / 18B Token
Modellgröße und Trainingsumfang
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com23h
Aurora 1.0-150M: Kleines Open-Source-Sprachmodell auf GPT-2-Small-Niveau
- MEINUNGreddit.com21h
Community sucht kleine Sprachmodelle unter 9B mit N-Gram-Training
- FORSCHUNGarxiv.org4d
Climate-ModernBERT: Domänenadaptiertes Encoder-Modell für Klimatexte
- FORSCHUNGarxiv.org1w
Low-Rank Clone: SLM-Training mit 1.000-facher Token-Effizienz
Community-Entwickler veröffentlicht Shibai-700M-Base auf Hugging Face
CompaniesHugging Face
Warum es zählt
Kontinuierliches Vortraining auf weiteren 5B Token reinen Python-Docstrings ist geplant. Für Entwickler interessant als leichtgewichtige Python-Code-Completion-Basis, jedoch ohne Chat-Finetuning aktuell nur als Base-Modell nutzbar.
— Lumeric Redaktion
700M Parameter / 18B Token
Modellgröße und Trainingsumfang
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com23h
Aurora 1.0-150M: Kleines Open-Source-Sprachmodell auf GPT-2-Small-Niveau
- MEINUNGreddit.com21h
Community sucht kleine Sprachmodelle unter 9B mit N-Gram-Training
- FORSCHUNGarxiv.org4d
Climate-ModernBERT: Domänenadaptiertes Encoder-Modell für Klimatexte
- FORSCHUNGarxiv.org1w
Low-Rank Clone: SLM-Training mit 1.000-facher Token-Effizienz