Xiaomi öffnet MiMo-V2.5-Pro: 1,02T-Parameter-Modell unter MIT-Lizenz
Xiaomi hat MiMo-V2.5-Pro als Open-Source-Modell unter MIT-Lizenz freigegeben. Das Modell nutzt eine Mixture-of-Experts-Architektur mit 1,02 Billionen Gesamtparametern, von denen 42 Milliarden pro Inferenzschritt aktiv sind. Der Kontextfenster beträgt 1 Million Token. Ein Reddit-Nutzer hat das Modell über 125 autonome Coding-Sessions via API genutzt und dabei ein vollständiges SaaS-Produkt aus einem leeren Repository entwickelt – inklusive Stripe-Integration, Serverless-Endpunkten, SEO und über 60 Seiten Content, mit 301 Commits vollständig autonom. Die Gesamtkosten beliefen sich auf $70,12 für 387 Millionen Token, was einer durchschnittlichen Cache-Hit-Rate von 96,3% entspricht. Im Preisvergleich liegt MiMo-V2.5-Pro mit $1,00/M Input-Token weit unter Claude Opus 4 ($15,00/M) und GPT-5 ($2,50/M). Der Self-Hosting-Pfad ist trotz offener Gewichte für die meisten Entwickler unrealistisch: FP8-quantisiert belegen die Gewichte rund 1 TB, als Mindestinfrastruktur werden 4× A100 80GB genannt – Hardware im Wert von $15.000–20.000 oder $6/Stunde auf Cloud-GPU-Mietbasis.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- BENCHMARKreddit.com3w
Kimi K3 (2,8T Parameter) auf 8× B300: 92 tok/s für $190 pro Mio. Token
- MEINUNGreddit.com3w
Mac Studio M5 Max vs. Cloud-APIs: Kostenvergleich für lokale Inferenz
- MEINUNGreddit.com0mo
Qwen3.8-27B lokal: 131M Tokens, null Ausfälle, 650 $ API-Kosten gespart
- MEINUNGreddit.com2w
Chinesische LLMs nähern sich Anthropics Spitzenmodell Opus 4.8
Xiaomi öffnet MiMo-V2.5-Pro: 1,02T-Parameter-Modell unter MIT-Lizenz
Xiaomi hat MiMo-V2.5-Pro als Open-Source-Modell unter MIT-Lizenz freigegeben. Das Modell nutzt eine Mixture-of-Experts-Architektur mit 1,02 Billionen Gesamtparametern, von denen 42 Milliarden pro Inferenzschritt aktiv sind. Der Kontextfenster beträgt 1 Million Token. Ein Reddit-Nutzer hat das Modell über 125 autonome Coding-Sessions via API genutzt und dabei ein vollständiges SaaS-Produkt aus einem leeren Repository entwickelt – inklusive Stripe-Integration, Serverless-Endpunkten, SEO und über 60 Seiten Content, mit 301 Commits vollständig autonom. Die Gesamtkosten beliefen sich auf $70,12 für 387 Millionen Token, was einer durchschnittlichen Cache-Hit-Rate von 96,3% entspricht. Im Preisvergleich liegt MiMo-V2.5-Pro mit $1,00/M Input-Token weit unter Claude Opus 4 ($15,00/M) und GPT-5 ($2,50/M). Der Self-Hosting-Pfad ist trotz offener Gewichte für die meisten Entwickler unrealistisch: FP8-quantisiert belegen die Gewichte rund 1 TB, als Mindestinfrastruktur werden 4× A100 80GB genannt – Hardware im Wert von $15.000–20.000 oder $6/Stunde auf Cloud-GPU-Mietbasis.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- BENCHMARKreddit.com3w
Kimi K3 (2,8T Parameter) auf 8× B300: 92 tok/s für $190 pro Mio. Token
- MEINUNGreddit.com3w
Mac Studio M5 Max vs. Cloud-APIs: Kostenvergleich für lokale Inferenz
- MEINUNGreddit.com0mo
Qwen3.8-27B lokal: 131M Tokens, null Ausfälle, 650 $ API-Kosten gespart
- MEINUNGreddit.com2w
Chinesische LLMs nähern sich Anthropics Spitzenmodell Opus 4.8