★ Begriff· Modell-Architektur
Mixture of Experts (MoE)
Architektur, bei der pro Token nur ein Subset der Modell-Parameter aktiv ist (z.B. 2 von 64 „Experten"). Halbiert Inferenz-Compute bei gleicher Total-Parameter-Zahl. Mistral Mixtral, DeepSeek-V3, Qwen3 nutzen MoE.
Verwandte Tools
Auch bekannt als
mixture of experts · mixture-of-experts · moe model · sparse moe
Aktivität
17
Mentions in den letzten 7 Tagen
4 Wochen
⚡neu · 17×
Zuletzt erwähnt in
- ExpertHTR: Unified HTR mit Multi-Task-Learning und Sparse Mixture-of-Experts2026-09-14
- Quality-Constrained Routing für quantisierte MoE-Modelle aus fixem Instanz-Pool2026-09-14
- DynaExq: Dynamische Mixed-Precision-Inferenz für MoE-Modelle auf Single-GPU2026-09-14
- Power Flexibility Index: Leistungselastizität von LLM-Training systematisch quantifiziert2026-09-12
- M3-Former: LLM-gestützter Transformer für Schiffstrajektion über 4 Stunden2026-09-11