Mimo2.6-Flash auf Apple M5 Ultra: erste Inferenz-Benchmarks mit mlx-vlm
ToolsQwen
Warum es zählt
Mimo2.6-Flash läuft auf Apple Silicon noch ohne offizielle Unterstützung und erfordert manuelle MLX-Patches. Die Generation-TPS (~49 bei 32k, ~38 bei 64k Kontext) liegen deutlich unter den Werten von Qwen3.8-Flash-Next (~44 TPS), was auf fehlendes MTP und fehlende Framework-Optimierungen hindeutet.
— Lumeric Redaktion
MLX Inferenz-Durchsatz (Generation TPS, 64k Prompt) · Spitzenwert
38.1%
Mimo2.6-Flash (mlx-vlm, 64k ctx)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Mimo2.6-Flash auf Apple M5 Ultra: erste Inferenz-Benchmarks mit mlx-vlm
ToolsQwen
Warum es zählt
Mimo2.6-Flash läuft auf Apple Silicon noch ohne offizielle Unterstützung und erfordert manuelle MLX-Patches. Die Generation-TPS (~49 bei 32k, ~38 bei 64k Kontext) liegen deutlich unter den Werten von Qwen3.8-Flash-Next (~44 TPS), was auf fehlendes MTP und fehlende Framework-Optimierungen hindeutet.
— Lumeric Redaktion
MLX Inferenz-Durchsatz (Generation TPS, 64k Prompt) · Spitzenwert
38.1%
Mimo2.6-Flash (mlx-vlm, 64k ctx)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.