DeepSeek v4.1 Flash auf Apple M3 Ultra: Praxisbericht mit Agentic Workflow
CompaniesDeepSeek
Warum es zählt
DeepSeek v4.1 Flash hält 16 t/s Decode bis ~110k Tokens auf dem M3 Ultra stabiler als llama.cpp, zeigt aber weiterhin Schwächen bei autonomer Tool-Auswahl in Agentic-Workflows. GLM 5.3 Flash liefert mit ~21–19 t/s bei q2 vergleichbar schneller Decode-Rate.
— Lumeric Redaktion
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
DeepSeek v4.1 Flash auf Apple M3 Ultra: Praxisbericht mit Agentic Workflow
CompaniesDeepSeek
Warum es zählt
DeepSeek v4.1 Flash hält 16 t/s Decode bis ~110k Tokens auf dem M3 Ultra stabiler als llama.cpp, zeigt aber weiterhin Schwächen bei autonomer Tool-Auswahl in Agentic-Workflows. GLM 5.3 Flash liefert mit ~21–19 t/s bei q2 vergleichbar schneller Decode-Rate.
— Lumeric Redaktion
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.