Splish: Splash-Fork für M5 Max mit bis zu 1,5× höherem Durchsatz
CompaniesDeepSeek
Warum es zählt
Wer 4-Bit-Modelle auf einem 40-Core M5 Max betreibt, kann mit Splish Token-Raten von ~56–64 tok/s statt 45–51 tok/s erreichen – ohne Qualitätseinbußen. Besonders Coding-Agents profitieren durch einen kopierten Rewrite-Pfad (+24–42% bei ganzen Datei-Edits).
— Lumeric Redaktion
Splash vs. Splish (tok/s, 40-core M5 Max, 4-bit) · Spitzenwert
74.7%
Splash 1.1.0 (Single Request)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
Inco Splash: Open-Source-Inferenz-Engine für Apple Silicon mit 3× Ollama-Speed
- LAUNCHreddit.com1d
Splash: Kernel-Tuning bringt +20 % Decode-Speed auf 40-Core M5 Max
- LAUNCHreddit.com14h
Splash 1.1.0: GGUF-Quants und MLX-Import für lokale Inferenz auf Apple Silicon
- BENCHMARKreddit.com1d
M5 Ultra: Prefill-Step auf 8192 verdoppelt LLM-Durchsatz
Splish: Splash-Fork für M5 Max mit bis zu 1,5× höherem Durchsatz
CompaniesDeepSeek
Warum es zählt
Wer 4-Bit-Modelle auf einem 40-Core M5 Max betreibt, kann mit Splish Token-Raten von ~56–64 tok/s statt 45–51 tok/s erreichen – ohne Qualitätseinbußen. Besonders Coding-Agents profitieren durch einen kopierten Rewrite-Pfad (+24–42% bei ganzen Datei-Edits).
— Lumeric Redaktion
Splash vs. Splish (tok/s, 40-core M5 Max, 4-bit) · Spitzenwert
74.7%
Splash 1.1.0 (Single Request)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
Inco Splash: Open-Source-Inferenz-Engine für Apple Silicon mit 3× Ollama-Speed
- LAUNCHreddit.com1d
Splash: Kernel-Tuning bringt +20 % Decode-Speed auf 40-Core M5 Max
- LAUNCHreddit.com14h
Splash 1.1.0: GGUF-Quants und MLX-Import für lokale Inferenz auf Apple Silicon
- BENCHMARKreddit.com1d
M5 Ultra: Prefill-Step auf 8192 verdoppelt LLM-Durchsatz