LocalMind: Gemma 4 26B und Qwen3.6 35B-MoE laufen direkt im Browser-Tab
Warum es zählt
Modelle, die den VRAM/RAM einer Maschine überschreiten, können künftig serverlos und ohne Installation direkt im Browser ausgeführt werden. Der Output ist bei greedy Decoding nahezu identisch mit llama.cpp, allerdings ca. 3× langsamer – für Privacy-First-Anwendungen ohne Backend ein relevanter Ansatz.
— Lumeric Redaktion
Decode-Geschwindigkeit (tok/s) im Browser vs. nativ · Spitzenwert
23.6%
Gemma 4 26B – LocalMind (Browser)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
LocalMind: Gemma 4 26B und Qwen3.6 35B-MoE laufen direkt im Browser-Tab
Warum es zählt
Modelle, die den VRAM/RAM einer Maschine überschreiten, können künftig serverlos und ohne Installation direkt im Browser ausgeführt werden. Der Output ist bei greedy Decoding nahezu identisch mit llama.cpp, allerdings ca. 3× langsamer – für Privacy-First-Anwendungen ohne Backend ein relevanter Ansatz.
— Lumeric Redaktion
Decode-Geschwindigkeit (tok/s) im Browser vs. nativ · Spitzenwert
23.6%
Gemma 4 26B – LocalMind (Browser)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.