llama.cpp erhält Support für poolside Laguna XS.2 und M.1 MoE-Modelle
CompaniesHugging Face
Warum es zählt
Laguna XS.2 läuft dank Sliding Window Attention mit per-head Gating in 30/40 Layern besonders schnell und mit kleinem KV-Cache lokal – sobald der PR gemergt ist, können llama.cpp-Nutzer beide Modelle direkt einsetzen.
— Lumeric Redaktion
33B / 225B Parameter (MoE)
Laguna XS.2 bzw. M.1 Gesamtparameter
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
llama.cpp erhält Hy3-Support mit MTP Speculative Decoding
- LAUNCHreddit.com17h
poolside veröffentlicht Laguna-S-2.1 als 120B Open-Weight-Modell
- LAUNCHreddit.com0mo
llama.cpp ergänzt granite-speech-4.1-2b, LFM2.5-Modelle und Vulkan-Verbesserungen
- LAUNCHreddit.com1w
llama.cpp: SYCL/Intel-Backend erhält Flash Attention und Performance-Fixes
llama.cpp erhält Support für poolside Laguna XS.2 und M.1 MoE-Modelle
CompaniesHugging Face
Warum es zählt
Laguna XS.2 läuft dank Sliding Window Attention mit per-head Gating in 30/40 Layern besonders schnell und mit kleinem KV-Cache lokal – sobald der PR gemergt ist, können llama.cpp-Nutzer beide Modelle direkt einsetzen.
— Lumeric Redaktion
33B / 225B Parameter (MoE)
Laguna XS.2 bzw. M.1 Gesamtparameter
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com1w
llama.cpp erhält Hy3-Support mit MTP Speculative Decoding
- LAUNCHreddit.com17h
poolside veröffentlicht Laguna-S-2.1 als 120B Open-Weight-Modell
- LAUNCHreddit.com0mo
llama.cpp ergänzt granite-speech-4.1-2b, LFM2.5-Modelle und Vulkan-Verbesserungen
- LAUNCHreddit.com1w
llama.cpp: SYCL/Intel-Backend erhält Flash Attention und Performance-Fixes