Swift-Qwen3.8-27B-Genesis-GGUF: Vision-Modell unter 17 GB VRAM mit 262k Kontext
Warum es zählt
Das Modell ermöglicht es, einen 27B-Multimodal-Agenten mit vollem 262k-Kontext auf 32 GB VRAM zu betreiben – bisher erforderten nvfp4-Varianten mehr VRAM oder mussten den Kontext auf 160k kürzen. Tradeoffs sind noch ungeklärt.
— Lumeric Redaktion
76 t/s
Inferenz-Speed bei 262k Kontext (llama.cpp)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Swift-Qwen3.8-27B-Genesis-GGUF: Vision-Modell unter 17 GB VRAM mit 262k Kontext
Warum es zählt
Das Modell ermöglicht es, einen 27B-Multimodal-Agenten mit vollem 262k-Kontext auf 32 GB VRAM zu betreiben – bisher erforderten nvfp4-Varianten mehr VRAM oder mussten den Kontext auf 160k kürzen. Tradeoffs sind noch ungeklärt.
— Lumeric Redaktion
76 t/s
Inferenz-Speed bei 262k Kontext (llama.cpp)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.