wird geladen
Qwen3.8 27B: Embeddings halbieren Token-Generierungsgeschwindigkeit in llama.cpp · Lumeric