wird geladen
llama.cpp ergänzt --n-cpu-ffn Option für dichte Modelle auf Low-VRAM-Hardware · Lumeric