Aider — Juli 2026
3 Beiträge im Juli 2026.
- MEINUNG25. JuliCommunity-Diskussion: Optimale LLM-Nutzung auf 2× RTX 3090 mit 48 GB VRAMFür AI-Builder mit Consumer-GPU-Setups relevant: Die Diskussion beleuchtet praktische Abwägungen zwischen vLLM, Ollama und llama.cpp sowie GGUF/AWQ/GPTQ/FP8-Quantisierung für 48 GB VRAM – ein realistisches Hobbyist- und Home-Lab-Szenario.
- MEINUNG06. JuliCommunity-Idee: Kleine Open-Source-Modelle für Workflow-Verifikation kollaborativ trainierenDer Vorschlag ist bislang ein unausgearbeitetes Brainstorming ohne konkretes Projekt oder Team. Für AI-Builder interessant als Ansatz, spezialisierte kleine Critic- und Tracing-Modelle community-getrieben zu erstellen – konkrete Umsetzung steht aber noch aus.
- LAUNCH02. Julijarvis-code: Terminal-Agent übersteht 10.000 Turns mit 2.000-Token-SpeicherDer Ansatz hält den gespeicherten Zustand konstant bei ~2.000 Token – unabhängig von der Sessionlänge – und vermeidet so exponentiell steigende Token-Kosten pro Turn. Entwickler, die lange Coding-Sessions ohne /clear oder /compact benötigen, können das Tool mit Claude, ChatGPT oder lokalen Modellen via llama.cpp/Ollama nutzen.