Vellium v1.1.0: Open-Source-Desktop-App mit lokalem STT/TTS und Live-Voice
Vellium ist eine lokal-first Desktop-Anwendung für KI-Chat, Charakter-Roleplay und Langform-Schreiben, die auf macOS, Windows und Linux läuft. Mit Version 1.1.0 steht der Live-Voice-Modus im Mittelpunkt: Er kombiniert Mikrofon-Input, lokale Spracherkennung und Streaming-TTS in einer einheitlichen Oberfläche, die außerdem Dateianhänge und Screen-Context unterstützt. Als STT-Modell wird Whisper Large v3 Turbo in der Q5_0-Quantisierung angeboten, was auf Consumer-Hardware nutzbar ist. Für die Sprachsynthese kommt TeraTTSv2 zum Einsatz, das englische und russische Stimmen mit Echtzeit-Wiedergabe bereitstellt. Der TTS-Prozess bleibt zwischen Antworten aktiv, sodass kein vollständiger Model-Reload anfällt und die Latenz sinkt. Auf der Backend-Seite erkennt Vellium nun automatisch bestehende llama-server-Installationen, GGUF-Modelle und laufende lokale Endpunkte und bindet sie als verwaltetes Backend ein. Alle Nutzdaten — Chats, Charaktere, LoreBooks, Schreibprojekte und Wissenssammlungen — werden lokal in SQLite gespeichert; Anbindungen an OpenAI-kompatible APIs, OpenRouter, LM Studio, Ollama und KoboldCpp sind ebenfalls möglich.
- Whisper Large v3 Turbo Q5_0 ist das vorgesehene STT-Modell, das direkt in der App installiert und konfiguriert werden kann.
- TeraTTSv2 liefert englische und russische Stimmen; der TTS-Prozess bleibt persistent, um Model-Reloads zwischen Antworten zu vermeiden.
- llama.cpp-Auto-Detection: Vellium erkennt vorhandene llama-server-Instanzen, GGUF-Modelle und laufende Endpunkte automatisch.
- Sämtliche Daten (Chats, Charaktere, LoreBooks, Schreibprojekte, Wissenssammlungen) werden lokal in SQLite abgelegt — keine Cloud-Abhängigkeit.
- Kleinere Fixes in v1.1.0: zuverlässigeres TTS-Streaming, sicherere Laufzeit-Archiv-Extraktion, System-Zertifikatsunterstützung und verbesserte Timeout-Behandlung.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
Vellium v1.1.0: Open-Source-Desktop-App mit lokalem STT/TTS und Live-Voice
Vellium ist eine lokal-first Desktop-Anwendung für KI-Chat, Charakter-Roleplay und Langform-Schreiben, die auf macOS, Windows und Linux läuft. Mit Version 1.1.0 steht der Live-Voice-Modus im Mittelpunkt: Er kombiniert Mikrofon-Input, lokale Spracherkennung und Streaming-TTS in einer einheitlichen Oberfläche, die außerdem Dateianhänge und Screen-Context unterstützt. Als STT-Modell wird Whisper Large v3 Turbo in der Q5_0-Quantisierung angeboten, was auf Consumer-Hardware nutzbar ist. Für die Sprachsynthese kommt TeraTTSv2 zum Einsatz, das englische und russische Stimmen mit Echtzeit-Wiedergabe bereitstellt. Der TTS-Prozess bleibt zwischen Antworten aktiv, sodass kein vollständiger Model-Reload anfällt und die Latenz sinkt. Auf der Backend-Seite erkennt Vellium nun automatisch bestehende llama-server-Installationen, GGUF-Modelle und laufende lokale Endpunkte und bindet sie als verwaltetes Backend ein. Alle Nutzdaten — Chats, Charaktere, LoreBooks, Schreibprojekte und Wissenssammlungen — werden lokal in SQLite gespeichert; Anbindungen an OpenAI-kompatible APIs, OpenRouter, LM Studio, Ollama und KoboldCpp sind ebenfalls möglich.
- Whisper Large v3 Turbo Q5_0 ist das vorgesehene STT-Modell, das direkt in der App installiert und konfiguriert werden kann.
- TeraTTSv2 liefert englische und russische Stimmen; der TTS-Prozess bleibt persistent, um Model-Reloads zwischen Antworten zu vermeiden.
- llama.cpp-Auto-Detection: Vellium erkennt vorhandene llama-server-Instanzen, GGUF-Modelle und laufende Endpunkte automatisch.
- Sämtliche Daten (Chats, Charaktere, LoreBooks, Schreibprojekte, Wissenssammlungen) werden lokal in SQLite abgelegt — keine Cloud-Abhängigkeit.
- Kleinere Fixes in v1.1.0: zuverlässigeres TTS-Streaming, sicherere Laufzeit-Archiv-Extraktion, System-Zertifikatsunterstützung und verbesserte Timeout-Behandlung.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.