Sentient OS: Proaktiver KI-Assistent mit lokalem LLM für macOS
Sentient OS wurde von dem Entwickler /u/TechExpert2910 gebaut, der bereits durch WritingTools bekannt ist – einem Open-Source-Port der Apple-Intelligence-Schreibwerkzeuge auf Windows. Das Projekt setzt auf einen vollständig lokalen Verarbeitungs-Stack auf Apple-Silicon-Macs (M1 oder neuer, macOS 15+, ab 8 GB RAM) und ist für Endverbraucher dauerhaft kostenlos. Das nächtliche Inferenz-Fenster um 3 Uhr morgens erforderte ein Reverse-Engineering des macOS-Powermanagements, damit ein zugeklappter Mac zuverlässig aufgeweckt werden kann. Für die Computer-Use-Funktionalität mit lokalen Modellen wurde außerdem das Codex-CLI von Grund auf reverse-engineered. Die 90/10-Aufteilung zwischen lokalem Gemma-4-E4B-Modell und einem optionalen Frontier-Modell ist architektonisch so gestaltet, dass das Cloud-Modell nur PII-bereinigte Zusammenfassungen erhält – Rohdaten verlassen das Gerät grundsätzlich nie. Als Frontier-Modelle empfiehlt der Entwickler aus eigenen Evals Kimi K3 für anspruchsvolle Computer-Use-Aufgaben; Qwen 3.7 35B A3B sei hingegen nur für sehr einfache Tasks geeignet. Neben direkten API-Endpunkten unterstützt Sentient OS auch LM Studio nativ als erste Wahl für den lokalen Frontier-Anteil.
- Systemvoraussetzungen: Apple Silicon (M1 oder neuer), macOS 15+, mindestens 8 GB RAM – Installation via Homebrew (`brew install --cask sentient-os-labs/tap/sentient-os`).
- Der LiteRT-LM-Fork wurde vom Team angepasst und um MTP/Speculative Decoding, Flash Attention sowie smartes KV-Cache-Reuse erweitert.
- WhatsApp, iMessage und Apple Notes werden direkt aus den lokalen macOS-Datenbanken ausgelesen – ohne Umweg über Cloud-APIs.
- Sidekick-Funktion: Klick auf das Mac-Notch + Spracheingabe löst Computer-Use-Aktionen aus, die auch im Hintergrund laufen können, während der Nutzer den Rechner weiterverwendet.
- Frontier-Modell-Optionen umfassen neben eigenen Endpunkten auch ChatGPT/Codex-Abonnements, OpenRouter und nativen LM-Studio-Support.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com2w
Agro: Open-Source On-Device Agent-Client für 4B-Modelle auf Mobile & Desktop
- MEINUNGreddit.com6d
Community-Diskussion: Sinnvolle Anwendungsfälle für lokale KI-Modelle
- LAUNCHreddit.com1w
Jenny: Quelloffene Electron-Desktop-App für lokale LLMs mit Tool-Calling und IDE
- LAUNCHreddit.com1w
Arcon: Lokaler Agent auf Basis Qwen3-4B mit Persistenz und Persönlichkeit
Sentient OS: Proaktiver KI-Assistent mit lokalem LLM für macOS
Sentient OS wurde von dem Entwickler /u/TechExpert2910 gebaut, der bereits durch WritingTools bekannt ist – einem Open-Source-Port der Apple-Intelligence-Schreibwerkzeuge auf Windows. Das Projekt setzt auf einen vollständig lokalen Verarbeitungs-Stack auf Apple-Silicon-Macs (M1 oder neuer, macOS 15+, ab 8 GB RAM) und ist für Endverbraucher dauerhaft kostenlos. Das nächtliche Inferenz-Fenster um 3 Uhr morgens erforderte ein Reverse-Engineering des macOS-Powermanagements, damit ein zugeklappter Mac zuverlässig aufgeweckt werden kann. Für die Computer-Use-Funktionalität mit lokalen Modellen wurde außerdem das Codex-CLI von Grund auf reverse-engineered. Die 90/10-Aufteilung zwischen lokalem Gemma-4-E4B-Modell und einem optionalen Frontier-Modell ist architektonisch so gestaltet, dass das Cloud-Modell nur PII-bereinigte Zusammenfassungen erhält – Rohdaten verlassen das Gerät grundsätzlich nie. Als Frontier-Modelle empfiehlt der Entwickler aus eigenen Evals Kimi K3 für anspruchsvolle Computer-Use-Aufgaben; Qwen 3.7 35B A3B sei hingegen nur für sehr einfache Tasks geeignet. Neben direkten API-Endpunkten unterstützt Sentient OS auch LM Studio nativ als erste Wahl für den lokalen Frontier-Anteil.
- Systemvoraussetzungen: Apple Silicon (M1 oder neuer), macOS 15+, mindestens 8 GB RAM – Installation via Homebrew (`brew install --cask sentient-os-labs/tap/sentient-os`).
- Der LiteRT-LM-Fork wurde vom Team angepasst und um MTP/Speculative Decoding, Flash Attention sowie smartes KV-Cache-Reuse erweitert.
- WhatsApp, iMessage und Apple Notes werden direkt aus den lokalen macOS-Datenbanken ausgelesen – ohne Umweg über Cloud-APIs.
- Sidekick-Funktion: Klick auf das Mac-Notch + Spracheingabe löst Computer-Use-Aktionen aus, die auch im Hintergrund laufen können, während der Nutzer den Rechner weiterverwendet.
- Frontier-Modell-Optionen umfassen neben eigenen Endpunkten auch ChatGPT/Codex-Abonnements, OpenRouter und nativen LM-Studio-Support.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com2w
Agro: Open-Source On-Device Agent-Client für 4B-Modelle auf Mobile & Desktop
- MEINUNGreddit.com6d
Community-Diskussion: Sinnvolle Anwendungsfälle für lokale KI-Modelle
- LAUNCHreddit.com1w
Jenny: Quelloffene Electron-Desktop-App für lokale LLMs mit Tool-Calling und IDE
- LAUNCHreddit.com1w
Arcon: Lokaler Agent auf Basis Qwen3-4B mit Persistenz und Persönlichkeit