Cerebras — Juli 2026
8 Beiträge im Juli 2026.
- LAUNCH30. JuliTechCrunch Disrupt 2026: Amazon, Replit und Cerebras auf der HauptbühneFür AI-Builder relevante Bühnen-Themen: Skalierung von KI-Infrastruktur (Cerebras), Demokratisierung von Softwareentwicklung (Replit) und Enterprise-AI-Adoption (Harvey). Frühbucher sparen bis zu 300 USD, aktuelles Preisfenster endet in wenigen Wochen.
- LAUNCH27. JuliNinfer: 700 Token/s mit Qwen3.6 35B auf RTX 5090 – Community-ReportNinfer verspricht auf der RTX 5090 Single-Instance-Throughput auf Cerebras-Niveau, ohne Batching oder parallele Agenten. Für lokale Setups mit Qwen3.6-Modellen könnte das Inferenz-Engpässe deutlich reduzieren – allerdings derzeit primär Linux-seitig und nur für zwei Modelle.
- FUNDING17. JuliGeneral Compute sichert sich $400-Mio.-Kredit für Inferenz-Chip-InfrastrukturInferenz-spezialisierte Non-Nvidia-Chips werden erstmals als bankfähige Sicherheiten akzeptiert – ein Signal, dass sich Kapital gezielt um kostengünstige Open-Source-Inferenzinfrastruktur organisiert und Nvidias Dominanz im Compute-Markt unter Druck gerät.
- LAUNCH08. JuliCognition launcht SWE-1.7: Frontier-Coding-Modell zu geringeren KostenSWE-1.7 ist ab sofort in Devin (Web, Desktop, CLI) via Cerebras mit 1000 TPS verfügbar. Die Ergebnisse deuten darauf hin, dass RL-Post-Training deutlich mehr Spielraum hat als bisher angenommen – relevant für Teams, die Coding-Agenten auf Basis offener Basismodelle aufbauen.
- LAUNCH03. JuliGemma 4 31B als sprechender 3D-Avatar mit Mimik und GestikDer vollständig open-source Stack (Silero VAD, Parakeet STT, Qwen3-TTS, TalkingHead) zeigt, wie lokale Modelle zu expressiven Sprach-Interfaces kombiniert werden können. Cerebras-Inferenz sorgt für niedrige Latenz – ein konkretes Blaupause-Projekt für interaktive Avatar-Anwendungen.
- LAUNCH02. JuliOpen-Source Voice-Pipeline mit Gemma 4 32B als Drop-in für OpenAI Realtime APIDie Pipeline ist ein direkter Drop-in-Ersatz für OpenAIs Realtime API und läuft lokal auf Consumer-Hardware (MacBook Pro M3 36 GB). AI-Builder erhalten damit eine kostenlose, anpassbare Alternative für sprachbasierte Echtzeit-Anwendungen – inklusive Web-Suche und Vision.
- MEINUNG01. JuliGemma 4 31B auf Cerebras übertrifft ChatGPT Voice Mode laut NutzertestCerebras' schnelle Inferenz kombiniert mit Gemma 4 31B könnte eine praktische Alternative zu proprietären Voice-Lösungen sein. Konkreter Mehrwert ohne Volltext und reproduzierbare Benchmarks nicht abschließend beurteilbar.
- LAUNCH01. JuliHugging Face und Cerebras bringen Gemma 4 in Echtzeit-Voice-AIEntwickler erhalten eine fertige Echtzeit-Voice-AI-Lösung auf Basis von Gemma 4 mit Cerebras-Inferenz — potenziell relevante Grundlage für latenzarme Sprachanwendungen. Konkreter technischer Mehrwert ohne Volltext nur begrenzt beurteilbar.