DeepSeek V4 Flash: günstiges Open-Weight-Modell für $0,09/$0,18 pro 1M Token
DeepSeek V4 Flash wurde Ende Juli 2026 veröffentlicht und überraschte die r/LocalLLaMA-Community sowohl mit seinem Preisniveau als auch mit seiner Benchmark-Performance. Mit $0,09 pro 1M Input-Token und $0,18 pro 1M Output-Token unterbietet es gängige Top-Modelle um ein Vielfaches – der Beitrag spricht von über 50× günstigerem Pricing gegenüber vergleichbaren Modellen. In Community-Tests belegt das Modell laut dem Beitragsautor /u/davidthesong den zweiten Platz unter den Open-Weight-Modellen, knapp hinter Kimi K3. Besonders stark soll es in den Bereichen Coding und Reasoning-Chat abschneiden. Das Modell wird als API-Angebot positioniert, was es vor allem für Entwickler und Teams interessant macht, die leistungsfähige Inferenz zu niedrigen Kosten benötigen. Die Bezeichnung „intelligence too cheap to meter" greift eine gängige Formulierung aus dem Cloud-Computing-Diskurs auf und deutet auf DeepSeeks strategisches Ziel hin, Inferenzkosten als Wettbewerbsvorteil zu nutzen. Das Modell reiht sich in DeepSeeks bisherige Strategie ein, mit aggressivem Pricing und Open-Weight-Releases den Markt unter Druck zu setzen.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
DeepSeek V4 Flash: günstiges Open-Weight-Modell für $0,09/$0,18 pro 1M Token
DeepSeek V4 Flash wurde Ende Juli 2026 veröffentlicht und überraschte die r/LocalLLaMA-Community sowohl mit seinem Preisniveau als auch mit seiner Benchmark-Performance. Mit $0,09 pro 1M Input-Token und $0,18 pro 1M Output-Token unterbietet es gängige Top-Modelle um ein Vielfaches – der Beitrag spricht von über 50× günstigerem Pricing gegenüber vergleichbaren Modellen. In Community-Tests belegt das Modell laut dem Beitragsautor /u/davidthesong den zweiten Platz unter den Open-Weight-Modellen, knapp hinter Kimi K3. Besonders stark soll es in den Bereichen Coding und Reasoning-Chat abschneiden. Das Modell wird als API-Angebot positioniert, was es vor allem für Entwickler und Teams interessant macht, die leistungsfähige Inferenz zu niedrigen Kosten benötigen. Die Bezeichnung „intelligence too cheap to meter" greift eine gängige Formulierung aus dem Cloud-Computing-Diskurs auf und deutet auf DeepSeeks strategisches Ziel hin, Inferenzkosten als Wettbewerbsvorteil zu nutzen. Das Modell reiht sich in DeepSeeks bisherige Strategie ein, mit aggressivem Pricing und Open-Weight-Releases den Markt unter Druck zu setzen.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.