DeepSeek V4 Release-Version auf API aktiviert – Open Weights stehen bevor
Der Reddit-Nutzer datbackup verweist auf einen Thread in r/DeepSeek, der darauf hindeutet, dass die Release-Version von DeepSeek V4 Flash still und leise auf der API aktiviert wurde – ohne offizielle Ankündigung. Die Vorschauversion des Modells hatte laut Community-Konsens primär durch ihren günstigen Preis überzeugt, war aber sonst schnell aus dem Scheinwerferlicht geraten. Der Autor argumentiert, dass die Preview-Phase damit noch nicht repräsentativ für das Gesamtpotenzial war. Die Open Weights der Release-Version waren ursprünglich für Mitte Juli angekündigt, was zeitlich mit den beobachteten API-Änderungen übereinstimmt. Besondere Aufmerksamkeit richtet sich auf die Kombination des Modells mit antirez' dwarfstar4-Projekt, das potenziell über 100 Tokens pro Sekunde auf zwei DGX-Spark-Einheiten ermöglichen soll. Für die größere Variante, DeepSeek V4 Pro, prognostiziert datbackup einen Sprung an die Spitze der Open-Weights-Ranglisten – er hält es für sehr wahrscheinlich, dass sie das bisherige Spitzenmodell GLM 5.2 verdrängen wird. Insgesamt sieht die Community in diesem Release einen möglichen Moment ähnlich dem Erscheinen von DeepSeek R1, der damals breite Aufmerksamkeit auf lokale Modelle lenkte.
- Die Release-Version von DS4 Flash wurde ohne offizielle Ankündigung auf der API aktiviert – Hinweis stammt aus einem verlinkten r/DeepSeek-Thread.
- Open Weights der Release-Version waren für Mitte Juli geplant; das zeitliche Zusammentreffen gilt als starkes Indiz für ein baldiges Release.
- Nutzer datbackup erwartet, dass DS4 Flash trotz etwa halb so vieler aktiver Parameter ähnlich wie Hunyuan 3 (Hy3) abschneidet.
- Das Projekt dwarfstar4 von Entwickler antirez soll in Kombination mit zwei DGX-Spark-Systemen über 100 Tokens pro Sekunde ermöglichen.
- DS4 Pro wird als potenzieller Nachfolger von GLM 5.2 an der Spitze der Open-Weights-Modelle gehandelt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
DeepSeek V4 Release-Version auf API aktiviert – Open Weights stehen bevor
Der Reddit-Nutzer datbackup verweist auf einen Thread in r/DeepSeek, der darauf hindeutet, dass die Release-Version von DeepSeek V4 Flash still und leise auf der API aktiviert wurde – ohne offizielle Ankündigung. Die Vorschauversion des Modells hatte laut Community-Konsens primär durch ihren günstigen Preis überzeugt, war aber sonst schnell aus dem Scheinwerferlicht geraten. Der Autor argumentiert, dass die Preview-Phase damit noch nicht repräsentativ für das Gesamtpotenzial war. Die Open Weights der Release-Version waren ursprünglich für Mitte Juli angekündigt, was zeitlich mit den beobachteten API-Änderungen übereinstimmt. Besondere Aufmerksamkeit richtet sich auf die Kombination des Modells mit antirez' dwarfstar4-Projekt, das potenziell über 100 Tokens pro Sekunde auf zwei DGX-Spark-Einheiten ermöglichen soll. Für die größere Variante, DeepSeek V4 Pro, prognostiziert datbackup einen Sprung an die Spitze der Open-Weights-Ranglisten – er hält es für sehr wahrscheinlich, dass sie das bisherige Spitzenmodell GLM 5.2 verdrängen wird. Insgesamt sieht die Community in diesem Release einen möglichen Moment ähnlich dem Erscheinen von DeepSeek R1, der damals breite Aufmerksamkeit auf lokale Modelle lenkte.
- Die Release-Version von DS4 Flash wurde ohne offizielle Ankündigung auf der API aktiviert – Hinweis stammt aus einem verlinkten r/DeepSeek-Thread.
- Open Weights der Release-Version waren für Mitte Juli geplant; das zeitliche Zusammentreffen gilt als starkes Indiz für ein baldiges Release.
- Nutzer datbackup erwartet, dass DS4 Flash trotz etwa halb so vieler aktiver Parameter ähnlich wie Hunyuan 3 (Hy3) abschneidet.
- Das Projekt dwarfstar4 von Entwickler antirez soll in Kombination mit zwei DGX-Spark-Systemen über 100 Tokens pro Sekunde ermöglichen.
- DS4 Pro wird als potenzieller Nachfolger von GLM 5.2 an der Spitze der Open-Weights-Modelle gehandelt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.