Alibaba (Qwen) — August 2026
30 Beiträge im August 2026.
- MEINUNG30. Aug.Hobby-Projekt: Lokaler Claude/ChatGPT-Ersatz mit Qwen 27B auf RTX 5090 in 6 Stunden gebautZeigt, dass lokale Setups mit Qwen 27B + MCP heute Frontier-UI-Features (Artifacts, Code-Sandboxing, Tool-Loops) replizieren können – komplett ohne Cloud, Telemetrie oder Abo-Kosten. Relevant für Teams, die datenschutzkritische Workloads lokal betreiben wollen.
- GERÜCHT28. Aug.Open-Weight-KI als heißeste Akquisitionsziele im Silicon ValleyOpen-Weight-Modelle werden bisher nur von 6 % der Unternehmen genutzt, gewinnen aber bei hochvolumigen Inferenz-Workloads an Boden. Steigen Preise der Frontier-Labs weiter, dürfte die Nachfrage nach selbst-gehosteten Modellen deutlich zunehmen – relevant für alle, die KI-Kosten optimieren wollen.
- LAUNCH27. Aug.Qwen3.8-Flash-Next lokal: 20 tok/s auf RTX 3090 mit 3,49M Token SessionQwen3.8-Flash-Next läuft mit 131k-Kontext und MoE-CPU-Offloading auf Consumer-Hardware mit brauchbarer Geschwindigkeit. Der benötigte llama.cpp-Build kommt noch aus einem offenen PR (#27742), ist also noch nicht im Stable-Release enthalten – wer das Modell jetzt nutzen will, muss selbst kompilieren.
- LAUNCH26. Aug.Alibaba veröffentlicht Qwen3.8-Flash-Next mit 6 von 125 Mrd. aktiven ParameternDas Modell erhöht den Preisdruck auf OpenAI und Anthropic erheblich: Extreme Kosteneffizienz bei wettbewerbsfähiger Leistung könnte API-Pricing-Kalkulationen für Entwickler neu ausrichten. Die Qwen4-Architektur deutet auf einen neuen Effizienz-Ansatz hin.
- LAUNCH25. Aug.Wan 3.0 von Alibaba jetzt auf Vercel AI Gateway verfügbarEntwickler erhalten ein konsolidiertes Videomodell statt mehrerer spezialisierter IDs und können asynchrone Generierung per Poll, Webhook oder Fire-and-forget nutzen – besonders nützlich für serverlose Funktionen und Batch-Verarbeitung.
- LAUNCH24. Aug.Alibaba Wan3.0 generiert KI-Videos bis 30 Sekunden aus Text, Bildern und DokumentenWan3.0 unterstützt ungewöhnliche Eingabeformate wie PDFs und PPTX, was direkte Workflows für Präsentations- und Dokumentenvisualisierung ermöglicht. Der Preis von 6 $ pro 1080p/30s-Clip gibt Entwicklern einen konkreten Kalkulationsanker für Produktionskosten.
- LAUNCH24. Aug.Thomson Reuters investiert 40 Mio. USD in eigenes KI-Modell auf Qwen-BasisDie Strategie zeigt: Für domänenspezifische Legal-AI kann ein eigenes, auf proprietären Daten trainiertes Modell gegenüber API-Diensten von OpenAI oder Anthropic vorteilhafter sein. CTO Hrons Credo – nicht maximale Intelligenz, sondern gezielte Eigenverantwortung für kritische KI-Komponenten – ist ein konkretes Entscheidungsrahmen für Enterprise-AI-Architekten.
- MEINUNG23. Aug.Community wünscht sich Qwen 3.8 35B A3B als schnellere MoE-AlternativeQwen 3.8 27B ist für Consumer-Hardware mit langen Thinking-Zeiten zu langsam. Ein 35B-MoE-Modell mit nur 3B aktiven Parametern würde deutlich höhere Inferenzgeschwindigkeit bei akzeptabler Qualität bieten – relevant für alle, die lokal mit Long-Thinking-Modellen arbeiten.
- GERÜCHT19. Aug.Spekulation: Qwen plant neues 397B-A17B-MoE-Modell gegen DeepSeek V4Reine Community-Spekulation ohne offizielle Bestätigung. Für AI-Builder relevant als Marktbeobachtung: DeepSeek V4 gilt aktuell als Kosten-Intelligenz-Sweetspot, was den Wettbewerbsdruck auf Qwen illustriert.
- LAUNCH18. Aug.Alibabas RISC-V-CPU XuanTie C950 führt Qwen-3.8 27B mit 30 tps ausWenn ein RISC-V-CPU 27B-Modelle mit 30 tps ausführen kann, eröffnet das preiswerte, GPU-freie Deployment-Optionen für lokale LLM-Inferenz – relevant für Edge- und On-Device-Szenarien ohne Nvidia-Abhängigkeit.
- GERÜCHT18. Aug.Qwen 4 soll im September erscheinen – Gerücht aus Alibaba-KreisenFalls die Ankündigung zutrifft, steht Developern schon nächsten Monat eine neue Modellgeneration von Alibaba zur Verfügung. Qwen 3.8 gilt bereits als leistungsstarke und günstige Alternative zu führenden proprietären Modellen.
- MEINUNG18. Aug.Qwen3.8 27B: xhigh-Reasoning als Default für bessere Benchmark-ErgebnisseWer Qwen3.8 27B benchmarkt oder vergleicht, sollte das Reasoning-Level beachten: Der xhigh-Default zeigt Maximalleistung, ist aber ressourcenintensiv und repräsentiert nicht den typischen Alltagseinsatz.
- MEINUNG17. Aug.Qwen 3.8 27B: Reddit-Community feiert neues Open-Weight-ModellQwen 3.8 27B wird als so leistungsfähig eingeschätzt, dass es viele Mittelklasse-Modelle obsolet macht – relevanter für AI-Builder, die lokale Inferenz mit günstiger Kostenstruktur anstreben. API-Preise auf OpenRouter gelten laut Post jedoch noch als zu hoch.
- MEINUNG16. Aug.Qwen 3.8 27B: Starkes lokales Modell mit problematischem Reasoning-StandardWer Qwen 3.8 27B lokal betreibt, sollte den Reasoning-Level sofort auf „low" oder deaktiviert stellen: Der xhigh-Default verbraucht massiv Tokens und Zeit, selbst für triviale Anfragen. Bounding-Box-Genauigkeit und Bildqualität sind auf lokaler Hardware dennoch beeindruckend.
- GERÜCHT16. Aug.Qwen 35B MoE offenbar gestrichen – Commits entfernen Modell aus RepoDas Qwen 35B MoE ist in der Local-LLM-Community weit verbreitet und beliebt. Ein ausbleibender Release würde eine Lücke im Open-Source-MoE-Segment hinterlassen – Nutzer sollten Alternativen evaluieren oder aktiv Feedback an Qwen richten.
- MEINUNG16. Aug.Qwen3.8 27B auf xhigh: 183k Tokens für ein einfaches HTML-SpielWer Qwen3.8 27B mit xhigh-Reasoning über vLLM lokal betreibt, muss mit extremem Kontextverbrauch rechnen. 200k Token als Mindestpuffer sind nötig, sonst bricht die Inferenz ab – relevant für GPU-Setups mit begrenztem VRAM.
- GERÜCHT15. Aug.Alibaba erschüttert erneut den Closed-Source-AI-MarktKonkreter Mehrwert ohne Volltext nicht beurteilbar. Der Titel deutet auf eine weitere Open-Source- oder Preis-Initiative von Alibaba hin, die Druck auf geschlossene Modelle ausübt.
- FORSCHUNG15. Aug.Alibaba AI-Modelle knacken 3 Milliarden Downloads – vor Meta und GoogleAlibaba hat sich zur dominierenden Kraft bei Open-Source-KI-Modellen entwickelt. Für AI-Builder bedeutet das: Alibabas Modell-Ökosystem (v.a. Qwen-Familie) ist ein zentraler Anlaufpunkt für lokale und kommerzielle Deployments geworden.
- LAUNCH14. Aug.Alibaba Qwen 3.8: Open-Weight-Modell mit 27B Parametern und 262K KontextEntwickler erhalten ein leistungsstarkes Open-Weight-Modell mit 262K-Kontext und Apache-2.0-Lizenz, das lokal und in Agenten-Pipelines eingesetzt werden kann – ohne Nutzungsrestriktionen kommerzieller Lizenzen.
- GERÜCHT14. Aug.Apple trainiert eigenes KI-Modell für China – gemeinsam mit AlibabaApple gewinnt durch ein eigenes China-Modell mehr Kontrolle über seine KI-Produkte im wichtigen chinesischen Smartphone-Markt – relevant für alle, die Apple Intelligence als Plattform einsetzen oder beobachten, wie globale KI-Regulierung Produktarchitekturen erzwingt.
- LAUNCH14. Aug.Cursor für 60 Mrd. USD von SpaceXai übernommenCursors Übernahme für 60 Mrd. USD zeigt die extreme Bewertungsdynamik bei KI-Coding-Tools. Gleichzeitig verdichten sich Hinweise, dass Performance-Gewinne zunehmend aus verbesserten Agent-Harnesses und Post-Training stammen – nicht aus größeren Basismodellen.
- GERÜCHT13. Aug.Qwen-Team kündigt Live-Stream anKonkreter Mehrwert ohne weiteren Inhalt nicht beurteilbar – der Post enthält lediglich den Hinweis auf einen bevorstehenden Live-Stream des Qwen-Teams.
- GERÜCHT12. Aug.Qwen3.8-Max: Neues Modell von Alibaba diskutiert auf LocalLLaMAKonkreter Mehrwert ohne Volltext nicht beurteilbar. Der Name deutet auf eine neue Variante der Qwen3-Reihe hin, Details zu Parametern oder Fähigkeiten sind aus dem Auszug nicht ableitbar.
- LAUNCH11. Aug.AI-News-Roundup: Zoox, Nvidia-Finanzierungskonsortium, Meta Muse GlimmerNvidias Infrastruktur-Finanzierungskonsortium ($500 Mrd., davon $125 Mrd. Eigenbackstop) macht AI-Rechenkapazität zur schuldenfinanzierten Anlageklasse – relevant für alle, die Cloud-Infrastruktur planen. Metas Muse Glimmer bietet permissive Open-Source-Lizenz und konkurriert laut Eigenangabe mit Alibaba Qwen3.6-27B.
- GERÜCHT09. Aug.RTX 5090 mit 96 GB VRAM auf Alibaba gesichtet96 GB VRAM in einer Consumer-GPU würde das lokale Ausführen großer Modelle deutlich zugänglicher machen. Die Quelle ist jedoch unbestätigt – AI-Builder sollten die Verifizierung abwarten, bevor sie Hardwarepläne darauf stützen.
- BENCHMARK06. Aug.Qwen3.8 Max erreicht Claude Opus 4.8-Niveau, Kimi K3 bleibt günstiger und stärkerQwen3.8 Max schließt in einer Modellgeneration eine große Lücke zu Anthropics Flaggschiff-Modell. Da Kimi K3 trotzdem besser und günstiger ist, verschärft sich der Preis-Leistungs-Wettbewerb für API-Nutzer weiter.
- LAUNCH03. Aug.Alibaba bewirbt Qwen 3.8 mit positivem Narrativ zur KI-JobablösungDas Marketing-Framing von Alibaba zeigt, wie Anbieter aktiv gegensteuern, um KI-Automatisierung positiv zu besetzen. Für AI-Builder relevant: Die öffentliche Wahrnehmung von KI-Arbeitsablösung wird zunehmend zum strategischen Kommunikationsfeld.
- MEINUNG03. Aug.Insider-Analyse: Vier chinesische KI-Labs, vier unterschiedliche StrategienLing-3.0-flash (124B total, ~5,1B aktiv, 262k Kontext) ist explizit auf günstige Agent-Loops ausgelegt – kein Leaderboard-Modell. Wer chinesische Open-Weights-Modelle evaluiert, sollte die jeweilige Designphilosophie kennen, um das richtige für den eigenen Use-Case zu wählen.
- MEINUNG03. Aug.CLI-Agent mit Python und Ollama lokal aufbauen – Schritt-für-SchrittEntwickler können damit einen funktionsfähigen lokalen AI-Agenten auf Basis von Qwen2.5 und Ollama aufsetzen, der direkt im Terminal Shell-Befehle ausführt – ohne API-Kosten oder Datenweitergabe an die Cloud.
- LAUNCH03. Aug.Alibaba kündigt Qwen3.8-27B und Qwen3.8-Max anKonkreter Mehrwert ohne vollständige technische Details nicht abschließend beurteilbar. Die Ankündigung deutet auf eine neue Generation lokal ausführbarer Qwen-Modelle hin, die für die Open-Source-Community relevant sein könnte.