Gryphe veröffentlicht Pantheon-Reasoning-27B für ungezensiertes Roleplay mit Denkspuren
Pantheon-Reasoning-27B ist das neueste Modell aus Gryphes Pantheon-Reihe für kreatives Roleplay und basiert auf llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Im Unterschied zu früheren Veröffentlichungen der Serie wurden diesmal vollständige Reasoning-Traces über jeden einzelnen Assistant-Turn trainiert – das Modell „denkt" also explizit über Ton, Narrativ-Beats und Charaktermotivationen nach, bevor es antwortet. Die Trainingsdaten setzen sich aus sechs Quellen zusammen: Pantheon-Kerndaten (~28 %), Claude-Opus-4.6-Reasoning-Traces für STEM und Coding (~21 %), WorldSim-Narrativdaten (~16 %), Text-Adventure-Inhalte (~16 %), allgemeine Roleplay-Transkripte (~16 %) und Tiamat-Daten mit Critic-Improver-Pipeline (~3 %). Die Option preserve_thinking: true sorgt dafür, dass Thinking-Tags in Multi-Turn-Gesprächen dauerhaft aktiv bleiben. Gemma 4 31B wurde als Basis verworfen, weil das Training nach Angaben des Autors aufgrund der Architektur besonders schwierig war. GGUF-Quants sind separat verfügbar. Das Modell ist gleichzeitig als Nachfolger der Pantheon-Serie und des einmaligen Codex-Releases konzipiert.
- Basis-Modell: llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved
- 6 Datenquellen, größter Anteil Pantheon-Kerndaten (~28 %) und Opus-4.6-Reasoning-Traces (~21 %)
- preserve_thinking: true — Thinking-Tags bleiben in allen Multi-Turn-Turns aktiv, nicht nur im ersten
- Tiamat-Daten (~3 %) nutzen mehrstufige Generation/Extension/Improvement-Pipeline mit Critic-Improver-Rewrites
- GGUF-Quants separat verfügbar; Gemma 4 31B als Basis wegen Trainings-Schwierigkeiten verworfen
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com4d
Qwen3.8-27B-Humanlike-Chat: LoRA-Finetuning für menschlichere Konversation
- LAUNCHreddit.com1w
Qwen3-8B mit ~20 Modalitäten als experimentelles Community-Modell
- MEINUNGreddit.com2d
Qwen 3.8 27B Low-Thinking-Mode vs. ältere Qwen 3.6 Modelle im Vergleich
- LAUNCHreddit.com3w
Unsloth aktualisiert Qwen3-235B-A22B GGUF-Dateien auf Hugging Face
Gryphe veröffentlicht Pantheon-Reasoning-27B für ungezensiertes Roleplay mit Denkspuren
Pantheon-Reasoning-27B ist das neueste Modell aus Gryphes Pantheon-Reihe für kreatives Roleplay und basiert auf llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Im Unterschied zu früheren Veröffentlichungen der Serie wurden diesmal vollständige Reasoning-Traces über jeden einzelnen Assistant-Turn trainiert – das Modell „denkt" also explizit über Ton, Narrativ-Beats und Charaktermotivationen nach, bevor es antwortet. Die Trainingsdaten setzen sich aus sechs Quellen zusammen: Pantheon-Kerndaten (~28 %), Claude-Opus-4.6-Reasoning-Traces für STEM und Coding (~21 %), WorldSim-Narrativdaten (~16 %), Text-Adventure-Inhalte (~16 %), allgemeine Roleplay-Transkripte (~16 %) und Tiamat-Daten mit Critic-Improver-Pipeline (~3 %). Die Option preserve_thinking: true sorgt dafür, dass Thinking-Tags in Multi-Turn-Gesprächen dauerhaft aktiv bleiben. Gemma 4 31B wurde als Basis verworfen, weil das Training nach Angaben des Autors aufgrund der Architektur besonders schwierig war. GGUF-Quants sind separat verfügbar. Das Modell ist gleichzeitig als Nachfolger der Pantheon-Serie und des einmaligen Codex-Releases konzipiert.
- Basis-Modell: llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved
- 6 Datenquellen, größter Anteil Pantheon-Kerndaten (~28 %) und Opus-4.6-Reasoning-Traces (~21 %)
- preserve_thinking: true — Thinking-Tags bleiben in allen Multi-Turn-Turns aktiv, nicht nur im ersten
- Tiamat-Daten (~3 %) nutzen mehrstufige Generation/Extension/Improvement-Pipeline mit Critic-Improver-Rewrites
- GGUF-Quants separat verfügbar; Gemma 4 31B als Basis wegen Trainings-Schwierigkeiten verworfen
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- LAUNCHreddit.com4d
Qwen3.8-27B-Humanlike-Chat: LoRA-Finetuning für menschlichere Konversation
- LAUNCHreddit.com1w
Qwen3-8B mit ~20 Modalitäten als experimentelles Community-Modell
- MEINUNGreddit.com2d
Qwen 3.8 27B Low-Thinking-Mode vs. ältere Qwen 3.6 Modelle im Vergleich
- LAUNCHreddit.com3w
Unsloth aktualisiert Qwen3-235B-A22B GGUF-Dateien auf Hugging Face