Community-Fix für Ornith1.5 35B A3B: MTP-Head-Patch bringt 33% Zeitersparnis
Der Reddit-Nutzer frankentriple setzt Ornith1.5 35B A3B für die Steuerung seiner Amateurfunk-Ausrüstung ein — konkret eines HackRF-Empfängers und eines 5-Watt-Quansheng-Portables, die beide headless über den PC laufen. Bereits Ornith1.0 betrieb er auf diese Weise; Ornith1.5 erwies sich in seinen Tests als schneller und genauer. Bekannt war in der Community, dass die veröffentlichte Version von Ornith1.5 einen untrainierten MTP-Head (Multi-Token Prediction) enthält, was trotz hoher t/s-Werte zu schlechter Wall-Clock-Effizienz führt. frankentriple fand einen trainierten MTP-Head in einem anderen Quant, den er aus anderen Gründen nicht nutzen konnte, und spleißte diesen auf ein APEX-Requant von Ornith1.5. Das Ergebnis ist laut seinen „Radio Torture Tests" 2,5-mal schneller als Ornith1.0 und ein Drittel schneller als die offizielle Ornith1.5-Veröffentlichung. Bemerkenswert ist die Diskrepanz zwischen dem marginalen t/s-Anstieg (+4 auf 64 t/s) und der drastischen Reduktion der Task-Completion-Zeit von 21 auf 14 Sekunden — ein Befund, der die praktische Relevanz eines funktionierenden MTP-Heads gegenüber rohen Tokens-per-Second-Angaben unterstreicht. Das gepatchte Modell sowie die vollständige Testmethodik und Ergebnisse sind öffentlich zugänglich.
- Einsatzszenario: Das Modell steuert einen HackRF-Empfänger und ein Quansheng-5-Watt-Portable headless via PC — beides lizenzierter Amateurfunk-Betrieb.
- Der trainierte MTP-Head wurde aus einem kompatiblen, aber für frankentriples Setup unnutzbaren Quant extrahiert und manuell auf das APEX-Requant gespleißt.
- Benchmark-Basis sind selbst entwickelte 'Radio Torture Tests'; Durchschnittswerte über mehrere Durchläufe (21 s → 14 s Aufgabenzeit).
- Gepatchtes Modell öffentlich unter ollama.com/slickwillies/ornith15-35b-a3b-apex-mtp-fixed; Testdaten auf GitHub (h00nigan/Ornith-testing-results).
- Nutzer hebt explizit hervor, dass das Modell keine unaufgeforderten Warnungen beim Keyen auf lizenzierten Frequenzen ausgibt — ein praktisch relevantes Verhalten für Funk-Automatisierung.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGreddit.com3w
Ornith-1.5-35B-A3B: MTP-Head nicht trainiert – nur zufällige Initialisierung
- MEINUNGreddit.com2w
Ornith 1.5 überzeugt mit 130 Token/s und starkem Tool Calling
- FORSCHUNGreddit.com1w
Training-freier Hack reduziert MoE-Reasoning-Token um 8,5 % bei Qwen 35B
- BENCHMARKreddit.com3w
Community-Tuning: Qwen 3.8B mit 45+ T/s auf 8-bit-Quant auf Apple M-Series
Community-Fix für Ornith1.5 35B A3B: MTP-Head-Patch bringt 33% Zeitersparnis
Der Reddit-Nutzer frankentriple setzt Ornith1.5 35B A3B für die Steuerung seiner Amateurfunk-Ausrüstung ein — konkret eines HackRF-Empfängers und eines 5-Watt-Quansheng-Portables, die beide headless über den PC laufen. Bereits Ornith1.0 betrieb er auf diese Weise; Ornith1.5 erwies sich in seinen Tests als schneller und genauer. Bekannt war in der Community, dass die veröffentlichte Version von Ornith1.5 einen untrainierten MTP-Head (Multi-Token Prediction) enthält, was trotz hoher t/s-Werte zu schlechter Wall-Clock-Effizienz führt. frankentriple fand einen trainierten MTP-Head in einem anderen Quant, den er aus anderen Gründen nicht nutzen konnte, und spleißte diesen auf ein APEX-Requant von Ornith1.5. Das Ergebnis ist laut seinen „Radio Torture Tests" 2,5-mal schneller als Ornith1.0 und ein Drittel schneller als die offizielle Ornith1.5-Veröffentlichung. Bemerkenswert ist die Diskrepanz zwischen dem marginalen t/s-Anstieg (+4 auf 64 t/s) und der drastischen Reduktion der Task-Completion-Zeit von 21 auf 14 Sekunden — ein Befund, der die praktische Relevanz eines funktionierenden MTP-Heads gegenüber rohen Tokens-per-Second-Angaben unterstreicht. Das gepatchte Modell sowie die vollständige Testmethodik und Ergebnisse sind öffentlich zugänglich.
- Einsatzszenario: Das Modell steuert einen HackRF-Empfänger und ein Quansheng-5-Watt-Portable headless via PC — beides lizenzierter Amateurfunk-Betrieb.
- Der trainierte MTP-Head wurde aus einem kompatiblen, aber für frankentriples Setup unnutzbaren Quant extrahiert und manuell auf das APEX-Requant gespleißt.
- Benchmark-Basis sind selbst entwickelte 'Radio Torture Tests'; Durchschnittswerte über mehrere Durchläufe (21 s → 14 s Aufgabenzeit).
- Gepatchtes Modell öffentlich unter ollama.com/slickwillies/ornith15-35b-a3b-apex-mtp-fixed; Testdaten auf GitHub (h00nigan/Ornith-testing-results).
- Nutzer hebt explizit hervor, dass das Modell keine unaufgeforderten Warnungen beim Keyen auf lizenzierten Frequenzen ausgibt — ein praktisch relevantes Verhalten für Funk-Automatisierung.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGreddit.com3w
Ornith-1.5-35B-A3B: MTP-Head nicht trainiert – nur zufällige Initialisierung
- MEINUNGreddit.com2w
Ornith 1.5 überzeugt mit 130 Token/s und starkem Tool Calling
- FORSCHUNGreddit.com1w
Training-freier Hack reduziert MoE-Reasoning-Token um 8,5 % bei Qwen 35B
- BENCHMARKreddit.com3w
Community-Tuning: Qwen 3.8B mit 45+ T/s auf 8-bit-Quant auf Apple M-Series