
Poolside Laguna S 2.1: 118B-Modell übertrifft Trillion-Parameter-Systeme auf Coding-Benchmarks
ToolsDeepSeek
CompaniesDeepSeek
Warum es zählt
Mit 13-fachem Parameterdefizit und trotzdem 4-facher Score-Überlegenheit auf DeepSWE stellt Laguna die Annahme „mehr Parameter = bessere Coding-Leistung" grundlegend in Frage. Poolside hat alle Evaluierungs-Trajektorien veröffentlicht, was die Nachvollziehbarkeit der Ergebnisse ermöglicht.
— Lumeric Redaktion
Terminal-Bench 2.1 · Spitzenwert
70.2%
Laguna S 2.1 (118B)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com1w
DeepSeek V4 Pro hinter GLM 5.3 Flash und Qwen Next in Benchmarks
- BENCHMARKreddit.com0mo
Qwen3.8-27B auf Augenhöhe mit DeepSeek V4 und GPT-5.6 Luna Max
- FORSCHUNGarxiv.org2h
JugnuLM-110M schlägt GPT-X2-125M mit 12% weniger Parametern auf BLiMP
- LAUNCHcognition.com4d
Cognition lanciert SWE-2: RL-skaliertes Coding-Modell mit 2,8T Parametern

Poolside Laguna S 2.1: 118B-Modell übertrifft Trillion-Parameter-Systeme auf Coding-Benchmarks
ToolsDeepSeek
CompaniesDeepSeek
Warum es zählt
Mit 13-fachem Parameterdefizit und trotzdem 4-facher Score-Überlegenheit auf DeepSWE stellt Laguna die Annahme „mehr Parameter = bessere Coding-Leistung" grundlegend in Frage. Poolside hat alle Evaluierungs-Trajektorien veröffentlicht, was die Nachvollziehbarkeit der Ergebnisse ermöglicht.
— Lumeric Redaktion
Terminal-Bench 2.1 · Spitzenwert
70.2%
Laguna S 2.1 (118B)
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- MEINUNGreddit.com1w
DeepSeek V4 Pro hinter GLM 5.3 Flash und Qwen Next in Benchmarks
- BENCHMARKreddit.com0mo
Qwen3.8-27B auf Augenhöhe mit DeepSeek V4 und GPT-5.6 Luna Max
- FORSCHUNGarxiv.org2h
JugnuLM-110M schlägt GPT-X2-125M mit 12% weniger Parametern auf BLiMP
- LAUNCHcognition.com4d
Cognition lanciert SWE-2: RL-skaliertes Coding-Modell mit 2,8T Parametern