
DiG-bench: Neuer Benchmark testet kreative Entdeckungsfähigkeit von KI-Modellen
Warum es zählt
Autonomous Discovery ist eine Grundvoraussetzung für rekursive Selbstverbesserung. Solange Frontier-Modelle auf Tier 7 nur 20 % Erfolgsrate erreichen, bleibt RSI in der Praxis begrenzt – die Lücke zu menschlicher Leistung zeigt, wo Post-Training und Reasoning noch nachziehen müssen.
— Lumeric Redaktion
DiG-bench Tier 7 · Spitzenwert
0.2%
Opus 5
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge

DiG-bench: Neuer Benchmark testet kreative Entdeckungsfähigkeit von KI-Modellen
Warum es zählt
Autonomous Discovery ist eine Grundvoraussetzung für rekursive Selbstverbesserung. Solange Frontier-Modelle auf Tier 7 nur 20 % Erfolgsrate erreichen, bleibt RSI in der Praxis begrenzt – die Lücke zu menschlicher Leistung zeigt, wo Post-Training und Reasoning noch nachziehen müssen.
— Lumeric Redaktion
DiG-bench Tier 7 · Spitzenwert
0.2%
Opus 5
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.