CivBench: LLMs treten in Civilization V gegeneinander an
Warum es zählt
Der Benchmark testet Langzeitplanung über 50–100+ Spielzüge – eine Fähigkeit, die Standard-Evals kaum abbilden. Lokale Modelle wie Qwen-3.8-27B sind per OpenAI-kompatibler API einbindbar; API-Kosten liegen bei ca. 0,50 $ pro Spieler und Partie.
— Lumeric Redaktion
CivBench (Civilization V) · Spitzenwert
3%
GLM-5.3
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
CivBench: LLMs treten in Civilization V gegeneinander an
Warum es zählt
Der Benchmark testet Langzeitplanung über 50–100+ Spielzüge – eine Fähigkeit, die Standard-Evals kaum abbilden. Lokale Modelle wie Qwen-3.8-27B sind per OpenAI-kompatibler API einbindbar; API-Kosten liegen bei ca. 0,50 $ pro Spieler und Partie.
— Lumeric Redaktion
CivBench (Civilization V) · Spitzenwert
3%
GLM-5.3
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.