BAAI veröffentlicht AREX-2: 27B-Agenten-Modell mit Long-Horizon Self-Improvement
CompaniesHugging Face
Warum es zählt
Das Modell überträgt auf Coding- und ML-Aufgaben trainiertes Selbstverbesserungsverhalten auf Deep-Research-Tasks – ohne zusätzliche Suchtrajectories. Für Agent-Pipelines relevant, da Feedback-Loops (Logs, Fehler, Scores) direkt genutzt werden.
— Lumeric Redaktion
262.144 Tokens
Maximale Kontextlänge
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org1w
Agent0: Selbstevolvierender LLM-Agent ohne externe Trainingsdaten
- FORSCHUNGarxiv.org0mo
reSolve: Selbst-evolvierende Agent-Skills übertreffen menschlich kuratierte Baselines
- FORSCHUNGhuggingface.co1w
SoL-Pi: Rekursive Auto-Research-Loops für effiziente Coding-Agenten
- FORSCHUNGarxiv.org5d
Env-Rethink: LLM-Agenten verbessern sich durch evolvierende Umgebungen
BAAI veröffentlicht AREX-2: 27B-Agenten-Modell mit Long-Horizon Self-Improvement
CompaniesHugging Face
Warum es zählt
Das Modell überträgt auf Coding- und ML-Aufgaben trainiertes Selbstverbesserungsverhalten auf Deep-Research-Tasks – ohne zusätzliche Suchtrajectories. Für Agent-Pipelines relevant, da Feedback-Loops (Logs, Fehler, Scores) direkt genutzt werden.
— Lumeric Redaktion
262.144 Tokens
Maximale Kontextlänge
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org1w
Agent0: Selbstevolvierender LLM-Agent ohne externe Trainingsdaten
- FORSCHUNGarxiv.org0mo
reSolve: Selbst-evolvierende Agent-Skills übertreffen menschlich kuratierte Baselines
- FORSCHUNGhuggingface.co1w
SoL-Pi: Rekursive Auto-Research-Loops für effiziente Coding-Agenten
- FORSCHUNGarxiv.org5d
Env-Rethink: LLM-Agenten verbessern sich durch evolvierende Umgebungen