archex: Deterministisches Code-Kontext-Tool für Coding Agents, 26 Sprachen, Apache 2.0
archex ist ein Soloprojekt von Tom Mathews (GitHub: Mathews-Tom), das Repositories in strukturierte, token-budgetierte Kontextpakete für Coding Agents umwandelt – als Alternative zum unkontrollierten Durchsuchen per Grep. Die Kernarchitektur kombiniert BM25F-Volltext-Ranking mit lokalen Embeddings und Graph-Expansion, die Importe, Typen und Aufrufbeziehungen verfolgt. Entscheidend für den Einsatz in CI- oder Produktionsumgebungen ist die vollständige Determinismus-Garantie: Gleiche Abfrage, gleicher Index-Stand, identisches Ausgabepaket – ohne versteckte Zufälligkeit durch Cloud-Inferenz. Im Vergleich mit cocoindex-code und Graphify auf einem selbst zusammengestellten 19-Aufgaben-Benchmark (nachvollziehbar über `archex benchmark headtohead report`) fällt besonders der Cold-Start-Vorteil auf: archex startet in 0 ms, während cocoindex-code 4,7 Sekunden und Graphify 937 ms benötigen. Die Testabdeckung von 91,1 % bei 3.619 Tests signalisiert einen für ein Soloprojekt ungewöhnlich hohen Reifegrad. Der MCP-Server stellt 17 Tools bereit, was eine direkte Integration in agentenbasierte Frameworks ermöglicht. Die detaillierte Benchmark-Methodik ist in der Datei `docs/ARCHEX_VS_COCOINDEX.md` im Repository festgehalten und öffentlich reproduzierbar.
- 26 Sprachen in drei Tiers: full (vollständige Analyse), structured (AST-basiert) und chunk-only (rein lexikalisch) – je nach Sprachunterstützung.
- MCP-Server mit 17 Tools, ergänzt durch CLI, Python-API und Docker – vier verschiedene Integrationspfade ohne externe Abhängigkeiten.
- Benchmark-Methodik vollständig im Repo eingecheckt: Ergebnisse lassen sich mit dem Befehl `archex benchmark headtohead report` selbst reproduzieren.
- Completion-Penalty-Tokens als Effizienzmetrik: archex erzeugt 922 gegenüber 11.188 bei cocoindex-code – ein Faktor ~12 weniger unnötiger Kontext.
- Soloprojekt von /u/tom_mathews mit 3.619 automatisierten Tests und 91,1 % Testabdeckung; Lizenz: Apache 2.0.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
archex: Deterministisches Code-Kontext-Tool für Coding Agents, 26 Sprachen, Apache 2.0
archex ist ein Soloprojekt von Tom Mathews (GitHub: Mathews-Tom), das Repositories in strukturierte, token-budgetierte Kontextpakete für Coding Agents umwandelt – als Alternative zum unkontrollierten Durchsuchen per Grep. Die Kernarchitektur kombiniert BM25F-Volltext-Ranking mit lokalen Embeddings und Graph-Expansion, die Importe, Typen und Aufrufbeziehungen verfolgt. Entscheidend für den Einsatz in CI- oder Produktionsumgebungen ist die vollständige Determinismus-Garantie: Gleiche Abfrage, gleicher Index-Stand, identisches Ausgabepaket – ohne versteckte Zufälligkeit durch Cloud-Inferenz. Im Vergleich mit cocoindex-code und Graphify auf einem selbst zusammengestellten 19-Aufgaben-Benchmark (nachvollziehbar über `archex benchmark headtohead report`) fällt besonders der Cold-Start-Vorteil auf: archex startet in 0 ms, während cocoindex-code 4,7 Sekunden und Graphify 937 ms benötigen. Die Testabdeckung von 91,1 % bei 3.619 Tests signalisiert einen für ein Soloprojekt ungewöhnlich hohen Reifegrad. Der MCP-Server stellt 17 Tools bereit, was eine direkte Integration in agentenbasierte Frameworks ermöglicht. Die detaillierte Benchmark-Methodik ist in der Datei `docs/ARCHEX_VS_COCOINDEX.md` im Repository festgehalten und öffentlich reproduzierbar.
- 26 Sprachen in drei Tiers: full (vollständige Analyse), structured (AST-basiert) und chunk-only (rein lexikalisch) – je nach Sprachunterstützung.
- MCP-Server mit 17 Tools, ergänzt durch CLI, Python-API und Docker – vier verschiedene Integrationspfade ohne externe Abhängigkeiten.
- Benchmark-Methodik vollständig im Repo eingecheckt: Ergebnisse lassen sich mit dem Befehl `archex benchmark headtohead report` selbst reproduzieren.
- Completion-Penalty-Tokens als Effizienzmetrik: archex erzeugt 922 gegenüber 11.188 bei cocoindex-code – ein Faktor ~12 weniger unnötiger Kontext.
- Soloprojekt von /u/tom_mathews mit 3.619 automatisierten Tests und 91,1 % Testabdeckung; Lizenz: Apache 2.0.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.