TinySearch v0.6.1: Lightweight Web-Research-Tool für lokale LLMs mit Browser-Integration
TinySearch entstand als Antwort auf ein praktisches Problem bei lokalen Sprachmodellen: Kleine Modelle mit 4B bis 9B Parametern werden durch ungefilterte Web-Inhalte schnell überwältigt, da sie selbst nicht zuverlässig die relevanten Passagen aus 50.000+ Token großen Textwüsten herausfiltern können. Das Tool übernimmt diese Vorfilterung lokal und ohne zwischengeschaltetes LLM – ausschließlich mit BM25-Keyword-Suche und ONNX-basierten Embeddings, die direkt auf dem eigenen Rechner laufen. Seit Version 0.4.0 wurden die Werkzeuge `search` und `scrape_urls` bewusst getrennt: Die Suche ist bewusst schlank gehalten und startet weder Chromium noch das Embedding-Modell. `scrape_urls` hingegen verarbeitet bis zu fünf URLs gleichzeitig und crawlt sie parallel durch eine einzelne Browser-Instanz. Die CDP-Integration (Chrome DevTools Protocol) ist dabei der praktisch bedeutsamste Neuzugang: Anstatt immer eine frische, leicht erkennbare headless-Chromium-Session zu starten, kann TinySearch nun einen bereits laufenden Browser des Nutzers übernehmen – inklusive gespeicherter Cookies, Profil, Proxy-Einstellungen und Browser-Fingerprint. Das schützt vor Blocking-Maßnahmen vieler moderner Websites. Ergänzend liefert das Tool zu jeder gecrawlten Seite verwandte Links, die gegen die ursprüngliche Query gewichtet werden, sodass ein Agent eigenständig entscheiden kann, welche Seiten er als nächstes besucht. Entwickelt und veröffentlicht wird das Projekt unter dem GitHub-Account TinySuiteHQ.
- scrape_urls verarbeitet 1–5 URLs gleichzeitig und crawlt sie parallel durch eine einzige Browser-Instanz.
- MCP-Antworten werden nun im XML-Format statt im alten Text-Prompt-Format ausgegeben.
- Boilerplate-Stripping erfolgt jetzt vor der Markdown-Generierung, was die Ausgabe-Qualität verbessert.
- Bloated Websites erreichten im Benchmark über 80 % Token-Reduktion; bereits saubere Seiten zeigten kaum Veränderung.
- Der Benchmark-Skript ist im Repo enthalten und öffentlich reproduzierbar – 8 Research-Queries, 146.878 → 53.426 Token.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- BENCHMARKthe-decoder.com3w
Artificial Analysis bewertet Such-APIs für KI-Agenten nach Qualität, Kosten und Speed
- LAUNCHgithub.com1w
WebLLM: Hochperformante LLM-Inferenz direkt im Browser via WebGPU
- LAUNCHreddit.com3w
S1-mini: 600M-Parameter-Modell läuft lokal im Browser via WebGPU
- BENCHMARKarxiv.org1w
MM-BrowseComp: Benchmark für multimodale Web-Browsing-Agenten
TinySearch v0.6.1: Lightweight Web-Research-Tool für lokale LLMs mit Browser-Integration
TinySearch entstand als Antwort auf ein praktisches Problem bei lokalen Sprachmodellen: Kleine Modelle mit 4B bis 9B Parametern werden durch ungefilterte Web-Inhalte schnell überwältigt, da sie selbst nicht zuverlässig die relevanten Passagen aus 50.000+ Token großen Textwüsten herausfiltern können. Das Tool übernimmt diese Vorfilterung lokal und ohne zwischengeschaltetes LLM – ausschließlich mit BM25-Keyword-Suche und ONNX-basierten Embeddings, die direkt auf dem eigenen Rechner laufen. Seit Version 0.4.0 wurden die Werkzeuge `search` und `scrape_urls` bewusst getrennt: Die Suche ist bewusst schlank gehalten und startet weder Chromium noch das Embedding-Modell. `scrape_urls` hingegen verarbeitet bis zu fünf URLs gleichzeitig und crawlt sie parallel durch eine einzelne Browser-Instanz. Die CDP-Integration (Chrome DevTools Protocol) ist dabei der praktisch bedeutsamste Neuzugang: Anstatt immer eine frische, leicht erkennbare headless-Chromium-Session zu starten, kann TinySearch nun einen bereits laufenden Browser des Nutzers übernehmen – inklusive gespeicherter Cookies, Profil, Proxy-Einstellungen und Browser-Fingerprint. Das schützt vor Blocking-Maßnahmen vieler moderner Websites. Ergänzend liefert das Tool zu jeder gecrawlten Seite verwandte Links, die gegen die ursprüngliche Query gewichtet werden, sodass ein Agent eigenständig entscheiden kann, welche Seiten er als nächstes besucht. Entwickelt und veröffentlicht wird das Projekt unter dem GitHub-Account TinySuiteHQ.
- scrape_urls verarbeitet 1–5 URLs gleichzeitig und crawlt sie parallel durch eine einzige Browser-Instanz.
- MCP-Antworten werden nun im XML-Format statt im alten Text-Prompt-Format ausgegeben.
- Boilerplate-Stripping erfolgt jetzt vor der Markdown-Generierung, was die Ausgabe-Qualität verbessert.
- Bloated Websites erreichten im Benchmark über 80 % Token-Reduktion; bereits saubere Seiten zeigten kaum Veränderung.
- Der Benchmark-Skript ist im Repo enthalten und öffentlich reproduzierbar – 8 Research-Queries, 146.878 → 53.426 Token.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- BENCHMARKthe-decoder.com3w
Artificial Analysis bewertet Such-APIs für KI-Agenten nach Qualität, Kosten und Speed
- LAUNCHgithub.com1w
WebLLM: Hochperformante LLM-Inferenz direkt im Browser via WebGPU
- LAUNCHreddit.com3w
S1-mini: 600M-Parameter-Modell läuft lokal im Browser via WebGPU
- BENCHMARKarxiv.org1w
MM-BrowseComp: Benchmark für multimodale Web-Browsing-Agenten