Browser Search

Stealth nettleserhenting og multi-motor søk for AI webforskning

av Johell1NS · Johell1NS/browser-search

Krever oppsett ★ 8.4/10

Browser Search — Stealth nettleserhenting og multi-motor søk for AI webforskning

Hva den gjør

Tre-lags webforskningstack: SearXNG for multi-motor søk, Camofox for JS-tunge sider, og CloakBrowser for nettsteder bak Cloudflare eller DataDome. Utløses ved webforskning, scraping, og sider som vanlig henting ikke kan gjengi.

Testrapport

Oppgave: Hent tittel og tekst fra en JS-gjengitt side quotes.toscrape.com/js – baseline med ren curl mot cloak-fetch.mjs-pakken. Baselinjen er ubrukelig: etter fjerning av tagger 0 sitater (innholdet samles på klienten); ferdigheten startet stealth-Chromium og returnerte tittel 'Quotes to Scrape', 1499 tegn og alle 10 sitater på 6.6 s. Sikkerhetspåstandene er sjekket live, ikke fra tekst: SSRF-blokken fungerte på 169.254.169.254 ('Blocked IP') og localhost ('Blocked hostname'), path-traversal guard avviste --script /etc/passwd, og de pakkede testene ga 28/28 og 12/12 bestått. Hovedforbeholdet: 2 av 3 verktøy (SearXNG og Camofox) krever Docker, som ikke er i miljøet – disse målte jeg IKKE, flaggskipet 'multi-engine search' forblir usjekket, og egen check.sh viser dette ærlig. En annen unøyaktighet: SKILL.md lover 'all commands/scripts are read-only, safe in Plan mode', men den første kjøringen av cloak-fetch lastet ned 140 MB Chromium til ~/.cloakbrowser. Docker + to containere – reelt manuelt arbeid, derav setup.

Testet på: 2026-07-17 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/Johell1NS/browser-search.git
mkdir -p ~/.claude/skills
cd browser-search && rm -rf .git && cp -r . ~/.claude/skills/browser-search
cd ~/.claude/skills/browser-search && npm install

Kommandoer og eksempelprompter

  • /browser-searchStealth nettleserhenting og multi-motor søk for AI webforskning

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • This page needs JavaScript to render, can you fetch the actual content
  • Search across multiple engines for me and pull the real page text back
  • This site is behind Cloudflare, I still need the rendered page content