Genimg Gemini Web

Generer billeder og tekst via Gemini webklienten fra en bun CLI

Af proyecto26 · proyecto26/sherlock-ai-plugin

Virker med opsætning ★ 7.6/10

Genimg Gemini Web — Generer billeder og tekst via Gemini webklienten fra en bun CLI

Hvad det gør

En CLI-understøttet skill, der driver Google Gemini's webgrænseflade til at generere billeder og tekst fra prompts, med multi-turn sessioner og reference-billede upload. Udløses når en opgave kræver en billedgenererings-backend (coverbilleder, illustrationer) snarere end billedredigering eller -analyse. Kræver bun runtime og et interaktivt Google-login via Chrome.

Testrapport

bun CLI indlæses, og dens --help matcher hvert dokumenteret flag, men enhver reel generering åbner Chrome for et interaktivt Google Gemini-login, der timed out efter to minutter uden konto, så output-versus-baseline forskellen er ægte umålt. En gennemlæsning af alle ti medfølgende TypeScript-scripts er ren: de når kun gemini.google.com og Google's upload-endpoint og cacher Google's egne auth-cookies lokalt, uden tredjeparts exfil. Funktionel billedgenererings-backend, men login-væggen plus bun-afhængigheden er reel opsætningsfriktion, der blokerer en no-skill sammenligning.

Testet: 2026-07-19 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/proyecto26/sherlock-ai-plugin
mkdir -p ~/.claude/skills
cd sherlock-ai-plugin && cp -r skills/genimg-gemini-web ~/.claude/skills/genimg-gemini-web

Kommandoer og eksempelprompter

  • /genimg-gemini-webGenerer billeder og tekst via Gemini webklienten fra en bun CLI

Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):

  • Generate a cover image for this article using Gemini.
  • Create an illustration of a sunset over mountains via Gemini.
  • Make me a hero image for this landing page through Gemini web.