Genimg Gemini Web
Generuj obrazy i tekst za pomocą klienta webowego Gemini z CLI bun
Działa po konfiguracji
Co robi ten skill
Umiejętność wspierana przez CLI, która steruje interfejsem webowym Google Gemini do generowania obrazów i tekstu z promptów, z sesjami wieloobrotowymi i przesyłaniem obrazów referencyjnych. Uruchamia się, gdy zadanie wymaga backendu do generowania obrazów (obrazy okładek, ilustracje), a nie edycji lub analizy obrazów. Wymaga środowiska uruchomieniowego bun i interaktywnego logowania Google przez Chrome.
Raport z testu
CLI bun ładuje się, a jego --help pasuje do każdej udokumentowanej flagi, ale każda rzeczywista generacja otwiera Chrome w celu interaktywnego logowania do Google Gemini, które wygasło po dwóch minutach bez konta, więc różnica między wyjściem a baseline'em jest naprawdę niemierzalna. Odczyt wszystkich dziesięciu dołączonych skryptów TypeScript jest czysty: docierają tylko do gemini.google.com i punktu końcowego przesyłania Google oraz lokalnie buforują własne pliki cookie autoryzacji Google, bez wycieku danych do stron trzecich. Funkcjonalny backend do generowania obrazów, ale ściana logowania plus zależność bun to prawdziwe tarcie konfiguracyjne, które blokuje porównanie bez umiejętności.
Testowano: 2026-07-19 · Claude Code 2.x (agent harness)
Instalacja
git clone https://github.com/proyecto26/sherlock-ai-plugin mkdir -p ~/.claude/skills cd sherlock-ai-plugin && cp -r skills/genimg-gemini-web ~/.claude/skills/genimg-gemini-web
Komendy i przykładowe prompty
/genimg-gemini-webGeneruj obrazy i tekst za pomocą klienta webowego Gemini z CLI bun
Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):
Generate a cover image for this article using Gemini.Create an illustration of a sunset over mountains via Gemini.Make me a hero image for this landing page through Gemini web.