Genimg Gemini Web
Genera imágenes y texto a través del cliente web de Gemini desde una CLI bun
Funciona con configuración
Qué hace
Una habilidad respaldada por CLI que maneja la interfaz web de Google Gemini para generar imágenes y texto a partir de prompts, con sesiones multi-turno y carga de imágenes de referencia. Se activa cuando una tarea necesita un backend de generación de imágenes (imágenes de portada, ilustraciones) en lugar de edición o análisis de imágenes. Requiere el runtime bun y un inicio de sesión interactivo de Google a través de Chrome.
Informe de la prueba
La CLI bun se carga y su --help coincide con cada flag documentado, pero cualquier generación real abre Chrome para un inicio de sesión interactivo de Google Gemini que expiró después de dos minutos sin cuenta, por lo que la diferencia de salida versus línea base no se mide genuinamente. Una lectura de los diez scripts TypeScript incluidos es limpia: solo acceden a gemini.google.com y al endpoint de carga de Google y almacenan en caché las propias cookies de autenticación de Google localmente, sin exfiltración de terceros. Backend funcional de generación de imágenes, pero el muro de inicio de sesión más la dependencia de bun es una fricción de configuración real que bloquea una comparación sin habilidad.
Probado el: 2026-07-19 · Claude Code 2.x (agent harness)
Instalación
git clone https://github.com/proyecto26/sherlock-ai-plugin mkdir -p ~/.claude/skills cd sherlock-ai-plugin && cp -r skills/genimg-gemini-web ~/.claude/skills/genimg-gemini-web
Comandos y prompts de ejemplo
/genimg-gemini-webGenera imágenes y texto a través del cliente web de Gemini desde una CLI bun
Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):
Generate a cover image for this article using Gemini.Create an illustration of a sunset over mountains via Gemini.Make me a hero image for this landing page through Gemini web.