Gpt Image2 Ppt
Convierte un esquema markdown en PNGs de diapositivas 16:9 y un .pptx a través de OpenAI gpt-image-2
Funciona con configuración
Qué hace
Convierte un esquema de diapositivas markdown en slides_plan.json, asigna un diseño de página de uno de los 33 bancos de diseños de estilo incluidos (o de una plantilla .pptx renderizada que proporcione), construye un prompt de imagen por página y llama a OpenAI gpt-image-2 para renderizar cada diapositiva, luego empaqueta los PNGs en un .pptx 16:9. Se activa cuando un usuario pide hacer una presentación, un deck, un pitch deck, material didáctico o diapositivas, o pide copiar el diseño de una plantilla .pptx existente. Requiere OPENAI_API_KEY y llamadas pagadas a gpt-image-2; los modos de clonación de plantilla y editables requieren además PowerPoint, Keynote o LibreOffice localmente.
Informe de la prueba
Cloné el repositorio y ejecuté el pipeline de verdad en una presentación de inversor de 6 diapositivas: escribí slides_plan.md en el formato documentado "## N. [page_type] title", md_to_plan.py lo convirtió limpiamente (6 diapositivas, page_type analizado), y render_template.py --check detectó correctamente Keynote 14.0 en este Mac. generate_ppt.py --style styles/clean-tech-blue.md ejecutó toda la cadena y se detuvo en la llamada a la API con un claro "缺少 OPENAI_API_KEY" error pero aún escribió prompts.json, por lo que pude inspeccionar artefactos reales: diseños distintos asignados por página (cover-hero-composition / content-structured-grid / comparison-two-zone / data-visual-callouts / closing-summary-contact) y prompts de 1.8-2.3k caracteres que contenían tokens hexadecimales exactos, descripción del diseño, capacidad de contenido y métricas autoextraídas (84万, 31, 118%, 3.1) — mucho más ricos que mi presentación python-pptx de línea base en Calibri predeterminado. Se encontraron dos defectos reales: cualquier página asignada a comparison-two-zone pierde TODO el contenido del cuerpo del prompt (38 caracteres de bloque de contenido vs 417 para una página de cuadrícula) y una slide_spec escrita a mano tampoco se inyecta allí; y LANGUAGE_FONT_RULE en generate_ppt.py codifica rígidamente "all slide text must be Simplified Chinese" sin ninguna bandera CLI, lo cual no se menciona ni en el README en inglés ni en la descripción de la habilidad. El escaneo de seguridad está limpio (solo api.openai.com, base64 es codificación/decodificación de imagen, el script de instalación usa rutas $HOME, no curl|sh), aunque se instala con pip en el Python ambiente y SKILL.md tiene 56 KB / 812 líneas de contexto siempre cargado.
Probado el: 2026-07-21 · Claude Code 2.x (agent harness)
Instalación
mkdir -p ~/.claude/skills
git clone --depth 1 https://github.com/JuneYaooo/gpt-image2-ppt-skills.git ~/.claude/skills/gpt-image2-ppt
# The repo's install_as_skill.sh copies to ~/.claude/skills/gpt-image2-ppt-skills (name differs from the slug).
# Needs OPENAI_API_KEY — the script does NOT create .env. Put it in ~/.claude/settings.json:
# "env": { "OPENAI_API_KEY": "sk-...", "GPT_IMAGE_MODEL_NAME": "gpt-image-2" }
# pip install -r ~/.claude/skills/gpt-image2-ppt/requirements.txt
# Only for --template-pptx / --editable: brew install --cask libreoffice (or have Keynote/PowerPoint)
# Verify a render backend exists: python3 scripts/render_template.py --check Comandos y prompts de ejemplo
/gpt-image2-pptConvierte un esquema markdown en PNGs de diapositivas 16:9 y un .pptx a través de OpenAI gpt-image-2
Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):
Make an investor pitch deck with this styleGenerate slides mimicking my uploaded PPTX templateCreate a magazine-style presentation on this topic