Gpt Image2 Ppt
Trasforma una bozza markdown in PNG di slide 16:9 e un .pptx tramite OpenAI gpt-image-2
Richiede configurazione
Cosa fa
Converte una bozza di slide markdown in slides_plan.json, assegna un layout di pagina da una delle 33 banche di layout di stile in bundle (o da un template .pptx renderizzato fornito dall'utente), costruisce un prompt di immagine per pagina e chiama OpenAI gpt-image-2 per renderizzare ogni slide, quindi impacchetta i PNG in un .pptx 16:9. Si attiva quando un utente chiede di creare una presentazione, un deck, un pitch deck, materiale didattico o slide, o chiede di copiare il layout di un template .pptx esistente. Richiede OPENAI_API_KEY e chiamate a pagamento a gpt-image-2; le modalità di clonazione del template e modificabili richiedono inoltre PowerPoint, Keynote o LibreOffice localmente.
Rapporto di test
Clonato il repo e eseguito la pipeline per davvero su un deck di presentazione per investitori di 6 slide: ho scritto slides_plan.md nel formato documentato "## N. [page_type] title", md_to_plan.py l'ha convertito in modo pulito (6 slide, page_type parsato), e render_template.py --check ha rilevato correttamente Keynote 14.0 su questo Mac. generate_ppt.py --style styles/clean-tech-blue.md ha eseguito l'intera catena e si è fermato alla chiamata API con un chiaro errore "缺少 OPENAI_API_KEY" ma ha comunque scritto prompts.json, quindi ho potuto ispezionare gli artefatti reali: layout distinti assegnati per pagina (cover-hero-composition / content-structured-grid / comparison-two-zone / data-visual-callouts / closing-summary-contact) e prompt di 1.8-2.3k caratteri con token esatti esadecimali, descrizione del layout, capacità di contenuto e metriche estratte automaticamente (84万, 31, 118%, 3.1) — molto più ricchi del mio deck python-pptx di base in Calibri predefinito. Due difetti reali trovati: qualsiasi pagina assegnata a comparison-two-zone perde TUTTO il contenuto del corpo dal prompt (38 caratteri di blocco di contenuto vs 417 per una pagina a griglia) e una slide_spec scritta a mano non viene iniettata lì; e LANGUAGE_FONT_RULE in generate_ppt.py hard-codes "all slide text must be Simplified Chinese" senza flag CLI, cosa che né il README inglese né la descrizione della skill menzionano. Scansione di sicurezza pulita (solo api.openai.com, base64 è codifica/decodifica immagine, lo script di installazione usa percorsi $HOME, nessun curl|sh), sebbene installi pip nell'ambiente Python e SKILL.md sia di 56 KB / 812 righe di contesto sempre caricato.
Testato il: 2026-07-21 · Claude Code 2.x (agent harness)
Installazione
mkdir -p ~/.claude/skills
git clone --depth 1 https://github.com/JuneYaooo/gpt-image2-ppt-skills.git ~/.claude/skills/gpt-image2-ppt
# The repo's install_as_skill.sh copies to ~/.claude/skills/gpt-image2-ppt-skills (name differs from the slug).
# Needs OPENAI_API_KEY — the script does NOT create .env. Put it in ~/.claude/settings.json:
# "env": { "OPENAI_API_KEY": "sk-...", "GPT_IMAGE_MODEL_NAME": "gpt-image-2" }
# pip install -r ~/.claude/skills/gpt-image2-ppt/requirements.txt
# Only for --template-pptx / --editable: brew install --cask libreoffice (or have Keynote/PowerPoint)
# Verify a render backend exists: python3 scripts/render_template.py --check Comandi e prompt di esempio
/gpt-image2-pptTrasforma una bozza markdown in PNG di slide 16:9 e un .pptx tramite OpenAI gpt-image-2
Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):
Make an investor pitch deck with this styleGenerate slides mimicking my uploaded PPTX templateCreate a magazine-style presentation on this topic