Gpt Image2 Ppt
Transforme un plan markdown en PNG de diapositives 16:9 et un .pptx via OpenAI gpt-image-2
Fonctionne avec configuration
Ce que fait
Convertit un plan de diapositives markdown en slides_plan.json, attribue une mise en page à partir de l'une des 33 banques de styles groupées (ou à partir d'un modèle .pptx rendu que vous fournissez), construit une invite d'image par page et appelle OpenAI gpt-image-2 pour rendre chaque diapositive, puis regroupe les PNG dans un .pptx 16:9. Se déclenche lorsqu'un utilisateur demande de créer une présentation, un deck, un pitch deck, un didacticiel ou des diapositives, ou demande de copier la mise en page d'un modèle .pptx existant. Nécessite OPENAI_API_KEY et des appels payants à gpt-image-2 ; les modes de clonage de modèle et d'édition nécessitent en outre PowerPoint, Keynote ou LibreOffice localement.
Rapport de test
Dépôt cloné et pipeline exécuté pour de vrai sur un pitch deck d'investisseur de 6 diapositives : slides_plan.md écrit au format documenté "## N. [page_type] title", md_to_plan.py l'a converti proprement (6 diapositives, page_type parsé), et render_template.py --check a correctement détecté Keynote 14.0 sur ce Mac. generate_ppt.py --style styles/clean-tech-blue.md a exécuté toute la chaîne et s'est arrêté à l'appel API avec une erreur claire "缺少 OPENAI_API_KEY" mais a quand même écrit prompts.json, j'ai donc pu inspecter de vrais artefacts : des mises en page distinctes attribuées par page (cover-hero-composition / content-structured-grid / comparison-two-zone / data-visual-callouts / closing-summary-contact) et des prompts de 1,8 à 2,3k caractères portant des jetons hexadécimaux exacts, une description de la mise en page, une capacité de contenu et des métriques auto-extraites (84万, 31, 118%, 3.1) — bien plus riches que mon deck python-pptx de base en Calibri par défaut. Deux défauts réels trouvés : toute page à laquelle est attribué comparison-two-zone perd TOUT le contenu du corps du prompt (38 caractères de bloc de contenu contre 417 pour une page de grille) et un slide_spec écrit à la main n'y est pas non plus injecté ; et LANGUAGE_FONT_RULE dans generate_ppt.py code en dur "all slide text must be Simplified Chinese" sans flag CLI, ce que ni le README anglais ni la description de la compétence ne mentionnent. Scan de sécurité propre (seulement api.openai.com, base64 est encodage/décodage d'image, le script d'installation utilise les chemins $HOME, pas de curl|sh), bien qu'il s'installe via pip dans l'environnement Python ambiant et que SKILL.md représente 56 Ko / 812 lignes de contexte toujours chargé.
Testé le: 2026-07-21 · Claude Code 2.x (agent harness)
Installation
mkdir -p ~/.claude/skills
git clone --depth 1 https://github.com/JuneYaooo/gpt-image2-ppt-skills.git ~/.claude/skills/gpt-image2-ppt
# The repo's install_as_skill.sh copies to ~/.claude/skills/gpt-image2-ppt-skills (name differs from the slug).
# Needs OPENAI_API_KEY — the script does NOT create .env. Put it in ~/.claude/settings.json:
# "env": { "OPENAI_API_KEY": "sk-...", "GPT_IMAGE_MODEL_NAME": "gpt-image-2" }
# pip install -r ~/.claude/skills/gpt-image2-ppt/requirements.txt
# Only for --template-pptx / --editable: brew install --cask libreoffice (or have Keynote/PowerPoint)
# Verify a render backend exists: python3 scripts/render_template.py --check Commandes et exemples de prompts
/gpt-image2-pptTransforme un plan markdown en PNG de diapositives 16:9 et un .pptx via OpenAI gpt-image-2
Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :
Make an investor pitch deck with this styleGenerate slides mimicking my uploaded PPTX templateCreate a magazine-style presentation on this topic