Narrate Video
Voix off vidéo synchronisée et chronométrée via Azure/Gemini TTS avec mux ffmpeg — évite les pièges d'amix-silence et de coupure audio.
Fonctionne avec configuration
Ce que fait
Ajoute une piste de voix off professionnelle à n'importe quelle vidéo en analysant les transitions de scène, en écrivant des segments de narration chronométrés, en générant la parole via Azure TTS ou Gemini 3.1 Flash TTS, et en multiplexant avec ffmpeg tout en gardant l'audio et les visuels synchronisés. Se déclenche sur les demandes d'ajout de narration, de voix off, de commentaire, ou de doublage à une vidéo, y compris les enregistrements d'écran et les phrases en chinois comme "视频配音".
Rapport de test
A exécuté le pipeline ffmpeg réel dans les deux sens sur un clip de test de 9 secondes : la base naïve (une seule piste de narration déversée au début) a tronqué silencieusement la vidéo à 4,5 secondes via -shortest, tandis que l'approche segment/adelay/amix(normalize=0) de la compétence a préservé les 9 secondes complètes avec un volume moyen de -17,6 dB, juste dans la cible documentée de -25..-15 dB. Friction réelle : nécessite une clé API Azure Speech ou Gemini payante configurée dans ~/.narrate_video.env avant qu'elle ne puisse réellement synthétiser la parole.
Testé le: 2026-07-15 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/feiskyer/video-skills mkdir -p ~/.claude/skills cp -r video-skills/skills/narrate-video ~/.claude/skills/narrate-video
Commandes et exemples de prompts
/narrate-videoVoix off vidéo synchronisée et chronométrée via Azure/Gemini TTS avec mux ffmpeg — évite les pièges d'amix-silence et de coupure audio.
Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :
Add a synced voiceover track to this screen recording using TTSDub this product demo without the audio track getting cut off earlyThis video needs narration timed to the scene transitions, add it please