Narrate Video
Voiceover video temporizzato e sincronizzato tramite Azure/Gemini TTS con mux ffmpeg — evita le trappole di amix-silence e audio-cutoff.
Richiede configurazione
Cosa fa
Aggiunge una traccia di voiceover professionale a qualsiasi video analizzando le transizioni di scena, scrivendo segmenti di narrazione temporizzati, generando parlato tramite Azure TTS o Gemini 3.1 Flash TTS e muxando con ffmpeg mantenendo sincronizzati audio e video. Si attiva su richieste di aggiungere narrazione, voiceover, commento o doppiaggio a un video, incluse registrazioni dello schermo e frasi in cinese come "视频配音".
Rapporto di test
Eseguito la vera pipeline ffmpeg in entrambi i modi su una clip di test di 9s: la baseline ingenua (traccia di narrazione singola scaricata all'inizio) ha troncato silenziosamente il video a 4.5s tramite -shortest, mentre l'approccio segment/adelay/amix(normalize=0) della skill ha preservato i pieni 9s di runtime con un volume medio di -17.6dB, proprio nel target documentato di -25..-15dB. Vero attrito: necessita di una chiave API Azure Speech o Gemini a pagamento configurata in ~/.narrate_video.env prima che possa effettivamente sintetizzare il parlato.
Testato il: 2026-07-15 · Claude Code 2.x (agent harness)
Installazione
git clone https://github.com/feiskyer/video-skills mkdir -p ~/.claude/skills cp -r video-skills/skills/narrate-video ~/.claude/skills/narrate-video
Comandi e prompt di esempio
/narrate-videoVoiceover video temporizzato e sincronizzato tramite Azure/Gemini TTS con mux ffmpeg — evita le trappole di amix-silence e audio-cutoff.
Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):
Add a synced voiceover track to this screen recording using TTSDub this product demo without the audio track getting cut off earlyThis video needs narration timed to the scene transitions, add it please