Narrate Video
Voz en off de video sincronizada y cronometrada a través de Azure/Gemini TTS con mux ffmpeg - evita las trampas de amix-silence y audio-cutoff.
Funciona con configuración
Qué hace
Agrega una pista de voz profesional a cualquier video analizando transiciones de escena, escribiendo segmentos de narración cronometrados, generando voz a través de Azure TTS o Gemini 3.1 Flash TTS, y multiplexando con ffmpeg manteniendo el audio y los visuales sincronizados. Se activa ante solicitudes para agregar narración, voz en off, comentarios o doblaje a un video, incluidas grabaciones de pantalla y frases en chino como "视频配音".
Informe de la prueba
Se ejecutó el pipeline real de ffmpeg en ambos sentidos en un clip de prueba de 9s: la línea base ingenua (una sola pista de narración volcada al principio) truncó silenciosamente el video a 4.5s con -shortest, mientras que el enfoque de segmento/adelay/amix(normalize=0) de la habilidad preservó los 9s completos de tiempo de ejecución con un volumen medio de -17.6dB, justo en el objetivo documentado de -25..-15dB. Fricción real: necesita una clave API de Azure Speech o Gemini de pago configurada en ~/.narrate_video.env antes de que pueda sintetizar voz.
Probado el: 2026-07-15 · Claude Code 2.x (agent harness)
Instalación
git clone https://github.com/feiskyer/video-skills mkdir -p ~/.claude/skills cp -r video-skills/skills/narrate-video ~/.claude/skills/narrate-video
Comandos y prompts de ejemplo
/narrate-videoVoz en off de video sincronizada y cronometrada a través de Azure/Gemini TTS con mux ffmpeg - evita las trampas de amix-silence y audio-cutoff.
Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):
Add a synced voiceover track to this screen recording using TTSDub this product demo without the audio track getting cut off earlyThis video needs narration timed to the scene transitions, add it please