Narrate Video
Zeitgesteuertes, synchronisiertes Video-Voiceover über Azure/Gemini TTS mit ffmpeg mux – vermeidet die amix-silence und Audio-Cutoff-Fallen.
Funktioniert mit Setup
Was es kann
Fügt jedem Video eine professionelle Voiceover-Spur hinzu, indem Szenenübergänge analysiert, zeitgesteuerte Erzählsegmente geschrieben, Sprache über Azure TTS oder Gemini 3.1 Flash TTS generiert und mit ffmpeg gemixt wird, während Audio und Video synchron gehalten werden. Löst bei Anfragen zum Hinzufügen von Erzählungen, Voiceover, Kommentaren oder Synchronisationen zu einem Video aus, einschließlich Bildschirmaufnahmen und chinesischer Phrasen wie "视频配音".
Testbericht
Die echte ffmpeg-Pipeline wurde auf einem 9s-Testclip in beide Richtungen ausgeführt: Die naive Baseline (eine einzelne Erzählspur, die am Anfang ausgegeben wurde) schnitt das Video stillschweigend auf 4,5s über -shortest ab, während der Segment-/adelay-/amix(normalize=0)-Ansatz des Skills die vollen 9s Laufzeit mit einer mittleren Lautstärke von -17,6 dB beibehielt, genau im dokumentierten Zielbereich von -25..-15 dB. Echte Reibung: Benötigt einen bezahlten Azure Speech oder Gemini API-Schlüssel, der in ~/.narrate_video.env konfiguriert ist, bevor er tatsächlich Sprache synthetisieren kann.
Getestet am: 2026-07-15 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/feiskyer/video-skills mkdir -p ~/.claude/skills cp -r video-skills/skills/narrate-video ~/.claude/skills/narrate-video
Befehle & Beispiel-Prompts
/narrate-videoZeitgesteuertes, synchronisiertes Video-Voiceover über Azure/Gemini TTS mit ffmpeg mux – vermeidet die amix-silence und Audio-Cutoff-Fallen.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Add a synced voiceover track to this screen recording using TTSDub this product demo without the audio track getting cut off earlyThis video needs narration timed to the scene transitions, add it please