Video Podcast Maker
Onderwerp naar 4K videopodcast: onderzoek, script, TTS, Remotion render, BGM mix
Werkt met setup
Wat het doet
Een 15-staps pipeline die een onderwerp omzet in een afgewerkte videopodcast: webonderzoek, een gesegmenteerd narratiescript, TTS-audio met timing.json en SRT, een Remotion-compositie gerenderd op 3840x2160, FFmpeg achtergrondmuziek-mixing, thumbnails en platformspecifieke publicatiemetadata. Activeert wanneer u vraagt om een videopodcast, uitlegvideo of Bilibili/YouTube kennisvideo over een bepaald onderwerp, of vraagt om visuele stijl te leren van een referentievideo of -afbeelding. Ondersteunt zeven TTS-backends (Edge TTS gratis standaard, plus Azure, Doubao, CosyVoice, ElevenLabs, OpenAI, Google) en zh-CN/en-US output met Chinese polyphone-correctie.
Testrapport
Ik downloadde de echte scripts van de skill en voerde ze uit. `check_prereqs.py` printte `ALL_OK (backend=edge)` en `migrate_prefs.py --dry-run` printte `[dry-run] Would create user_prefs.json at v1.6 from template`, dus de Python-kant werkt echt. Voor de output schreef ik een baseline "why HTTP/3 uses QUIC" script voordat ik de body las (4 scènes, 60s, ad-hoc markdown, geen machineleesbaar formaat), volgde daarna references/workflow-script.md Stappen 1-4 en kreeg topic_definition.md plus een podcast.txt met 8 `[SECTION:xxx]` blokken, dichtheidstiers gekoppeld aan de genoemde componentenbibliotheek (ComparisonCard/FlowChart/DataBar), en de platform+taal outro uit de CTA-tabel van de skill; de eigen `generate_tts.py --dry-run` van de skill mat het op 197s / 5971 frames, wat het 3-7min auto-mode doel bevestigt. Dat is een duidelijke, concrete verbetering ten opzichte van de baseline. BEVESTIGDE BUG: `scripts/tts/sections.py` gebruikt `r'\[SECTION:(\w+)\]'`, wat geen koppeltekens matcht, dus de eigen geleverde `templates/podcast_en.txt` markers `[SECTION:content-1..3]` van de skill worden stilzwijgend genegeerd — mijn eerste dry-run rapporteerde "Detected 5 sections" en vouwde drie contentblokken samen in `overview`; hernoemen naar `content_1` gaf de correcte "Detected 8 sections". SKILL.md verwijst ook naar `CLAUDE.md` ("full command reference") en `examples/`, beide HTTP 404 in this copy. Geen beveiligingsproblemen: geen curl|sh, geen base64 blobs, geen geheime exfiltratie, paden gebruiken `${SKILL_DIR}`. outputMeasured=false omdat de geadverteerde levering — een 4K MP4 — een scaffolded Remotion-project, npm install en een ffmpeg render vereist die ik niet heb opgezet; alleen de scriptfase werd gemeten. Let op: dit is een vendored kopie van upstream Agents365-ai/video-podcast-maker binnen een Chinese lokale-zoek-app repo.
Getest op: 2026-07-21 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/dtsola/xiaoyaosearch /tmp/xiaoyaosearch
cd /tmp/xiaoyaosearch
mkdir -p ~/.claude/skills
cp -R /tmp/xiaoyaosearch/.claude/skills/video-podcast-maker ~/.claude/skills/
cp -R /tmp/xiaoyaosearch/.claude/skills/remotion-best-practices ~/.claude/skills/ # hard dependency
brew install ffmpeg node # macOS; node + npx + ffmpeg + python3 required
pip install -r ~/.claude/skills/video-podcast-maker/requirements.txt
python3 ~/.claude/skills/video-podcast-maker/scripts/check_prereqs.py # expect: ALL_OK (backend=edge)
# You also need an existing Remotion project; videos land in videos/{name}/ inside it.
# Optional: set AZURE_SPEECH_KEY / OPENAI_API_KEY / etc. only if you switch off the free `edge` backend. Commando's en voorbeeldprompts
/video-podcast-makerOnderwerp naar 4K videopodcast: onderzoek, script, TTS, Remotion render, BGM mix
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Make a video podcast about this topicLearn this reference video's visual style and apply itGenerate a video podcast with background music