Voice Compose
Stelt voice-design briefs en generate_voice.js aanroepen samen voor personages en narratie
Werkt met setup
Wat het doet
Een skill voor de lokale PAI-Pro filmstudio die voice-design prompts en de generate_voice.js CLI-aanroep vormgeeft om herbruikbare timbre-samples per personage of narrator/VO-audio op het canvas te creëren. Het triggert wanneer de gebruiker vraagt om een personage een stem te geven, een preview te krijgen van hoe een personage klinkt, of om definitieve narratie/line-read audio te produceren. Het produceren van daadwerkelijke audio vereist de PAI_KEY API en een draaiende lokale canvas server.
Testrapport
SKILL.md opgehaald; frontmatter parseert (name+description). Referenties steekproefsgewijs gecontroleerd via raw fetch: server/cli/generate_voice.js en server/pai_voice_client.js beide HTTP 200; PROJECT_AGENT.md is 404 op root maar bestaat als agent-templates/PROJECT_AGENT.md, een template dat per project wordt klaargezet tijdens runtime. Het lezen van pai_voice_client.js bevestigde dat het contract van de skill reëel is: --prompt mapt naar payload.instructions van een VoiceDesign TTS-model en --source-node-id is een canvas authorship edge, dus de regel "beschrijf het geluid van de stem, noem nooit het personage" is gebaseerd op de code. Triggers beoordeeld 5/5: activeert op "geef de detective een stem", "hoe zou dit personage klinken — maak een sample", "neem de uiteindelijke narrator VO op voor deze regel"; weigert correct "transcribeer deze audio naar tekst" (STT) en "schrijf de introductieregels van de narrator" (script-compose). Output NIET gemeten: de oplevering is audio gekoppeld aan het canvas, waarvoor PAI_KEY (betaald) plus een draaiende lokale viewer/server nodig is die ik niet kan starten; ik kon alleen de CLI-aanroep samenstellen, niet generate_voice.js uitvoeren of output horen. Geen beveiligingsrisico's in de skill zelf (repo .env.example documenteert een PAI_AGENT_BYPASS die agents uitvoert met --dangerously-skip-permissions, maar dat is repo-infra, niet gerelateerd aan deze skill).
Getest op: 2026-07-31 · Claude Code 2.x (agent harness)
Installatie
git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src mkdir -p ~/.claude/skills cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose # NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes, # $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo. # To actually generate/attach voice audio you must: # 1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src # 2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env # 3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh) # Recommended real install is the plugin marketplace: this repo ships # .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.
Commando's en voorbeeldprompts
/voice-composeStelt voice-design briefs en generate_voice.js aanroepen samen voor personages en narratie
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Give this character a distinct voicePreview how this character sounds speakingGenerate final narration audio for this scene