Voice Compose
Komponerer stemmedesign-briefs og generate_voice.js-kald til karakterer og fortælling
Virker med opsætning
Hvad det gør
En færdighed til PAI-Pro's lokale filmstudie, der former stemmedesign-prompts og generate_voice.js CLI-kaldet for at skabe genanvendelige klangprøver per karakter eller fortæller/VO-lyd på lærredet. Den udløses, når brugeren beder om at give en karakter en stemme, forhåndsvise hvordan en karakter lyder, eller producere endelig fortælling/replik-lyd. Produktion af faktisk lyd kræver PAI_KEY API'en og en kørende lokal canvas-server.
Testrapport
Hentede SKILL.md; frontmatter parser (name+description). Kontrollerede referencer via rå hentning: server/cli/generate_voice.js og server/pai_voice_client.js begge HTTP 200; PROJECT_AGENT.md er 404 ved roden, men findes som agent-templates/PROJECT_AGENT.md, en skabelon iscenesat per projekt ved runtime. Læsning af pai_voice_client.js bekræftede, at færdighedens kontrakt er reel: --prompt mapper til payload.instructions af en VoiceDesign TTS-model, og --source-node-id er en canvas-forfatterkant, så reglen "beskriv stemmens lyd, navngiv aldrig karakteren" er forankret i koden. Triggere bedømt 5/5: aktiveres ved "giv detektiven en stemme", "hvordan ville denne karakter lyde — lav en prøve", "optag den endelige fortæller-VO for denne replik"; afviser korrekt "transkriber denne lyd til tekst" (STT) og "skriv fortællerens introduktionslinjer" (script-compose). Output IKKE målt: leverancen er lyd knyttet til lærredet, kræver PAI_KEY (betalt) plus en kørende lokal viewer/server, jeg ikke kan starte; jeg kunne kun komponere CLI-kaldet, ikke køre generate_voice.js eller høre output. Ingen sikkerhedsbrister i selve færdigheden (repo .env.example dokumenterer en PAI_AGENT_BYPASS, der kører agenter med --dangerously-skip-permissions, men det er repo-infrastruktur, urelateret til denne færdighed).
Testet: 2026-07-31 · Claude Code 2.x (agent harness)
Installation
git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src mkdir -p ~/.claude/skills cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose # NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes, # $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo. # To actually generate/attach voice audio you must: # 1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src # 2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env # 3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh) # Recommended real install is the plugin marketplace: this repo ships # .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.
Kommandoer og eksempelprompter
/voice-composeKomponerer stemmedesign-briefs og generate_voice.js-kald til karakterer og fortælling
Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):
Give this character a distinct voicePreview how this character sounds speakingGenerate final narration audio for this scene