Voice Compose
Komponerer stemmedesign-briefs og generate_voice.js-kall for karakterer og fortelling
Krever oppsett
Hva den gjør
En ferdighet for PAI-Pro lokale filmstudio som former stemmedesign-prompter og generate_voice.js CLI-kall for å lage gjenbrukbare klangprøver per karakter eller forteller/VO-lyd på lerretet. Den utløses når brukeren ber om å gi en karakter en stemme, forhåndsvise hvordan en karakter høres ut, eller produsere endelig forteller-/replikklesingslyd. Produksjon av faktisk lyd krever PAI_KEY API og en kjørende lokal canvas-server.
Testrapport
SKILL.md hentet; frontmatter parses (name+description). Referanser stikkprøvekontrollert via rå henting: server/cli/generate_voice.js og server/pai_voice_client.js begge HTTP 200; PROJECT_AGENT.md er 404 ved rot, men finnes som agent-templates/PROJECT_AGENT.md, en mal iscenesatt per prosjekt ved kjøretid. Lesing av pai_voice_client.js bekreftet ferdighetens kontrakt er reell: --prompt mapper til payload.instructions i en VoiceDesign TTS-modell og --source-node-id er en canvas authorship edge, så regelen "beskriv stemmens lyd, aldri navngi karakteren" er forankret i koden. Utløsere vurdert 5/5: aktiveres på "give the detective a voice", "what would this character sound like — make a sample", "record the final narrator VO for this line"; avviser korrekt "transcribe this audio to text" (STT) og "write the narrator's intro lines" (script-compose). Utdata IKKE målt: leveransen er lyd knyttet til lerretet, krever PAI_KEY (betalt) pluss en kjørende lokal visningsprogram/server jeg ikke kan starte; jeg kunne bare komponere CLI-kallet, ikke kjøre generate_voice.js eller høre utdata. Ingen sikkerhetsbrudd i selve ferdigheten (repo .env.example dokumenterer en PAI_AGENT_BYPASS som kjører agenter med --dangerously-skip-permissions, men det er repo-infrastruktur, urelatert til denne ferdigheten).
Testet på: 2026-07-31 · Claude Code 2.x (agent harness)
Installer
git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src mkdir -p ~/.claude/skills cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose # NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes, # $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo. # To actually generate/attach voice audio you must: # 1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src # 2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env # 3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh) # Recommended real install is the plugin marketplace: this repo ships # .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.
Kommandoer og eksempelprompter
/voice-composeKomponerer stemmedesign-briefs og generate_voice.js-kall for karakterer og fortelling
Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):
Give this character a distinct voicePreview how this character sounds speakingGenerate final narration audio for this scene