Voice Compose
Sestavuje zadání pro hlasový design a volání generate_voice.js pro postavy a vyprávění
Funguje s nastavením
Co umí
Dovednost pro lokální filmové studio PAI-Pro, která formuje výzvy pro hlasový design a volání CLI generate_voice.js k vytváření opakovaně použitelných vzorků barvy hlasu pro každou postavu nebo zvuk vypravěče/VO na plátně. Spouští se, když uživatel požádá o přidělení hlasu postavě, náhled zvuku postavy nebo vytvoření finálního zvuku vyprávění/čtení replik. Vytvoření skutečného zvuku vyžaduje API PAI_KEY a běžící lokální canvas server.
Testovací report
Načten SKILL.md; frontmatter se parsuje (name+description). Namátkově zkontrolovány reference přes raw fetch: server/cli/generate_voice.js a server/pai_voice_client.js oba HTTP 200; PROJECT_AGENT.md je 404 v rootu, ale existuje jako agent-templates/PROJECT_AGENT.md, šablona připravená pro každý projekt za běhu. Čtení pai_voice_client.js potvrdilo, že kontrakt dovednosti je skutečný: --prompt se mapuje na payload.instructions modelu VoiceDesign TTS a --source-node-id je hrana autorství canvasu, takže pravidlo „popište zvuk hlasu, nikdy nepojmenujte postavu“ je zakotveno v kódu. Spouštěče hodnoceny 5/5: aktivují se na „give the detective a voice“, „what would this character sound like — make a sample“, „record the final narrator VO for this line“; správně odmítají „transcribe this audio to text“ (STT) a „write the narrator's intro lines“ (script-compose). Výstup NEMĚŘEN: dodávka je zvuk připojený k canvasu, vyžadující PAI_KEY (placené) plus běžící lokální prohlížeč/server, který nemohu spustit; mohl jsem pouze sestavit volání CLI, ne spustit generate_voice.js nebo slyšet výstup. Žádné bezpečnostní nedostatky v samotné dovednosti (repo .env.example dokumentuje PAI_AGENT_BYPASS, který spouští agenty s --dangerously-skip-permissions, ale to je infrastruktura repozitáře, nesouvisející s touto dovedností).
Testováno: 2026-07-31 · Claude Code 2.x (agent harness)
Instalace
git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src mkdir -p ~/.claude/skills cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose # NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes, # $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo. # To actually generate/attach voice audio you must: # 1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src # 2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env # 3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh) # Recommended real install is the plugin marketplace: this repo ships # .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.
Příkazy a ukázkové prompty
/voice-composeSestavuje zadání pro hlasový design a volání generate_voice.js pro postavy a vyprávění
Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):
Give this character a distinct voicePreview how this character sounds speakingGenerate final narration audio for this scene