Voice Compose

Sestavuje zadání pro hlasový design a volání generate_voice.js pro postavy a vyprávění

od Utopai-Research · Utopai-Research/pai-pro

Funguje s nastavením ★ 7.6/10

Voice Compose — Sestavuje zadání pro hlasový design a volání generate_voice.js pro postavy a vyprávění

Co umí

Dovednost pro lokální filmové studio PAI-Pro, která formuje výzvy pro hlasový design a volání CLI generate_voice.js k vytváření opakovaně použitelných vzorků barvy hlasu pro každou postavu nebo zvuk vypravěče/VO na plátně. Spouští se, když uživatel požádá o přidělení hlasu postavě, náhled zvuku postavy nebo vytvoření finálního zvuku vyprávění/čtení replik. Vytvoření skutečného zvuku vyžaduje API PAI_KEY a běžící lokální canvas server.

Testovací report

Načten SKILL.md; frontmatter se parsuje (name+description). Namátkově zkontrolovány reference přes raw fetch: server/cli/generate_voice.js a server/pai_voice_client.js oba HTTP 200; PROJECT_AGENT.md je 404 v rootu, ale existuje jako agent-templates/PROJECT_AGENT.md, šablona připravená pro každý projekt za běhu. Čtení pai_voice_client.js potvrdilo, že kontrakt dovednosti je skutečný: --prompt se mapuje na payload.instructions modelu VoiceDesign TTS a --source-node-id je hrana autorství canvasu, takže pravidlo „popište zvuk hlasu, nikdy nepojmenujte postavu“ je zakotveno v kódu. Spouštěče hodnoceny 5/5: aktivují se na „give the detective a voice“, „what would this character sound like — make a sample“, „record the final narrator VO for this line“; správně odmítají „transcribe this audio to text“ (STT) a „write the narrator's intro lines“ (script-compose). Výstup NEMĚŘEN: dodávka je zvuk připojený k canvasu, vyžadující PAI_KEY (placené) plus běžící lokální prohlížeč/server, který nemohu spustit; mohl jsem pouze sestavit volání CLI, ne spustit generate_voice.js nebo slyšet výstup. Žádné bezpečnostní nedostatky v samotné dovednosti (repo .env.example dokumentuje PAI_AGENT_BYPASS, který spouští agenty s --dangerously-skip-permissions, ale to je infrastruktura repozitáře, nesouvisející s touto dovedností).

Testováno: 2026-07-31 · Claude Code 2.x (agent harness)

Instalace

git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src
mkdir -p ~/.claude/skills
cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose
# NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes,
#   $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo.
# To actually generate/attach voice audio you must:
#   1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src
#   2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env
#   3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh)
# Recommended real install is the plugin marketplace: this repo ships
#   .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.

Příkazy a ukázkové prompty

  • /voice-composeSestavuje zadání pro hlasový design a volání generate_voice.js pro postavy a vyprávění

Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):

  • Give this character a distinct voice
  • Preview how this character sounds speaking
  • Generate final narration audio for this scene