Voice Compose

Tworzy briefy projektowe głosu i wywołania generate_voice.js dla postaci i narracji

Autor: Utopai-Research · Utopai-Research/pai-pro

Działa po konfiguracji ★ 7.6/10

Voice Compose — Tworzy briefy projektowe głosu i wywołania generate_voice.js dla postaci i narracji

Co robi ten skill

Umiejętność dla lokalnego studia filmowego PAI-Pro, która kształtuje podpowiedzi projektowania głosu i wywołanie CLI generate_voice.js do tworzenia próbek barwy dźwięku wielokrotnego użytku dla każdej postaci lub narracji/audio VO na płótnie. Uruchamia się, gdy użytkownik prosi o nadanie postaci głosu, podgląd brzmienia postaci lub wyprodukowanie finalnego audio narracji/odczytu linii. Produkcja rzeczywistego audio wymaga API PAI_KEY i działającego lokalnego serwera canvas.

Raport z testu

Pobrano SKILL.md; frontmatter parsowany (name+description). Sprawdzono referencje poprzez surowe pobranie: server/cli/generate_voice.js i server/pai_voice_client.js oba HTTP 200; PROJECT_AGENT.md jest 404 w katalogu głównym, ale istnieje jako agent-templates/PROJECT_AGENT.md, szablon przygotowywany dla każdego projektu w czasie wykonania. Odczyt pai_voice_client.js potwierdził, że kontrakt umiejętności jest prawdziwy: --prompt mapuje się do payload.instructions modelu VoiceDesign TTS, a --source-node-id to krawędź autorstwa canvas, więc zasada „opisz brzmienie głosu, nigdy nie nazywaj postaci” jest ugruntowana w kodzie. Wyzwalacze oceniono 5/5: aktywacja na „give the detective a voice”, „what would this character sound like — make a sample”, „record the final narrator VO for this line”; prawidłowo odrzucono „transcribe this audio to text” (STT) i „write the narrator's intro lines” (script-compose). Wynik NIE mierzony: dostarczalnym jest audio dołączone do canvas, wymagające PAI_KEY (płatne) plus działającego lokalnego podglądu/serwera, którego nie mogę uruchomić; mogłem tylko skomponować wywołanie CLI, nie uruchomić generate_voice.js ani usłyszeć wyjścia. Brak zagrożeń bezpieczeństwa w samej umiejętności (repo .env.example dokumentuje PAI_AGENT_BYPASS, który uruchamia agentów z --dangerously-skip-permissions, ale to jest infrastruktura repozytorium, niezwiązana z tą umiejętnością).

Testowano: 2026-07-31 · Claude Code 2.x (agent harness)

Instalacja

git clone --depth 1 https://github.com/Utopai-Research/pai-pro.git /tmp/voice-compose-src
mkdir -p ~/.claude/skills
cp -R /tmp/voice-compose-src/skills/voice-compose ~/.claude/skills/voice-compose
# NOT standalone. The skill only shapes prompts + a CLI call; the CLI it invokes,
#   $PAI_REPO_ROOT/server/cli/generate_voice.js, lives in the full pai-pro repo.
# To actually generate/attach voice audio you must:
#   1. Keep the whole cloned repo and export PAI_REPO_ROOT=/tmp/voice-compose-src
#   2. Set PAI_KEY (paid; get at https://pai-pro.utopaistudios.com/keys) in .env
#   3. Run the local canvas viewer/server (./scripts/start.sh or docker-start.sh)
# Recommended real install is the plugin marketplace: this repo ships
#   .claude-plugin/marketplace.json exposing /pai-pro:voice-compose.

Komendy i przykładowe prompty

  • /voice-composeTworzy briefy projektowe głosu i wywołania generate_voice.js dla postaci i narracji

Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):

  • Give this character a distinct voice
  • Preview how this character sounds speaking
  • Generate final narration audio for this scene