Scriba
Lokální transkripce schůzky s diarizací řečníků (whisperX + pyannote), poté přejmenování Speaker 1/2 na skutečná jména.
Funguje s nastavením
Co umí
Přepisuje audio/video schůzku do přesného, řečníkem označeného Markdown přepisu (Speaker 1/2/3) s vloženými hlasovými klipy pro každého řečníka, poté na požádání přejmenuje řečníky na skutečná jména. Spouští se, když uživatel vloží audio/video soubor a požádá o přepis, diarizaci nebo 'who said what' (anglicky nebo rusky).
Testovací report
Spustil svůj vlastní skutečný formátovač end-to-end na syntetickém diarizovaném přepisu: správná matematika doby hovoru 62%/38%, čistá sekce ID řečníka s ukázkovými citacemi, poté funkční přejmenování (Speaker 1/2 -> skutečná jména) – skutečně lepší než naivní baseline render. Plná ASR+diarizace nemohla být procvičena: vyžaduje `uv` (zde není nainstalováno) plus bezplatný účet HuggingFace a 3-klikový tok souhlasu s gated-modelem, než se vůbec spustí stahování ~3GB, přesně jak uvádí samotný SKILL.md.
Testováno: 2026-07-15 · Claude Code 2.x (agent harness)
Instalace
git clone https://github.com/AlexanderAbramovPav/scriba mkdir -p ~/.claude/skills cp -r scriba ~/.claude/skills/scriba
Příkazy a ukázkové prompty
/scribaLokální transkripce schůzky s diarizací řečníků (whisperX + pyannote), poté přejmenování Speaker 1/2 na skutečná jména.
Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):
Transcribe this meeting recording and label who said what, pleaseDiarize this audio file and then rename the speakers to their real namesI have a Zoom recording, give me a speaker-labeled transcript please