Scriba

Lokální transkripce schůzky s diarizací řečníků (whisperX + pyannote), poté přejmenování Speaker 1/2 na skutečná jména.

od AlexanderAbramovPav · AlexanderAbramovPav/scriba

Funguje s nastavením ★ 8.4/10

Scriba — Lokální transkripce schůzky s diarizací řečníků (whisperX + pyannote), poté přejmenování Speaker 1/2 na skutečná jména.

Co umí

Přepisuje audio/video schůzku do přesného, řečníkem označeného Markdown přepisu (Speaker 1/2/3) s vloženými hlasovými klipy pro každého řečníka, poté na požádání přejmenuje řečníky na skutečná jména. Spouští se, když uživatel vloží audio/video soubor a požádá o přepis, diarizaci nebo 'who said what' (anglicky nebo rusky).

Testovací report

Spustil svůj vlastní skutečný formátovač end-to-end na syntetickém diarizovaném přepisu: správná matematika doby hovoru 62%/38%, čistá sekce ID řečníka s ukázkovými citacemi, poté funkční přejmenování (Speaker 1/2 -> skutečná jména) – skutečně lepší než naivní baseline render. Plná ASR+diarizace nemohla být procvičena: vyžaduje `uv` (zde není nainstalováno) plus bezplatný účet HuggingFace a 3-klikový tok souhlasu s gated-modelem, než se vůbec spustí stahování ~3GB, přesně jak uvádí samotný SKILL.md.

Testováno: 2026-07-15 · Claude Code 2.x (agent harness)

Instalace

git clone https://github.com/AlexanderAbramovPav/scriba
mkdir -p ~/.claude/skills
cp -r scriba ~/.claude/skills/scriba

Příkazy a ukázkové prompty

  • /scribaLokální transkripce schůzky s diarizací řečníků (whisperX + pyannote), poté přejmenování Speaker 1/2 na skutečná jména.

Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):

  • Transcribe this meeting recording and label who said what, please
  • Diarize this audio file and then rename the speakers to their real names
  • I have a Zoom recording, give me a speaker-labeled transcript please