Scriba
Lokale sprecher-diarisierte Meeting-Transkription (whisperX + pyannote), dann Umbenennung von Sprecher 1/2 in echte Namen.
Funktioniert mit Setup
Was es kann
Transkribiert ein Audio-/Video-Meeting in ein genaues, sprecherbeschriftetes Markdown-Transkript (Sprecher 1/2/3) mit eingebetteten Sprachclips pro Sprecher und benennt dann Sprecher auf Anfrage in echte Namen um. Löst aus, wenn der Benutzer eine Audio-/Videodatei ablegt und nach einem Transkript, einer Diarisierung oder 'Wer hat was gesagt' (Englisch oder Russisch) fragt.
Testbericht
Der eigene echte Formatter wurde End-to-End auf einem synthetischen diarisierten Transkript ausgeführt: korrekte 62 %/38 % Sprechzeit-Mathematik, sauberer Sprecher-ID-Abschnitt mit Beispielzitaten, dann ein funktionierender Umbenennungsdurchlauf (Sprecher 1/2 -> echte Namen) – wirklich besser als eine naive Baseline-Darstellung. Vollständige ASR+Diarisierung konnte nicht genutzt werden: Sie benötigt `uv` (nicht hier installiert) plus ein kostenloses HuggingFace-Konto und einen 3-Klick-Gated-Model-Zustimmungsfluss, bevor ein ca. 3 GB großer Download überhaupt beginnt, genau wie SKILL.md selbst offenlegt.
Getestet am: 2026-07-15 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/AlexanderAbramovPav/scriba mkdir -p ~/.claude/skills cp -r scriba ~/.claude/skills/scriba
Befehle & Beispiel-Prompts
/scribaLokale sprecher-diarisierte Meeting-Transkription (whisperX + pyannote), dann Umbenennung von Sprecher 1/2 in echte Namen.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Transcribe this meeting recording and label who said what, pleaseDiarize this audio file and then rename the speakers to their real namesI have a Zoom recording, give me a speaker-labeled transcript please