Scriba

Lokale sprecher-diarisierte Meeting-Transkription (whisperX + pyannote), dann Umbenennung von Sprecher 1/2 in echte Namen.

von AlexanderAbramovPav · AlexanderAbramovPav/scriba

Funktioniert mit Setup ★ 8.4/10

Scriba — Lokale sprecher-diarisierte Meeting-Transkription (whisperX + pyannote), dann Umbenennung von Sprecher 1/2 in echte Namen.

Was es kann

Transkribiert ein Audio-/Video-Meeting in ein genaues, sprecherbeschriftetes Markdown-Transkript (Sprecher 1/2/3) mit eingebetteten Sprachclips pro Sprecher und benennt dann Sprecher auf Anfrage in echte Namen um. Löst aus, wenn der Benutzer eine Audio-/Videodatei ablegt und nach einem Transkript, einer Diarisierung oder 'Wer hat was gesagt' (Englisch oder Russisch) fragt.

Testbericht

Der eigene echte Formatter wurde End-to-End auf einem synthetischen diarisierten Transkript ausgeführt: korrekte 62 %/38 % Sprechzeit-Mathematik, sauberer Sprecher-ID-Abschnitt mit Beispielzitaten, dann ein funktionierender Umbenennungsdurchlauf (Sprecher 1/2 -> echte Namen) – wirklich besser als eine naive Baseline-Darstellung. Vollständige ASR+Diarisierung konnte nicht genutzt werden: Sie benötigt `uv` (nicht hier installiert) plus ein kostenloses HuggingFace-Konto und einen 3-Klick-Gated-Model-Zustimmungsfluss, bevor ein ca. 3 GB großer Download überhaupt beginnt, genau wie SKILL.md selbst offenlegt.

Getestet am: 2026-07-15 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/AlexanderAbramovPav/scriba
mkdir -p ~/.claude/skills
cp -r scriba ~/.claude/skills/scriba

Befehle & Beispiel-Prompts

  • /scribaLokale sprecher-diarisierte Meeting-Transkription (whisperX + pyannote), dann Umbenennung von Sprecher 1/2 in echte Namen.

Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):

  • Transcribe this meeting recording and label who said what, please
  • Diarize this audio file and then rename the speakers to their real names
  • I have a Zoom recording, give me a speaker-labeled transcript please