Scriba
Transcripción local de reuniones con diarización de hablantes (whisperX + pyannote), luego renombra Speaker 1/2 a nombres reales.
Funciona con configuración
Qué hace
Transcribe una reunión de audio/video en una transcripción Markdown precisa y etiquetada por hablante (Speaker 1/2/3) con clips de voz incrustados por hablante, luego renombra los hablantes a nombres reales a pedido. Se activa cuando el usuario suelta un archivo de audio/video y solicita una transcripción, diarización o 'quién dijo qué' (inglés o ruso).
Informe de la prueba
Se ejecutó el formateador real de extremo a extremo en una transcripción diarizada sintética: matemáticas correctas de tiempo de habla del 62%/38%, sección limpia de identificación de hablante con citas de ejemplo, luego una pasada de renombre de hablante funcional (Speaker 1/2 -> nombres reales) - genuinamente mejor que una representación de línea base ingenua. No se pudo ejercitar el ASR + diarización completos: necesita `uv` (no instalado aquí) más una cuenta gratuita de HuggingFace y un flujo de consentimiento de modelo con puerta de 3 clics antes de que comience la descarga de ~3 GB, exactamente como SKILL.md mismo divulga.
Probado el: 2026-07-15 · Claude Code 2.x (agent harness)
Instalación
git clone https://github.com/AlexanderAbramovPav/scriba mkdir -p ~/.claude/skills cp -r scriba ~/.claude/skills/scriba
Comandos y prompts de ejemplo
/scribaTranscripción local de reuniones con diarización de hablantes (whisperX + pyannote), luego renombra Speaker 1/2 a nombres reales.
Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):
Transcribe this meeting recording and label who said what, pleaseDiarize this audio file and then rename the speakers to their real namesI have a Zoom recording, give me a speaker-labeled transcript please