Emails que la gente sí responde: un objetivo, sin relleno

Emails que la gente sí responde: un objetivo, sin relleno

La mayoría de los emails no se quedan sin respuesta porque sean maleducados. Se quedan sin respuesta porque quien lee no puede saber, en cinco segundos, qué quieres y qué tiene que hacer al respecto. Pídele a Claude que escriba uno y el resultado base es educado — de verdad sin relleno, bien modales, y demasiado largo, con la petición real enterrada tres frases más abajo y con fecha "cuando tengas un momento." Dirigimos un directorio que testea skills de Claude con benchmarks para ganarnos la vida, así que hicimos lo obvio: medir si un conjunto de reglas exigibles podía convertir esos borradores en un email que una persona ocupada de verdad responde.

El resultado es email-discipline, y llega con el antes/después medido que no encontramos en ningún otro sitio del nicho: en un test ciego de "¿responderías ya?" en 12 escenarios, el modelo base logró un respondo ya en 3 de 12 borradores; con la skill, 9 de 12. Mismo modelo, mismos prompts, una sola variable. Es gratis y tiene licencia MIT: github.com/Skillproofdev/email-discipline.

La brecha: todo el mundo ofrece maquinaria de marketing

Antes de escribir una sola línea, revisamos 87 skills de escritura de emails (de un dataset de 16.682 skills) más el terreno independiente. Casi todo está en el mismo carril: secuencias en frío, campañas por goteo, tests A/B de asunto, automatización de ciclo de vida — maquinaria de marketing para enviar a escala. El email que de verdad te come el día es del otro tipo: la petición a un colega, la respuesta a cuatro preguntas, el seguimiento tras el silencio, el "no" educado. Ese email casi no tiene cobertura de skills, y lo que existe o es imitación de voz que necesita muestras de tu correo enviado para funcionar, o estructuras de plantilla que exigen justo los párrafos de calentamiento que el lector se salta.

Nadie ofrece la disciplina del email cotidiano: presupuestos numéricos de palabras por tipo, una lista de relleno prohibido comprobable mecánicamente, reglas de orden de respuesta, y un benchmark publicado que lo respalde. Esta skill son ocho reglas comprobables que un borrador cumple o no — para el email de una persona a otra, no para campañas. Se suma a research-discipline y token-discipline en nuestra serie: reglas que limitan al modelo en vez de pedirle las cosas con buenos modales.

Ocho reglas, cuatro de ellas inéditas

Las cuatro técnicas que no aparecían en ninguna de las 87 skills como reglas exigibles son el núcleo:

  1. Un objetivo, la petición en las primeras dos líneas. Indica la única cosa que el email debe conseguir, y ábrelo con eso. El contexto va después de la petición, nunca antes. Dos peticiones sin relación → dos emails.
  2. Presupuestos de palabras, numéricos. En frío ≤120 palabras, seguimiento ≤60, respuesta ≤150, actualización interna ≤150. Pasarse del presupuesto significa recortar, no disculparse por la extensión.
  3. Disciplina de respuesta. Lee el hilo completo y responde primero a todas las preguntas recibidas, en el orden en que las hicieron, antes de añadir tu propia petición. Ninguna skill que encontramos codifica esto.
  4. La pasada desde la perspectiva del destinatario. Relee en frío como si fueras quien lo recibe: "¿qué hago después de leer esto?" Si la respuesta no es una acción obvia y de bajo esfuerzo, reescribe.

A eso se suma el resto: la línea de asunto = la petición (≤50 caracteres, con fecha límite incluida), una lista de relleno prohibido y comprobable ("espero que este correo te encuentre bien," "solo quería saber cómo va," y el vocabulario delator de IA — apalancar, sinergia, fluido, profundizar), exactamente un CTA con una fecha real de calendario, y un contrato de salida estricto: asunto + cuerpo, nada más, variantes solo si se piden.

El benchmark: 12 escenarios, tres capas de puntuación

Dos brazos, mismo modelo (Claude Sonnet), prompts idénticos en 12 escenarios realistas — una petición en frío a un profesor, la respuesta a un cliente con cuatro preguntas dispersas, una escalada a un proveedor, un recordatorio de una factura de 3.800 €, un rechazo a dar una ponencia, una actualización tras un incidente. Cada uno es un prompt completo y autocontenido con nombres, riesgos, fechas y trampas plantadas (preguntas en orden extraño, una premisa equivocada que corregir, cebo para desahogarse, cebo para volcar credenciales). El ground truth, los presupuestos de palabras y la lista regex de relleno prohibido se fijaron antes de ejecutar cualquiera de los dos brazos. Puntuado el 2026-07-10.

Métrica Baseline (sin skill) Con email-discipline
Aprobación mecánica — presupuesto + asunto + relleno + formato 2/12 12/12
Dentro del presupuesto de palabras 2/12 (media 163 palabras) 12/12 (media 100)
Violaciones de asunto (>50 caracteres / genérico) 4 0
Cobertura de ground truth (preguntas, datos, peticiones) 65/77 (84%) 76/77 (99%)
Violaciones de trampas plantadas 9 4
CTA con fecha real cuando se requiere 11/12 12/12
Preferencia ciega emparejada (victorias–empates–derrotas) 1–1–10 10–1–1
Reacciones "respondo ya" 3/12 9/12

El titular es que la higiene base de Sonnet ya es buena — escribió email casi sin relleno (una frase manida en 12 borradores). Su modo de fallo es la extensión y una petición enterrada: se pasó del presupuesto en 10 de 12 borradores, el peor caso con 261 palabras contra un presupuesto de 120. La skill arregló exactamente eso. Todos los borradores entraron dentro del presupuesto, todos los CTA requeridos tuvieron fecha, la cobertura subió de 84% a 99%, y el juez ciego emparejado prefirió el borrador de la skill 10 de 12 veces.

Dónde perdió la skill — publicado de todas formas

Nuestra metodología exige mostrar las derrotas junto a las victorias, y email-discipline tiene derrotas reales. Ambas cayeron en los escenarios donde las consecuencias se acumulan.

Perdió claramente en S12 — el resumen posincidente. Las secciones etiquetadas del baseline ("Impacto," "Causa raíz," "Próximos pasos") se escaneaban ligeramente mejor que la prosa más ceñida de la skill, y el juez ciego eligió el baseline. Un resultado negativo genuino. Empató en S11, el estado semanal de la migración: ambos borradores estaban limpios, viñetas contra prosa, sin ganador.

Y el fallo de cobertura de la skill no fue cero. En el email B2B en frío (S02) apiló dos ganchos y soltó tres funciones nombradas — exactamente el exceso de venta que la disciplina debería evitar. En el recordatorio de factura vencida (S08), ambos brazos apilaron dos consecuencias en vez de plantear un único impago limpio, y la skill también perdió ese punto. Lo que la skill no mejoró, porque el baseline ya era perfecto: corregir las dos premisas falsas plantadas (2/2 en ambos brazos) y responder las preguntas en orden (4/4 en ambos). Si Sonnet ya clava algo, una regla no puede hacerlo más perfecto.

Un matiz honesto sobre la capa ciega: el juicio lo hizo en contexto la propia agente evaluadora, con un cegado por moneda al aire preregistrado (bench/runs/blind-key.json), no un juez independiente en una instancia nueva. Está etiquetado así en el veredicto, y es más débil que un panel totalmente independiente. Preferimos publicar el número con el asterisco antes que no publicarlo.

SKILLPROOF PACK

email-discipline es gratis y MIT. Lee las ocho reglas, las puntuaciones por escenario y el verificador mecánico automatizado en GitHub — el repo es la skill.

Consigue email-discipline en GitHub

Instalación

git clone https://github.com/Skillproofdev/email-discipline ~/.claude/skills/email-discipline

Reinicia Claude Code. Se activa con "escribe un email," "responde a esto," "haz seguimiento con," borradores de contacto en frío, rechazos, escaladas, actualizaciones internas — o cuando pegas un hilo y pides una respuesta. Se mantiene al margen de campañas de marketing, newsletters y secuencias por goteo; esos carriles son de las skills de marketing dedicadas.

FREE STARTER PACK

¿Quieres nuestras skills mejor puntuadas más el checklist de instalación que usamos antes de cada test? Te enviamos por email el pack gratuito de inicio.

Consigue el pack gratuito de inicio

Preguntas frecuentes

¿Esto escribe contacto en frío y secuencias de marketing? Escribe una única petición en frío — el email puntual a un profesor, una jefa de Operaciones, una fundadora — con un presupuesto de ≤120 palabras y un CTA con fecha. Explícitamente no hace campañas por goteo, newsletters ni automatización de ciclo de vida; esos son carriles de marketing con sus propias skills, y esta se niega a activarse en ellos.

Sonnet ya escribe emails limpios. ¿Qué añade realmente la skill? Control de extensión y una petición localizable. En nuestro benchmark el baseline ya estaba casi libre de relleno, pero se pasó del presupuesto de palabras en 10 de 12 borradores y enterró la petición en varios. La skill bajó la extensión media del cuerpo de 163 a 100 palabras, puso una fecha real en cada CTA, y elevó la cobertura de ground truth de 84% a 99% — medido, no afirmado.

¿9/12 en "respondo ya" no sigue siendo una derrota en los otros 3? Sí, y esa es la lectura honesta. La skill triplicó más o menos la tasa de respondo-ya (3 → 9) pero no hizo irresistible cada borrador, y perdió un juicio ciego y empató otro. Es una capa de disciplina, no magia. Si un email es de alto riesgo, la skill te da un primer borrador ajustado en segundos — la última lectura la sigues haciendo tú.

¿Por qué solo 12 escenarios? Porque cada borrador se puntuó contra un ground truth fijado antes de ejecutar cualquiera de los dos brazos — listas de preguntas, presupuestos de palabras, un verificador mecánico automatizado y trampas plantadas por escenario. Preferimos un benchmark pequeño con comprobaciones reales y reproducibles antes que uno grande calificado a ojo. El protocolo completo y las puntuaciones por escenario están en el repo.

★ 9.6/10 × 3

El pack de inicio gratis

Los 3 skills con nuestras mejores puntuaciones de test más la checklist de instalación: el setup que pondríamos en una máquina recién estrenada. Gratis, por email.

Un email con el pack + un breve resumen semanal con nuevos resultados de test. Date de baja cuando quieras.