
Des e-mails auxquels on répond vraiment, sans blabla IA
La plupart des e-mails restent sans réponse non pas parce qu'ils sont impolis. Mais parce que le lecteur ne peut pas dire, en cinq secondes, ce que vous voulez et ce qu'il doit en faire. Demandez à Claude d'en écrire un et le résultat de base est poli — vraiment sans blabla, bien élevé, et trop long, avec la vraie demande enterrée trois phrases plus loin et datée « quand vous aurez un moment ». Nous dirigeons un annuaire qui teste les skills Claude à longueur de journée, alors nous avons fait la chose évidente : mesurer si un ensemble de règles applicables pouvait transformer ces brouillons en e-mails auxquels une personne occupée répond vraiment.
Le résultat s'appelle email-discipline, et il est livré avec le avant/après mesuré que nous n'avons trouvé nulle part ailleurs dans ce créneau : sur un test en aveugle « répondriez-vous maintenant ? » portant sur 12 scénarios, le modèle de base a obtenu un je réponds maintenant sur 3 des 12 brouillons ; avec le skill, 9 sur 12. Même modèle, mêmes prompts, une seule variable. Il est gratuit et sous licence MIT : github.com/Skillproofdev/email-discipline.
Le vide : tout le monde livre de la machinerie marketing
Avant d'écrire une ligne, nous avons passé en revue 87 skills d'écriture d'e-mails (sur un jeu de données de 16 682 skills), plus le champ hors plateforme. Presque tout se range dans la même case : séquences de prospection, campagnes de goutte-à-goutte, tests A/B d'objets, automatisation de cycle de vie — de la machinerie marketing pour envoyer à grande échelle. L'e-mail qui vous bouffe vraiment la journée est d'un autre genre : la demande à un collègue, la réponse en quatre points, la relance après un silence, le refus poli. Cet e-mail-là n'a presque aucune couverture de skill, et ce qui existe est soit du mimétisme de voix qui a besoin d'échantillons de vos e-mails envoyés pour fonctionner, soit des structures à modèle qui imposent justement les paragraphes d'échauffement que les lecteurs sautent.
Personne ne propose la discipline de l'e-mail du quotidien : budgets de mots numériques par type, une liste de blabla interdit mécaniquement repérable, des règles d'ordre de réponse, et un benchmark publié pour l'étayer. Ce skill, ce sont huit règles vérifiables qu'un brouillon respecte ou non — pour l'e-mail d'un humain à un autre, pas pour les campagnes. Il rejoint research-discipline et token-discipline dans notre série : des règles qui contraignent le modèle plutôt que de le prier gentiment.
Huit règles, dont quatre inédites
Les quatre techniques qui n'apparaissaient dans aucun des 87 skills comme règles applicables forment le cœur du dispositif :
- Un seul objectif, la demande dans les deux premières lignes. Énoncez la seule chose que l'e-mail doit accomplir, puis commencez par ça. Le contexte vient après la demande, jamais avant. Deux demandes sans rapport → deux e-mails.
- Des budgets de mots, chiffrés. Prospection ≤120 mots, relance ≤60, réponse ≤150, point interne ≤150. Au-delà du budget, on coupe, on ne s'excuse pas de la longueur.
- Discipline de la réponse. Lire tout le fil, puis répondre à chaque question posée en premier, dans l'ordre où elle a été posée, avant d'ajouter sa propre demande. Aucun skill trouvé ne codifie ça.
- La relecture côté destinataire. Relire à froid comme le destinataire : « qu'est-ce que je fais après avoir lu ça ? » Si la réponse n'est pas une action évidente et peu coûteuse, on réécrit.
Plus le reste : objet = la demande (≤50 caractères, échéance incluse), une liste de blabla interdit mécaniquement repérable (« j'espère que vous allez bien », « je fais juste un petit point », et le vocabulaire trahissant l'IA — leverage, synergy, seamless, delve), exactement un CTA avec une vraie date de calendrier, et un contrat de sortie strict : objet + corps, rien d'autre, des variantes uniquement sur demande.
Le benchmark : 12 scénarios, trois couches de notation
Deux bras, même modèle (Claude Sonnet), prompts identiques sur 12 scénarios réalistes — une demande à froid à un professeur, une réponse client avec quatre questions éparpillées, une escalade fournisseur, une relance de facture de 3 800 €, un refus de keynote, un point post-incident. Chacun est un prompt autonome complet avec noms, enjeux, dates et pièges implantés (questions dans un ordre inhabituel, une prémisse fausse à corriger, appât à épanchement, appât à fuite d'identifiants). Vérité terrain, budgets de mots et liste regex du blabla interdit ont été figés avant que l'un ou l'autre bras ne tourne. Noté le 2026-07-10.
| Métrique | Base (sans skill) | Avec email-discipline |
|---|---|---|
| Réussite mécanique — budget + objet + blabla + format | 2/12 | 12/12 |
| Dans le budget de mots | 2/12 (moyenne 163 mots) | 12/12 (moyenne 100) |
| Objets non conformes (>50 caractères / génériques) | 4 | 0 |
| Couverture de vérité terrain (questions, faits, demandes) | 65/77 (84 %) | 76/77 (99 %) |
| Violations des pièges implantés | 9 | 4 |
| CTA avec une vraie date là où requis | 11/12 | 12/12 |
| Préférence appariée en aveugle (victoires-égalités-défaites) | 1–1–10 | 10–1–1 |
| Réactions « je réponds maintenant » | 3/12 | 9/12 |
Le point marquant, c'est que l'hygiène de base de Sonnet est déjà bonne — il écrit un e-mail quasiment sans blabla (une seule formule toute faite sur 12 brouillons). Son point faible, c'est la longueur et une demande enterrée : au-delà du budget sur 10 brouillons sur 12, avec un pire cas à 261 mots pour un budget de 120. Le skill a corrigé exactement ça. Chaque brouillon est resté dans le budget, chaque CTA requis a eu sa date, la couverture est passée de 84 % à 99 %, et le juge apparié en aveugle a préféré le brouillon avec skill 10 fois sur 12.
Là où le skill a perdu — publié quand même
Notre méthodologie exige que les pertes soient publiées à côté des gains, et email-discipline en a de réelles. Les deux se situent sur les scénarios où les conséquences s'accumulent.
Il a franchement perdu S12 — le récapitulatif post-incident. Les sections étiquetées de la base (« Impact », « Cause racine », « Prochaines étapes ») étaient un peu plus faciles à scanner que la prose plus resserrée du skill, et le juge en aveugle a préféré la base. Un vrai résultat négatif. Il a fait match nul sur S11, le point hebdomadaire de migration : les deux brouillons étaient propres, puces contre prose, aucun gagnant.
Et le raté de couverture du skill n'a pas été nul. Sur l'e-mail B2B à froid (S02), il a empilé deux accroches et cité trois fonctionnalités nommées — exactement la survente que la discipline est censée empêcher. Sur la relance de facture en retard (S08), les deux bras ont empilé deux conséquences au lieu d'énoncer un seul défaut clair, et le skill a aussi perdu ce point-là. Ce que le skill n'a pas amélioré, parce que la base était déjà parfaite : corriger les deux fausses prémisses implantées (2/2 pour les deux bras) et répondre aux questions dans l'ordre (4/4 pour les deux). Si Sonnet réussit déjà quelque chose, une règle ne peut pas le rendre plus parfait.
Une réserve honnête sur la couche « en aveugle » : le jugement a été fait dans le même contexte par l'agent de notation, avec un tirage à pile ou face pré-enregistré pour l'aveuglement (bench/runs/blind-key.json), pas par un juge indépendant dans une instance neuve. C'est étiqueté comme tel dans le verdict, et c'est plus faible qu'un panel entièrement indépendant. Nous publions le chiffre avec l'astérisque plutôt que sans le chiffre.
PACK SKILLPROOF
email-discipline est gratuit et sous licence MIT. Lisez les huit règles, les scores par scénario et le vérificateur mécanique scripté sur GitHub — le dépôt est le skill.
Obtenir email-discipline sur GitHubInstallation
git clone https://github.com/Skillproofdev/email-discipline ~/.claude/skills/email-discipline
Redémarrez Claude Code. Il se déclenche sur « write an email », « reply to this », « follow up with », les brouillons de prospection à froid, les refus, les escalades, les points internes — ou quand vous collez un fil et demandez une réponse. Il reste en retrait pour les campagnes marketing, les newsletters et les séquences de goutte-à-goutte ; les skills marketing dédiés couvrent ces créneaux.
PACK DE DÉMARRAGE GRATUIT
Envie de nos skills les mieux notés et de la checklist d'installation que nous suivons avant chaque test ? Nous vous envoyons le pack de démarrage gratuit par e-mail.
Obtenir le pack de démarrage gratuitFAQ
Est-ce que ça écrit de la prospection à froid et des séquences marketing ? Ça écrit une seule demande à froid — l'e-mail ponctuel à un professeur, un responsable des opérations, un fondateur — avec un budget ≤120 mots et un CTA daté. Ça ne fait explicitement pas de campagnes de goutte-à-goutte, de newsletters ni d'automatisation de cycle de vie ; ce sont des créneaux marketing avec leurs propres skills, et celui-ci refuse de s'y déclencher.
Sonnet écrit déjà des e-mails propres. Qu'est-ce que le skill apporte vraiment ? Le contrôle de la longueur et une demande repérable. Dans notre benchmark, la base était déjà quasiment sans blabla, mais elle dépassait le budget de mots sur 10 brouillons sur 12 et enterrait la demande sur plusieurs. Le skill a fait passer la longueur moyenne du corps de 163 à 100 mots, a mis une vraie date sur chaque CTA, et a fait grimper la couverture de vérité terrain de 84 % à 99 % — mesuré, pas affirmé.
9/12 « je réponds maintenant », n'est-ce pas quand même un échec sur 3 ? Si, et c'est la lecture honnête. Le skill a à peu près triplé le taux de réponse immédiate (3 → 9) mais n'a pas rendu chaque brouillon irrésistible, et il a perdu un jugement en aveugle et fait match nul sur un autre. C'est une couche de discipline, pas de la magie. Si un e-mail est à fort enjeu, le skill vous donne un premier brouillon serré en quelques secondes — vous faites quand même la relecture finale.
Pourquoi seulement 12 scénarios ? Parce que chaque brouillon a été noté par rapport à une vérité terrain figée avant que l'un ou l'autre bras ne tourne — listes de questions, budgets de mots, vérificateur mécanique scripté, et pièges implantés par scénario. Nous préférons un petit benchmark aux vérifications réelles et reproductibles plutôt qu'un grand noté au ressenti. Le protocole complet et les scores par scénario sont dans le dépôt.
★ 9.6/10 × 3
Le pack de démarrage gratuit
Les 3 skills avec nos meilleurs scores de test, plus la checklist d'installation — le setup qu'on mettrait sur une machine neuve. Gratuit, par e-mail.