Mejl folk faktiskt svarar på: ett mål, ingen fluff

Mejl folk faktiskt svarar på: ett mål, ingen fluff

De flesta mejl förblir inte obesvarade för att de är oartiga. De förblir obesvarade för att läsaren inte på fem sekunder kan avgöra vad du vill och vad hen ska göra åt saken. Be Claude skriva ett, och resultatet i baslinjen är artigt — genuint utan utfyllnad, väluppfostrat och för långt, med den faktiska begäran begravd tre meningar in och daterad "när du får en stund." Vi driver en katalog som benchmarkar Claude-skills på heltid, så vi gjorde det uppenbara: mätte om ett antal tvingande regler kunde göra om de utkasten till mejl som en upptagen person faktiskt svarar på.

Resultatet är email-discipline, och den kommer med det uppmätta före/efter vi inte kunde hitta någon annanstans i nischen: i ett blint "skulle du svara nu?"-test över 12 scenarier fick basmodellen ett svara-nu3 av 12 utkast; med skillen, 9 av 12. Samma modell, samma prompt, en enda variabel. Den är gratis och MIT-licensierad: github.com/Skillproofdev/email-discipline.

Luckan: alla levererar marknadsföringsmaskineri

Innan vi skrev en enda rad kartlade vi 87 mejlskrivande skills (ur ett dataset på 16 682 skills) plus fältet i övrigt. Nästan allt ligger i samma fält: kalla sekvenser, dripp-kampanjer, A/B-test av ämnesrader, livscykelautomation — marknadsföringsmaskineri för utskick i stor skala. Mejlet som faktiskt äter upp din dag är av det andra slaget: begäran till en kollega, svaret på fyra frågor, uppföljningen efter tystnad, det artiga nejet. Det mejlet har nästan ingen täckning bland skills, och det som finns är antingen röstimitation som behöver exempel på din egen skickade post för att fungera, eller mallstrukturer som kräver just de uppvärmningsstycken läsare hoppar över.

Ingen levererar den vardagliga mejldisciplinen: numeriska ordbudgetar per typ, en mekaniskt avläsbar lista över förbjudna klichéer, regler för svarsordning och ett publicerat benchmark som backar upp det. Den här skillen är åtta kontrollerbara regler ett utkast antingen klarar eller inte — för mejl från en människa till en annan, inte kampanjer. Den sällar sig till research-discipline och token-discipline i vår serie: regler som begränsar modellen istället för att be den snällt.

Åtta regler, fyra av dem nya

De fyra teknikerna som inte fanns i någon av de 87 skillsen som tvingande regler är kärnan:

  1. Ett mål, begäran i de första två raderna. Ange den enda sak mejlet måste uppnå, och led med den. Sammanhanget kommer efteråt, aldrig innan. Två orelaterade begäranden → två mejl.
  2. Ordbudgetar, numeriska. Kallt mejl ≤120 ord, uppföljning ≤60, svar ≤150, intern uppdatering ≤150. Över budget betyder skär, inte be om ursäkt för längden.
  3. Svarsdisciplin. Läs hela tråden, besvara sedan varje inkommande fråga först, i frågeställarens ordning, innan du lägger till din egen begäran. Ingen skill vi hittade kodifierar det här alls.
  4. Genomgången ur mottagarens perspektiv. Läs om kallt, som mottagaren: "vad gör jag efter att ha läst det här?" Om svaret inte är en tydlig, lågansträngd handling, skriv om.

Plus resten: ämnesraden = begäran (≤50 tecken, deadline inkluderad), en avläsbar lista över förbjudna klichéer ("jag hoppas du mår bra," "bara en påminnelse," och de AI-avslöjande orden — leverage, synergi, sömlös, fördjupa sig), exakt en CTA med ett riktigt kalenderdatum, och ett strikt kontrakt för utdata: ämnesrad + brödtext, inget mer, varianter bara på begäran.

Benchmarket: 12 scenarier, tre poänglager

Två grenar, samma modell (Claude Sonnet), identiska prompter över 12 realistiska scenarier — en kall förfrågan till en professor, ett kundsvar med fyra spridda frågor, en leverantörseskalering, en påminnelse om en faktura på 3 800 €, ett avböjande av ett huvudtalarinbjudan, en incidentuppdatering. Varje scenario är en fullständig, självständig prompt med namn, insatser, datum och planterade fällor (frågor i konstig ordning, ett felaktigt antagande som ska rättas, ventilerande bete, bete om att dumpa inloggningsuppgifter). Facit, ordbudgetar och listan med förbjudna klichéer (regex) fastställdes innan någon gren kördes. Poängsatt 2026-07-10.

Mått Baslinje (utan skill) Med email-discipline
Mekanisk godkänd — budget + ämnesrad + klichéer + format 2/12 12/12
Inom ordbudget 2/12 (medel 163 ord) 12/12 (medel 100)
Ämnesradsbrott (>50 tecken / generisk) 4 0
Facit-täckning (frågor, fakta, begäranden) 65/77 (84%) 76/77 (99%)
Brott mot planterade fällor 9 4
CTA med riktigt datum där det krävs 11/12 12/12
Blind parvis preferens (vinst–oavgjort–förlust) 1–1–10 10–1–1
"Skulle svara nu"-reaktioner 3/12 9/12

Huvudnumret är att Sonnets hygien i baslinjen redan är bra — den skrev nästan klichéfria mejl (en enda sliten fras på 12 utkast). Dess svaghet är längd och en begravd begäran: över budget på 10 av 12 utkast, värsta fall 261 ord mot en budget på 120. Skillen fixade precis det. Varje utkast kom in under budget, varje krävd CTA fick ett datum, täckningen klättrade från 84% till 99%, och den blinda paruppdelade domaren föredrog skillens utkast 10 gånger av 12.

Där skillen förlorade — publicerat ändå

Vår metodik kräver att förlusterna redovisas bredvid vinsterna, och email-discipline har riktiga sådana. Båda hamnade i scenarierna där konsekvenser hopar sig.

Den förlorade S12 rakt av — incidentsammanfattningen efteråt. Baslinjens märkta rubriker ("Påverkan," "Grundorsak," "Nästa steg") skummades marginellt bättre än skillens tätare prosa, och den blinda domaren valde baslinjen. Ett äkta negativt resultat. Den delade S11, veckans migrationsstatus: båda utkasten var rena, punktlistor mot prosa, ingen vinnare.

Och skillens täckningsmiss var inte noll. På det kalla B2B-mejlet (S02) staplade den två krokar och dumpade tre namngivna funktioner — exakt det översäljande disciplinen ska förhindra. På den förfallna fakturapåminnelsen (S08) staplade båda grenarna två konsekvenser istället för att ange ett enda tydligt standardval, och skillen förlorade den poängen också. Det skillen inte förbättrade, för att baslinjen redan var perfekt: att korrigera de två planterade falska antagandena (2/2 båda grenarna) och besvara svarsfrågor i ordning (4/4 båda). Om Sonnet redan gör något perfekt kan en regel inte göra det mer perfekt.

Ett ärligt förbehåll om det blinda lagret: bedömningen gjordes i kontext av poängsättningsagenten med en förregistrerad slantsingling-blindning (bench/runs/blind-key.json), inte av en oberoende domare i en ny instans. Det är märkt som sådant i bedömningen, och det är svagare än en helt oberoende panel. Vi levererar siffran med asterisken hellre än utan siffran.

SKILLPROOF-PAKETET

email-discipline är gratis och MIT. Läs de åtta reglerna, poängen per scenario och den skriptade mekaniska kontrollen på GitHub — repot är skillen.

Hämta email-discipline på GitHub

Installation

git clone https://github.com/Skillproofdev/email-discipline ~/.claude/skills/email-discipline

Starta om Claude Code. Den triggas av "skriv ett mejl," "svara på det här," "följ upp med," kalla utskick, avböjanden, eskaleringar, interna uppdateringar — eller när du klistrar in en tråd och ber om ett svar. Den håller sig undan från marknadsföringskampanjer, nyhetsbrev och dripp-sekvenser; dedikerade marknadsföringsskills äger de fälten.

GRATIS STARTPAKET

Vill du ha våra bäst testade skills plus installationschecklistan vi kör inför varje test? Vi mejlar dig det gratis startpaketet.

Hämta det gratis startpaketet

FAQ

Skriver den kalla utskick och marknadsföringssekvenser? Den skriver en enskild kall förfrågan — engångsmejlet till en professor, en driftchef, en grundare — med en budget på ≤120 ord och en daterad CTA. Den gör uttryckligen inte dripp-kampanjer, nyhetsbrev eller livscykelautomation; det är marknadsföringsfält med egna skills, och skillen vägrar trigga på dem.

Sonnet skriver redan rent mejl. Vad tillför skillen egentligen? Längdkontroll och en synlig begäran. I vårt benchmark var baslinjen redan nästan klichéfri men sprängde ordbudgeten på 10 av 12 utkast och begravde begäran i flera. Skillen tog medellängden på brödtexten från 163 ord till 100, satte ett riktigt datum på varje CTA och lyfte facit-täckningen från 84% till 99% — uppmätt, inte påstått.

Är inte 9/12 "svara nu" fortfarande en förlust på 3 av dem? Ja, och det är den ärliga läsningen. Skillen ungefär tredubblade andelen svara-nu (3 → 9) men gjorde inte varje utkast oemotståndligt, och den förlorade en blind bedömning och delade en annan. Det är ett disciplinlager, inte magi. Om ett mejl har hög insats ger skillen dig ett tajt förstautkast på sekunder — du gör fortfarande sista genomläsningen.

Varför bara 12 scenarier? För att varje utkast poängsattes mot facit som fastställdes innan någon gren kördes — frågelistor, ordbudgetar, en skriptad mekanisk kontroll och planterade fällor per scenario. Vi föredrar ett litet benchmark där kontrollerna är riktiga och reproducerbara framför ett stort som bedöms på magkänsla. Hela protokollet och poängen per scenario finns i repot.

★ 9.6/10 × 3

Gratis startpaket

De 3 skills som fått våra högsta testbetyg plus installationschecklistan — setupen vi själva skulle lägga på en ny maskin. Gratis, via e-post.

Ett mejl med paketet + en kort veckosammanfattning av nya testresultat. Avsluta prenumerationen när du vill.