E-poster folk faktisk svarer på: ett mål, null KI-fyll

E-poster folk faktisk svarer på: ett mål, null KI-fyll

De fleste e-poster forblir ikke ubesvart fordi de er uhøflige. De forblir ubesvart fordi leseren ikke kan se, i løpet av fem sekunder, hva du vil og hva de skal gjøre med det. Be Claude skrive en, og baseline-resultatet er høflig — genuint fri for fyllord, veloppdragen, og for langt, med selve forespørselen begravd tre setninger inn og datert «når du får tid». Vi driver en katalog som benchmarker Claude-skills til daglig, så vi gjorde det opplagte: målte om et sett håndhevbare regler kunne gjøre de utkastene om til e-post en travel person faktisk svarer på.

Resultatet er email-discipline, og den kommer med det målte før/etter vi ikke fant andre steder i nisjen: på en blind «ville du svart nå?»-test på tvers av 12 scenarioer fikk baseline-modellen et svar-nå3 av 12 utkast; med skillen, 9 av 12. Samme modell, samme prompter, én variabel. Den er gratis og MIT-lisensiert: github.com/Skillproofdev/email-discipline.

Gapet: alle leverer markedsføringsmaskineri

Før vi skrev en eneste linje kartla vi 87 e-post-skrivende skills (fra et datasett på 16 682 skills) pluss det frittstående feltet. Nesten alt er i samme bane: kalde sekvenser, drypp-kampanjer, A/B-tester på emnelinjer, livssyklus-automatisering — markedsføringsmaskineri for utsending i stor skala. E-posten som faktisk spiser opp dagen din er av en annen sort: forespørselen til en kollega, fire-spørsmåls-svaret, oppfølgingen etter stillhet, det høflige nei-et. Den e-posten har nesten ingen skill-dekning, og det som finnes er enten stemme-imitasjon som krever eksempler fra din egen sendte post for å fungere, eller malstrukturer som pålegger nettopp de oppvarmingsavsnittene lesere hopper over.

Ingen leverer hverdags-e-post-disiplinen: numeriske ordbudsjetter etter type, en mekanisk gjennomsøkbar fyll-forbudsliste, svarrekkefølge-regler, og en publisert benchmark som støtter det. Denne skillen er åtte sjekkbare regler et utkast enten består eller ikke består — for e-post fra ett menneske til et annet, ikke kampanjer. Den sitter sammen med research-discipline og token-discipline i vår serie: regler som begrenser modellen i stedet for å be den pent.

Åtte regler, fire av dem nye

De fire teknikkene som fantes i ingen av de 87 skillene som håndhevbare regler, er kjernen:

  1. Ett mål, forespørselen i de to første linjene. Angi den ene tingen e-posten må oppnå, og led med den. Kontekst kommer etter forespørselen, aldri før. To urelaterte forespørsler → to e-poster.
  2. Ordbudsjetter, numeriske. Kald ≤120 ord, oppfølging ≤60, svar ≤150, intern oppdatering ≤150. Over budsjett betyr kutt, ikke unnskyld lengden.
  3. Svar-disiplin. Les hele tråden, svar deretter på hvert innkommende spørsmål først, i spørrerens rekkefølge, før du legger til din egen forespørsel. Ingen skill vi fant kodifiserer dette i det hele tatt.
  4. Mottaker-perspektiv-gjennomgangen. Les kaldt på nytt som mottakeren: «hva gjør jeg etter å ha lest dette?» Hvis svaret ikke er én åpenbar, lav-innsats-handling, skriv om.

Pluss resten: emnelinje = forespørselen (≤50 tegn, frist inkludert), en gjennomsøkbar fyll-forbudsliste («håper alt er bra med deg», «bare en rask sjekk», og KI-avslørende ordforråd — leverage, synergi, sømløs, dykke ned i), nøyaktig én CTA med en ekte kalenderdato, og en streng utdata-kontrakt: emne + brødtekst, ingenting annet, varianter kun på forespørsel.

Benchmarken: 12 scenarioer, tre score-lag

To armer, samme modell (Claude Sonnet), identiske prompter på tvers av 12 realistiske scenarioer — en kald forespørsel til en professor, et kundesvar med fire spredte spørsmål, en leverandøreskalering, en purring på en faktura på 3 800 €, et avslag på en hovedtale, en oppdatering etter en hendelse. Hver er en fullstendig, selvstendig prompt med navn, innsats, datoer og plantede feller (spørsmål i rar rekkefølge, en feil premiss å rette opp, ventile-agn, agn for å dumpe innloggingsdetaljer). Fasit, ordbudsjetter og den frosne fyll-regex-listen ble fastlåst før noen av armene kjørte. Scoret 2026-07-10.

Metrikk Baseline (uten skill) Med email-discipline
Mekanisk bestått — budsjett + emne + fyll + format 2/12 12/12
Innenfor ordbudsjett 2/12 (snitt 163 ord) 12/12 (snitt 100)
Emnelinje-brudd (>50 tegn / generisk) 4 0
Fasit-dekning (spørsmål, fakta, forespørsler) 65/77 (84 %) 76/77 (99 %)
Plantet-felle-brudd 9 4
CTA med ekte dato der påkrevd 11/12 12/12
Blind parvis preferanse (seire–uavgjort–tap) 1–1–10 10–1–1
«Ville svart nå»-reaksjoner 3/12 9/12

Hovedpoenget er at Sonnets baseline-hygiene allerede er god — den skrev nesten fyllfri e-post (én klisjéfrase i 12 utkast). Feilmåten er lengde og en begravd forespørsel: over budsjett på 10 av 12 utkast, verste tilfelle 261 ord mot et 120-budsjett. Skillen fikset nettopp det. Hvert utkast kom under budsjett, hver påkrevde CTA fikk en dato, dekningen klatret 84 % → 99 %, og den blinde parvise dommeren foretrakk skill-utkastet 10 av 12 ganger.

Der skillen tapte — publisert likevel

Vår metodikk krever at tapene vises ved siden av seirene, og email-discipline har ekte tap. Begge landet på scenarioene der konsekvensene hoper seg opp.

Den tapte S12 helt — sammendraget etter en hendelse. Baselinens merkede seksjoner («Konsekvens», «Grunnårsak», «Neste steg») skannet marginalt bedre enn skillens strammere prosa, og den blinde dommeren valgte baseline. Et ekte negativt resultat. Den fikk uavgjort på S11, den ukentlige migreringsstatusen: begge utkastene var rene, punktlister mot prosa, ingen vinner.

Og skillens dekningsbom var ikke null. På den kalde B2B-e-posten (S02) stablet den to kroker og dumpet tre navngitte funksjoner — akkurat det oversalget disiplinen skal forhindre. På purringen for forfalt faktura (S08) stablet begge armer to konsekvenser i stedet for å oppgi ett rent standardvalg, og skillen tapte det poenget også. Det skillen ikke forbedret, fordi baseline allerede var perfekt: å rette de to plantede falske premissene (2/2 begge armer) og svare på spørsmål i rekkefølge (4/4 begge). Hvis Sonnet allerede mestrer noe, kan en regel ikke gjøre det mer perfekt.

Ett ærlig forbehold om det blinde laget: dommen ble gjort in-context av score-agenten med en forhåndsregistrert myntkast-blinding (bench/runs/blind-key.json), ikke av en uavhengig fersk-instans-dommer. Det er merket som sådan i vurderingen, og det er svakere enn et fullstendig uavhengig panel. Vi sender tallet med stjernenote i stedet for uten tallet.

SKILLPROOF-PAKKE

email-discipline er gratis og MIT. Les de åtte reglene, scoren per scenario og den scriptede mekaniske sjekkeren på GitHub — repoet er skillen.

Hent email-discipline på GitHub

Installasjon

git clone https://github.com/Skillproofdev/email-discipline ~/.claude/skills/email-discipline

Start Claude Code på nytt. Den trigger på «skriv en e-post», «svar på denne», «følg opp med», kalde utsendelser, avslag, eskaleringer, interne oppdateringer — eller når du limer inn en tråd og ber om et svar. Den holder seg unna markedsføringskampanjer, nyhetsbrev og drypp-sekvenser; dedikerte markedsføringsskills eier de banene.

GRATIS STARTPAKKE

Vil du ha våre høyest scorede skills pluss installasjonssjekklisten vi kjører før hver test? Vi sender deg den gratis startpakken på e-post.

Få den gratis startpakken

Ofte stilte spørsmål

Skriver denne kalde utsendelser og markedsføringssekvenser? Den skriver én enkelt kald forespørsel — engangs-e-posten til en professor, en driftssjef, en gründer — med et ≤120-ords budsjett og én datert CTA. Den gjør uttrykkelig ikke drypp-kampanjer, nyhetsbrev eller livssyklus-automatisering; det er markedsføringsbaner med sine egne skills, og skillen nekter å trigge på dem.

Sonnet skriver allerede ren e-post. Hva tilfører skillen egentlig? Lengdekontroll og en synlig forespørsel. I vår benchmark var baseline allerede nesten fyllfri, men sprengte ordbudsjettet på 10 av 12 utkast og begravde forespørselen i flere av dem. Skillen tok gjennomsnittlig brødtekstlengde fra 163 ord til 100, satte en ekte dato på hver CTA, og løftet fasit-dekningen fra 84 % til 99 % — målt, ikke påstått.

Er ikke 9/12 «svar nå» fortsatt et tap på 3 av dem? Ja, og det er den ærlige lesningen. Skillen omtrent tredoblet svar-nå-raten (3 → 9) men gjorde ikke hvert utkast uimotståelig, og den tapte én blind vurdering og fikk uavgjort på en annen. Det er et disiplinlag, ikke magi. Hvis en e-post har høy innsats, gir skillen deg et stramt førsteutkast på sekunder — du gjør fortsatt siste gjennomlesning.

Hvorfor bare 12 scenarioer? Fordi hvert utkast ble scoret mot en fasit fastlåst før noen av armene kjørte — spørsmålslister, ordbudsjetter, en scriptet mekanisk sjekker, og plantede feller per scenario. Vi foretrekker en liten benchmark der sjekkene er ekte og reproduserbare, fremfor en stor gradert på magefølelse. Hele protokollen og scoren per scenario finner du i repoet.

★ 9.6/10 × 3

Den gratis startpakken

De 3 skillsene med våre høyeste testscorer pluss installasjonssjekklisten — oppsettet vi selv ville lagt på en fersk maskin. Gratis, på e-post.

Én e-post med pakken + en kort ukentlig oppsummering av nye testresultater. Meld deg av når du vil.