Inngest Agent Evals
Kopplar produktions-Inngest-agentutvärderingar: direkt/uppskjuten poängsättning, sessioner och A/B-experiment.
Testad · Fungerar
Vad den gör
Lägger till Inngests v4-utvärderingsprimitiver — step.score, uppskjutna createScorer-scorers, meta.sessions-korrelation och group.experiment A/B-jämförelser — till en produktions-AI-agent eller arbetsflöde byggt på Inngest. Aktiveras när användaren vill poängsätta, utvärdera, felsöka eller A/B-testa agent-/arbetsflödesresultat, eller migrera en befintlig Inngest-app för att lägga till produktionsutvärderingar.
Testrapport
Typkontrollerade färdighetens exakta kodmönster mot det verkliga, för närvarande publicerade inngest@4.12.1-paketet på npm — scoreMiddleware, createScorer, group.experiment och experimentRef kompilerades alla rena — medan en baslinje från minnet återuppfann ett icke-beständigt, otilldelat poängsystem som POSTar till ett påhittat mätvärdes-endpoint och slår tärning om sitt 'experiment' med Math.random().
Testad: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/inngest/inngest-skills cd inngest-skills mkdir -p ~/.claude/skills cp -r skills/inngest-agent-evals ~/.claude/skills/inngest-agent-evals
Kommandon och exempelprompter
/inngest-agent-evalsKopplar produktions-Inngest-agentutvärderingar: direkt/uppskjuten poängsättning, sessioner och A/B-experiment.
Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):
Add quality scoring to my Inngest support-ticket agent functionI need an A/B test comparing two prompt strategies in InngestWire up deferred eval scoring from user feedback in Inngest