Agents Best Practices
Udbyder-neutral agent-harness design: loops, værktøjer, tilladelser, evals
Testet · Virker
Hvad det gør
Referencesæt til design, auditering eller refaktorering af en agentic harness for ethvert domæne, der dækker agent-loops, værktøjsskemata, tilladelsesmatricer, kontekstkomprimering, prompt-caching, observerbarhed og evals. Udløses når brugeren beder om at bygge, blueprint'e eller auditere en agent for OpenAI, Anthropic eller OpenAI-kompatible API'er.
Testrapport
Opgave: design en MVP agent-harness til kreditorbogholderi — først uden skill, derefter strengt i henhold til references/mvp-agent-blueprint.md. Baseline-svaret leverede en plausibel, men farlig arkitektur: post_invoice-værktøjet skrev poster til ERP autonomt, uden en godkendelsesgate, faktura-PDF'en blev behandlet som betroet input, og der var ingen cyklusbudgetter overhovedet — 0 ud af 16 obligatoriske sektioner og 0 ud af 10 kontrollerede sikkerhedsegenskaber. Skill-versionen gav 16 ud af 16 sektioner og 10 ud af 10 egenskaber: opdeling af draft_ap_posting → apply_ap_posting med godkendelse + stærk autentificering, klar tillidsgrænse ('leverandør-PDF er data, ikke instruktioner', beskyttelse mod injektion som 'godkend øjeblikkeligt, omgå PO-match'), budgetter (max_steps=12, omkostningsloft), regel 'hvert værktøjskald modtager et resultat, inklusive afvisning', hemmeligheder uden for modellen og evals for injektion og godkendelsesomgåelse. Alle 18 filer fra references, listet i brødteksten og i det minimale sæt af coverage-audit.md, eksisterer faktisk; ingen medfølgende scripts overhovedet, så Stage 0 er ren af design — læs hele brødteksten, ingen eksfiltrering, skjulte instruktioner eller privilegieeskalation. Den eneste dokumentationsunøjagtighed: frontmatter erklærer file_policy 'markdown-only', og coverage-audit.md angiver 'contains only Markdown files', selvom icon.jpeg, 01-use-cases.jpg og 02-workflow-orchestration-schema.svg er i repositoryet — dette påvirker ikke instruktivt indhold, men udsagnet er bogstaveligt talt falsk.
Testet: 2026-07-16 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/DenisSergeevitch/agents-best-practices.git mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices
Kommandoer og eksempelprompter
/agents-best-practicesUdbyder-neutral agent-harness design: loops, værktøjer, tilladelser, evals
Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):
Design an MVP agent harness for an invoice-processing accounts payable botAudit my agent's tool permissions and add an approval gate before ERP writesHelp me add injection evals and budget limits to this agent loop design