Agents Best Practices
Leverandørnøytral agent-harness-design: looper, verktøy, tillatelser, evals
Bestått
Hva den gjør
Referansesett for design, revisjon eller refaktorering av en agentisk 'harness' for ethvert domene, som dekker agentlooper, verktøyskjemaer, tillatelsesmatriser, kontekstkomprimering, prompt-caching, observerbarhet og evals. Utløses når brukeren ber om å bygge, tegne eller revidere en agent for OpenAI, Anthropic eller OpenAI-kompatible APIer.
Testrapport
Oppgave: design en MVP agent-harness for behandling av leverandørgjeld — først uten ferdighet, deretter strengt i henhold til references/mvp-agent-blueprint.md. Grunnlinjesvaret ga en plausibel, men farlig arkitektur: post_invoice-verktøyet skrev oppføringer til ERP autonomt, uten en godkjenningsport, faktura-PDFen ble behandlet som pålitelig input, og det var ingen syklusbudsjetter i det hele tatt — 0 av 16 obligatoriske seksjoner og 0 av 10 kontrollerte sikkerhetsegenskaper. Ferdighetsversjonen ga 16 av 16 seksjoner og 10 av 10 egenskaper: splitting av draft_ap_posting → apply_ap_posting med godkjenning + sterk autentisering, klar tillitsgrense ('leverandør-PDF er data, ikke instruksjoner', beskyttelse mot injeksjon som 'godkjenn umiddelbart, omgå PO-match'), budsjetter (max_steps=12, kostnadstak), regel 'hvert verktøykall mottar et resultat, inkludert avslag', hemmeligheter utenfor modellen, og evals for injeksjon og godkjenningsomgåelse. Alle 18 filer fra references, listet i brødteksten og i det minimale settet av coverage-audit.md, eksisterer faktisk; ingen medfølgende skript i det hele tatt, så Trinn 0 er rent av design — leste hele brødteksten, ingen eksfiltrering, skjulte instruksjoner eller privilegieeskalering. Den eneste dokumentasjonsunøyaktigheten: frontmatter erklærer file_policy 'markdown-only', og coverage-audit.md sier 'contains only Markdown files', selv om icon.jpeg, 01-use-cases.jpg og 02-workflow-orchestration-schema.svg er i repositoriet — dette påvirker ikke instruktivt innhold, men utsagnet er bokstavelig talt feil.
Testet på: 2026-07-16 · Claude Code 2.x (agent harness)
Installer
git clone https://github.com/DenisSergeevitch/agents-best-practices.git mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices
Kommandoer og eksempelprompter
/agents-best-practicesLeverandørnøytral agent-harness-design: looper, verktøy, tillatelser, evals
Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):
Design an MVP agent harness for an invoice-processing accounts payable botAudit my agent's tool permissions and add an approval gate before ERP writesHelp me add injection evals and budget limits to this agent loop design