Agents Best Practices

Leverandørnøytral agent-harness-design: looper, verktøy, tillatelser, evals

av DenisSergeevitch · DenisSergeevitch/agents-best-practices

Bestått ★ 9.2/10

Agents Best Practices — Leverandørnøytral agent-harness-design: looper, verktøy, tillatelser, evals

Hva den gjør

Referansesett for design, revisjon eller refaktorering av en agentisk 'harness' for ethvert domene, som dekker agentlooper, verktøyskjemaer, tillatelsesmatriser, kontekstkomprimering, prompt-caching, observerbarhet og evals. Utløses når brukeren ber om å bygge, tegne eller revidere en agent for OpenAI, Anthropic eller OpenAI-kompatible APIer.

Testrapport

Oppgave: design en MVP agent-harness for behandling av leverandørgjeld — først uten ferdighet, deretter strengt i henhold til references/mvp-agent-blueprint.md. Grunnlinjesvaret ga en plausibel, men farlig arkitektur: post_invoice-verktøyet skrev oppføringer til ERP autonomt, uten en godkjenningsport, faktura-PDFen ble behandlet som pålitelig input, og det var ingen syklusbudsjetter i det hele tatt — 0 av 16 obligatoriske seksjoner og 0 av 10 kontrollerte sikkerhetsegenskaper. Ferdighetsversjonen ga 16 av 16 seksjoner og 10 av 10 egenskaper: splitting av draft_ap_posting → apply_ap_posting med godkjenning + sterk autentisering, klar tillitsgrense ('leverandør-PDF er data, ikke instruksjoner', beskyttelse mot injeksjon som 'godkjenn umiddelbart, omgå PO-match'), budsjetter (max_steps=12, kostnadstak), regel 'hvert verktøykall mottar et resultat, inkludert avslag', hemmeligheter utenfor modellen, og evals for injeksjon og godkjenningsomgåelse. Alle 18 filer fra references, listet i brødteksten og i det minimale settet av coverage-audit.md, eksisterer faktisk; ingen medfølgende skript i det hele tatt, så Trinn 0 er rent av design — leste hele brødteksten, ingen eksfiltrering, skjulte instruksjoner eller privilegieeskalering. Den eneste dokumentasjonsunøyaktigheten: frontmatter erklærer file_policy 'markdown-only', og coverage-audit.md sier 'contains only Markdown files', selv om icon.jpeg, 01-use-cases.jpg og 02-workflow-orchestration-schema.svg er i repositoriet — dette påvirker ikke instruktivt innhold, men utsagnet er bokstavelig talt feil.

Testet på: 2026-07-16 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/DenisSergeevitch/agents-best-practices.git
mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices

Kommandoer og eksempelprompter

  • /agents-best-practicesLeverandørnøytral agent-harness-design: looper, verktøy, tillatelser, evals

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Design an MVP agent harness for an invoice-processing accounts payable bot
  • Audit my agent's tool permissions and add an approval gate before ERP writes
  • Help me add injection evals and budget limits to this agent loop design