Agents Best Practices

Udbyder-neutral agent-harness design: loops, værktøjer, tilladelser, evals

Af DenisSergeevitch · DenisSergeevitch/agents-best-practices

Testet · Virker ★ 9.2/10

Agents Best Practices — Udbyder-neutral agent-harness design: loops, værktøjer, tilladelser, evals

Hvad det gør

Referencesæt til design, auditering eller refaktorering af en agentic harness for ethvert domæne, der dækker agent-loops, værktøjsskemata, tilladelsesmatricer, kontekstkomprimering, prompt-caching, observerbarhed og evals. Udløses når brugeren beder om at bygge, blueprint'e eller auditere en agent for OpenAI, Anthropic eller OpenAI-kompatible API'er.

Testrapport

Opgave: design en MVP agent-harness til kreditorbogholderi — først uden skill, derefter strengt i henhold til references/mvp-agent-blueprint.md. Baseline-svaret leverede en plausibel, men farlig arkitektur: post_invoice-værktøjet skrev poster til ERP autonomt, uden en godkendelsesgate, faktura-PDF'en blev behandlet som betroet input, og der var ingen cyklusbudgetter overhovedet — 0 ud af 16 obligatoriske sektioner og 0 ud af 10 kontrollerede sikkerhedsegenskaber. Skill-versionen gav 16 ud af 16 sektioner og 10 ud af 10 egenskaber: opdeling af draft_ap_posting → apply_ap_posting med godkendelse + stærk autentificering, klar tillidsgrænse ('leverandør-PDF er data, ikke instruktioner', beskyttelse mod injektion som 'godkend øjeblikkeligt, omgå PO-match'), budgetter (max_steps=12, omkostningsloft), regel 'hvert værktøjskald modtager et resultat, inklusive afvisning', hemmeligheder uden for modellen og evals for injektion og godkendelsesomgåelse. Alle 18 filer fra references, listet i brødteksten og i det minimale sæt af coverage-audit.md, eksisterer faktisk; ingen medfølgende scripts overhovedet, så Stage 0 er ren af design — læs hele brødteksten, ingen eksfiltrering, skjulte instruktioner eller privilegieeskalation. Den eneste dokumentationsunøjagtighed: frontmatter erklærer file_policy 'markdown-only', og coverage-audit.md angiver 'contains only Markdown files', selvom icon.jpeg, 01-use-cases.jpg og 02-workflow-orchestration-schema.svg er i repositoryet — dette påvirker ikke instruktivt indhold, men udsagnet er bogstaveligt talt falsk.

Testet: 2026-07-16 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/DenisSergeevitch/agents-best-practices.git
mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices

Kommandoer og eksempelprompter

  • /agents-best-practicesUdbyder-neutral agent-harness design: loops, værktøjer, tilladelser, evals

Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):

  • Design an MVP agent harness for an invoice-processing accounts payable bot
  • Audit my agent's tool permissions and add an approval gate before ERP writes
  • Help me add injection evals and budget limits to this agent loop design