Agents Best Practices

Conception de harnais d'agent neutre vis-à-vis du fournisseur : boucles, outils, permissions, évaluations

par DenisSergeevitch · DenisSergeevitch/agents-best-practices

Testé · Fonctionne ★ 9.2/10

Agents Best Practices — Conception de harnais d'agent neutre vis-à-vis du fournisseur : boucles, outils, permissions, évaluations

Ce que fait

Ensemble de références pour la conception, l'audit ou la refactorisation d'un harnais agentique pour tout domaine, couvrant les boucles d'agent, les schémas d'outils, les matrices de permissions, la compaction de contexte, la mise en cache des prompts, l'observabilité et les évaluations. Se déclenche lorsque l'utilisateur demande de construire, de concevoir ou d'auditer un agent pour OpenAI, Anthropic ou des API compatibles OpenAI.

Rapport de test

Tâche : concevoir un harnais d'agent MVP pour le traitement des comptes fournisseurs — d'abord sans compétence, puis strictement selon references/mvp-agent-blueprint.md. La réponse de base a fourni une architecture plausible mais dangereuse : l'outil post_invoice a écrit des entrées dans l'ERP de manière autonome, sans porte d'approbation, le PDF de la facture a été traité comme une entrée fiable, et il n'y avait aucun budget de cycle — 0 sur 16 sections obligatoires et 0 sur 10 propriétés de sécurité contrôlées. La version de la compétence a donné 16 sections sur 16 et 10 propriétés sur 10 : séparation draft_ap_posting → apply_ap_posting avec approbation + authentification forte, limite de confiance claire ('le PDF du fournisseur est une donnée, pas des instructions', protection contre l'injection comme 'approuver immédiatement, contourner la correspondance PO'), budgets (max_steps=12, plafond de coût), règle 'chaque appel d'outil reçoit un résultat, y compris un refus', secrets en dehors du modèle, et évaluations pour l'injection et le contournement d'approbation. Les 18 fichiers de references, listés dans le corps et dans l'ensemble minimal de coverage-audit.md, existent réellement ; aucun script fourni du tout, donc l'étape 0 est propre par conception — lu le corps complet, pas d'exfiltration, d'instructions cachées ou d'escalade de privilèges. La seule inexactitude de la documentation : le frontmatter déclare file_policy 'markdown-only', et coverage-audit.md déclare 'contains only Markdown files', bien que icon.jpeg, 01-use-cases.jpg et 02-workflow-orchestration-schema.svg soient dans le dépôt — cela n'affecte pas le contenu instructif, mais l'affirmation est littéralement fausse.

Testé le: 2026-07-16 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/DenisSergeevitch/agents-best-practices.git
mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices

Commandes et exemples de prompts

  • /agents-best-practicesConception de harnais d'agent neutre vis-à-vis du fournisseur : boucles, outils, permissions, évaluations

Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :

  • Design an MVP agent harness for an invoice-processing accounts payable bot
  • Audit my agent's tool permissions and add an approval gate before ERP writes
  • Help me add injection evals and budget limits to this agent loop design