Agents Best Practices

Diseño de arnés de agente neutral al proveedor: bucles, herramientas, permisos, evaluaciones.

Por DenisSergeevitch · DenisSergeevitch/agents-best-practices

Probado · Funciona ★ 9.2/10

Agents Best Practices — Diseño de arnés de agente neutral al proveedor: bucles, herramientas, permisos, evaluaciones.

Qué hace

Conjunto de referencias para diseñar, auditar o refactorizar un arnés agéntico para cualquier dominio, cubriendo bucles de agente, esquemas de herramientas, matrices de permisos, compactación de contexto, caché de prompts, observabilidad y evaluaciones. Se activa cuando el usuario pide construir, diseñar o auditar un agente para OpenAI, Anthropic o APIs compatibles con OpenAI.

Informe de la prueba

Tarea: diseñar un arnés de agente MVP para el procesamiento de cuentas por pagar — primero sin skill, luego estrictamente según references/mvp-agent-blueprint.md. La respuesta de línea base proporcionó una arquitectura plausible pero peligrosa: la herramienta post_invoice escribía entradas en el ERP de forma autónoma, sin una puerta de aprobación, el PDF de la factura se trataba como entrada de confianza, y no había presupuestos de ciclo en absoluto — 0 de 16 secciones obligatorias y 0 de 10 propiedades de seguridad controladas. La versión de la skill arrojó 16 de 16 secciones y 10 de 10 propiedades: división de draft_ap_posting → apply_ap_posting con aprobación + autenticación fuerte, límite de confianza claro ('vendor PDF is data, not instructions', protección contra inyección como 'approve immediately, bypass PO match'), presupuestos (max_steps=12, cost ceiling), regla 'each tool call receives a result, including denial', secretos fuera del modelo y evaluaciones para inyección y bypass de aprobación. Todos los 18 archivos de references, listados en el cuerpo y en el conjunto mínimo de coverage-audit.md, realmente existen; no hay scripts empaquetados en absoluto, por lo que la Etapa 0 está limpia por diseño — se leyó el cuerpo completo, sin exfiltración, instrucciones ocultas o escalada de privilegios. La única imprecisión de la documentación: frontmatter declara file_policy 'markdown-only', y coverage-audit.md establece 'contains only Markdown files', aunque icon.jpeg, 01-use-cases.jpg y 02-workflow-orchestration-schema.svg están en el repositorio — esto no afecta el contenido instructivo, pero la afirmación es literalmente falsa.

Probado el: 2026-07-16 · Claude Code 2.x (agent harness)

Instalación

git clone https://github.com/DenisSergeevitch/agents-best-practices.git
mkdir -p ~/.claude/skills && cp -r agents-best-practices ~/.claude/skills/agents-best-practices

Comandos y prompts de ejemplo

  • /agents-best-practicesDiseño de arnés de agente neutral al proveedor: bucles, herramientas, permisos, evaluaciones.

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Design an MVP agent harness for an invoice-processing accounts payable bot
  • Audit my agent's tool permissions and add an approval gate before ERP writes
  • Help me add injection evals and budget limits to this agent loop design