Delegation Triggers

Règles explicites pour savoir quand générer des sous-agents ou travailler directement, ajustées sur un benchmark de 408 exécutions.

par vitaliikapliuk · vitaliikapliuk/modelharness

Testé · Fonctionne ★ 8.8/10

Delegation Triggers — Règles explicites pour savoir quand générer des sous-agents ou travailler directement, ajustées sur un benchmark de 408 exécutions.

Ce que fait

Une courte heuristique de décision pour les sessions de codage agentiques : répartir le travail vers des sous-agents parallèles lorsque les éléments sont indépendants, qu'une recherche large n'a besoin que de sa conclusion, ou qu'une vérification de contexte frais est nécessaire ; sinon, travailler directement. Se déclenche chaque fois qu'un agent (ou son utilisateur) décide si une tâche vaut la peine d'être déléguée — audits multi-fichiers, recherches larges, passes de vérification — plutôt que de se fier à l'intuition. S'associe à une compétence sœur 'verification-loop' dans le même dépôt.

Rapport de test

Appliqué à une vraie décision de fan-out ou non (12 fichiers de vérification d'authentification indépendants contre une fonction d'analyse de date), il a produit une répartition décisive — sous-agents d'audit parallèles pour les fichiers, travail direct pour la fonction unique — là où un jugement non guidé aurait simplement hésité ; son affirmation 'Opus 4.8 under-delegates' est vérifiée par rapport au tableau de benchmark de 408 exécutions publié par le dépôt lui-même.

Testé le: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/vitaliikapliuk/modelharness
cd modelharness
mkdir -p ~/.claude/skills
cp -r skills/delegation-triggers ~/.claude/skills/delegation-triggers

Commandes et exemples de prompts

  • /delegation-triggersRègles explicites pour savoir quand générer des sous-agents ou travailler directement, ajustées sur un benchmark de 408 exécutions.

Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :

  • Should I spawn parallel subagents for these fifteen config files?
  • Is this task worth delegating, or should I just do it myself?
  • We have twelve independent audits, worth fanning out to agents?