
Combien de compétences Claude devriez-vous installer ?
Moins que vous ne le pensez. Pour la plupart des personnes effectuant un travail normal dans Claude Code, le nombre qui tient sur plusieurs mois se situe entre cinq et huit compétences activement utilisées, sans compter ce qui est livré en bundle dans un plugin que vous n'avez pas choisi individuellement. Ce n'est pas un plafond strict. C'est le point où le portefeuille que vous utilisez réellement cesse de croître, peu importe le nombre de compétences supplémentaires que vous installez.
La raison de ce faible nombre n'est pas l'encombrement dans une vue de dossier. Chaque compétence que vous installez, que vous l'utilisiez ou non, place sa description de déclencheur devant Claude à chaque requête, pour toujours, et chaque description supplémentaire est une chose de plus que Claude doit ignorer correctement. Au-delà d'un certain point, ajouter des compétences n'ajoute pas de capacité. Cela ajoute du bruit contre lequel les bonnes compétences doivent rivaliser.
Cet article présente l'arithmétique derrière ce nombre : ce que vous coûte une compétence installée mais inactive, pourquoi deux compétences qui se chevauchent sont pires qu'une seule, et la structure de portefeuille que nous utilisons nous-mêmes après en avoir catalogué et testé 73.
Ce que vous coûte réellement une compétence installée
Les compétences se chargent en deux étapes. Au démarrage de la session, Claude ne lit que le frontmatter, le name et la description, de chaque compétence qu'il peut trouver, généralement 50 à 150 tokens chacun. Ces métadonnées restent en contexte pendant toute la session, que la compétence se déclenche ou non. Le corps complet, les instructions réelles, ne se charge que lorsqu'une requête correspond à la description. C'est une divulgation progressive, et c'est la raison pour laquelle les compétences s'adaptent mieux que les prompts copiés-collés. Nous avons couvert le mécanisme dans ce que sont les compétences Claude.
La partie toujours active est celle que les gens oublient de compter. Supposons que vous ayez installé 30 compétences, chacune avec une moyenne de 100 tokens de frontmatter : 3 000 tokens se tenant devant chaque message, chaque tour, chaque session, qu'ils soient pertinents ou non. À 30 tours dans une session de travail, cela représente 90 000 tokens dépensés à relire une liste de métadonnées avant que Claude ne fasse quoi que ce soit que vous ayez demandé. Sur 22 jours ouvrables, près de 2 millions de tokens par mois de pure taxe d'attente. Rien de tout cela n'est cher en soi, quelques centimes aux tarifs Sonnet. Mais cela rivalise pour l'espace dans la fenêtre de contexte et s'ajoute à tout le reste : CLAUDE.md, les schémas d'outils MCP, l'historique de session. Nous avons fait l'analyse complète dans réduire les coûts de tokens Claude.
Le coût le plus important n'est pas monétaire. C'est l'attention. Claude décide quelle compétence charger en faisant correspondre votre requête à une pile de descriptions, et cette correspondance devient moins fiable à mesure que la pile s'agrandit et que les descriptions commencent à se chevaucher en termes de vocabulaire. Une compétence que vous avez installée en mars et que vous n'avez pas utilisée depuis est toujours dans cette pile chaque fois que vous demandez quelque chose en avril, rendant discrètement la bonne correspondance une option parmi 41 au lieu d'une option parmi 8.
PACK DE DÉMARRAGE GRATUIT
Trois est le bon nombre pour commencer, pas trente. Nous vous enverrons par e-mail nos 3 compétences les mieux notées et la liste de contrôle d'installation que nous utilisons avant chaque test SkillProof. Gratuit.
Obtenez le pack de démarrage gratuitLe problème de collision : deux compétences, une requête
Installez suffisamment de compétences et, finalement, deux d'entre elles décriront le même travail avec des mots différents. Ce n'est pas une hypothèse. Nous l'avons rencontré en construisant notre propre catalogue de tests : deux packs marketing installés côte à côte contenaient tous deux une compétence pour la rédaction de textes de prospection, cold-email et email-sequences, avec des descriptions se chevauchant suffisamment pour qu'un simple prompt "rédigez-moi un e-mail de suivi" puisse plausiblement correspondre à l'une ou l'autre.
Lorsque cela se produit, l'une des trois choses suivantes se produit, et aucune ne vous est annoncée. Claude en choisit une, silencieusement, en fonction de la description qui correspond le mieux à votre formulation exacte, de sorte que le même prompt posé de deux manières différentes peut déclencher deux compétences différentes. Ou une collision dure sur le champ name signifie qu'une compétence éclipse entièrement l'autre ; la seconde ne se charge tout simplement jamais, et vous ne recevrez pas d'erreur vous l'indiquant. Ou, dans le pire des cas, Claude essaie de satisfaire les deux correspondances partielles à la fois et produit un résultat assemblé à partir de deux ensembles d'instructions qui n'ont jamais été conçus pour coopérer : votre compétence d'e-mail et votre compétence de ton de voix essayant toutes deux de s'approprier la même phrase.
La solution est diagnostique, pas préventive, car vous ne savez généralement pas que deux compétences entrent en collision avant que cela ne se produise. Nous avons rédigé la liste de contrôle complète en six points pour cela dans compétence Claude ne se déclenche pas, mais la version courte spécifiquement pour la taille du portefeuille : si vous ne pouvez pas expliquer en une phrase pourquoi la compétence A gère une requête au lieu de la compétence B, elles se chevauchent trop pour rester toutes les deux installées. Fusionnez-les, supprimez-en une, ou réécrivez la description la plus faible pour découper une part plus étroite et non-chevauchante du travail. Le nombre de collisions dans un portefeuille évolue à peu près avec le carré de sa taille, ce qui est la version mathématique de "gardez-le petit."
L'approche portefeuille : ancres, situationnelles, expérimentales
Une fois que vous acceptez que chaque compétence installée a un coût continu, la question passe de "dois-je installer ceci" à "dans quelle catégorie cela appartient-il". Nous classons les nôtres en trois.
Ancres sont les deux à cinq compétences dont vous remarqueriez l'absence en une journée si elles disparaissaient. Génération de documents si vous rédigez des rapports chaque semaine. Une discipline de débogage si vous écrivez du code quotidiennement. Une compétence de ton ou d'édition si votre travail est basé sur les mots. Celles-ci trouvent une place permanente dans ~/.claude/skills/, disponibles dans chaque projet, et elles sont la seule catégorie qui vaille la peine d'être installée sur la foi avant que vous n'ayez prouvé que le déclencheur fonctionne spécifiquement pour vous.
Situationnelles sont réelles et utiles mais circonscrites à un seul contexte : une liste de contrôle de migration pour une base de code, la voix de marque spécifique d'un client, une compétence de conformité dont seul votre projet réglementé a besoin. Celles-ci appartiennent au dossier .claude/skills/ d'un projet, pas à votre dossier personnel. Elles voyagent avec le dépôt, elles sont visibles par les coéquipiers qui le clonent, et surtout, leur description ne rivalise pour l'attention que dans les sessions où elles sont réellement pertinentes. Installer une compétence spécifique à un client globalement signifie que sa description accompagne également chaque projet sans rapport que vous touchez.
Expérimentales sont tout ce que vous essayez parce qu'un collègue l'a recommandé ou qu'une entrée de catalogue a bien été notée. Donnez-leur un délai strict de deux semaines à partir de l'installation. Si vous ne l'avez pas utilisée spontanément, naturellement, sans faire d'efforts pour la tester, à la fin des deux semaines, supprimez-la. La plupart des expériences échouent à ce test, et c'est bien ainsi ; c'est à cela que sert la période d'essai. L'erreur n'est pas d'essayer des compétences, c'est de laisser celles qui n'ont pas été testées passer discrètement au statut d'ancre permanente simplement parce que supprimer un dossier donne l'impression d'admettre que l'essai a échoué.
Cette structure répond également à la question "combien" de manière plus utile qu'un simple chiffre. Ce n'est pas "installez 6 compétences au total". C'est "gardez vos ancres à ce qui vous manquerait vraiment, limitez les situationnelles là où elles sont importantes, et mettez une date d'expiration sur tout le reste."
Ce qui a survécu sur notre propre banc d'essai
Nous testons chaque compétence du catalogue SkillProof sur une installation propre avant qu'elle n'obtienne un verdict, et séparément, certaines de ces compétences testées deviennent celles que nous utilisons réellement quotidiennement, des mois après la publication de l'évaluation. Cette deuxième liste est courte, et elle est informative précisément parce qu'elle est courte.
DOCX (9.6/10) est celle dont nous remarquerions le plus rapidement l'absence si elle disparaissait. La propre compétence de référence d'Anthropic, et la raison est ennuyeuse : nous produisons des documents Word la plupart des semaines, et elle en rédige de vrais, tables des matières, modifications suivies, en-têtes intacts, au lieu de markdown que nous devrions reformater à la main.
Débogage Systématique (9.6/10) et Développement Dirigé par les Tests (9.6/10), tous deux de la collection Superpowers, sont la paire qui a changé la façon dont nos propres sessions se déroulent plutôt que ce qu'elles produisent. Pas de scripts, pas d'outils externes, pur changement de comportement : red-green-refactor appliqué à chaque fois, une discipline de débogage qui ne laissera pas Claude deviner une solution avant de reproduire le bug. Ce sont les cas les plus clairs de notre catalogue pour une compétence obtenant le statut d'ancre sur la seule base de son résultat.
Gestion de la Mémoire (9.2/10) gagne sa place en étant invisible de la meilleure façon : elle empêche le contexte de s'évaporer entre les sessions sans que nous ayons à gérer un fichier de notes à la main.
Remarquez ce qui est absent. Notre catalogue contient 73 compétences ; 35 ont un verdict de "pass" propre. Nous utilisons peut-être huit de ces 35 comme véritables ancres quotidiennes. Les 27 autres sont bonnes, testées et honnêtes quant à ce qu'elles font, et la plupart restent pour nous en statut situationnel ou expérimental, car "testé et bon" et "appartient à vos cinq à huit permanentes" sont des critères différents. Une compétence peut obtenir 9/10 lors d'une évaluation et il peut toujours être erroné de la maintenir installée globalement si vous n'utilisez son cas d'usage que deux fois par trimestre.
Le rituel d'élagage mensuel
Les portefeuilles dérivent. Une compétence installée pour un projet survit au projet. Une expérience survit à son délai de deux semaines parce que supprimer des choses n'est la tâche préférée de personne. La solution est un passage récurrent de dix minutes, pas un nettoyage ponctuel.
Une fois par mois, suivez ceci :
- Listez ce qui est réellement installé.
ls ~/.claude/skills/etls .claude/skills/pour tout projet dans lequel vous vous trouvez. Si vous ne reconnaissez pas un nom de dossier, c'est déjà votre réponse. - Demandez quand chacune a été déclenchée pour la dernière fois. Si vous ne vous souvenez pas l'avoir utilisée le mois dernier, et que ce n'est pas une ancre que vous utilisez par intermittence (saison des impôts, rapports trimestriels), c'est une candidate à l'élagage.
- Vérifiez les chevauchements. Lisez le champ
descriptionde chaque compétence côte à côte. Deux qui pourraient plausiblement répondre au même prompt sont une collision en attente ; voir la section ci-dessus. - Confirmez que les compétences spécifiques à un projet sont réellement spécifiques à un projet. Tout ce qui est spécifique à un client ou à un dépôt n'a rien à faire dans votre dossier personnel, accompagnant chaque projet sans rapport.
- Supprimez, n'archivez pas. Une compétence désactivée quelque part ne doit pas être confondue avec une compétence active. Si elle ne justifie pas sa place, supprimez le dossier.
- Retestez vos ancres. Demandez quelque chose que chaque ancre devrait gérer, sans la nommer, de la même manière que nous testons les déclencheurs pour le catalogue. Si elle ne se déclenche pas proprement, quelque chose ajouté depuis l'éclipse probablement.
Dix minutes, une fois par mois, et le portefeuille conserve une taille utile au lieu de dériver vers une taille qui ne fait que s'accumuler.
La qualité prime sur la quantité
C'est toute la thèse de SkillProof compressée en une seule section, et il est important de le dire clairement ici car "combien de compétences" est en réalité un substitut à une question différente : quelle est la valeur marginale de la prochaine que vous êtes sur le point d'installer ?
Sur les 45 compétences que nous avons soumises à des tests complets, 35 ont été "pass" proprement et 10 ont nécessité une configuration "setup" supplémentaire pour fonctionner. Ce n'est pas une critique de l'écosystème, le format est intentionnellement ouvert, n'importe qui peut publier sans porte de révision, ce qui est précisément la raison de sa croissance rapide. Mais cela signifie aussi que la compétence moyenne sur GitHub n'est pas vérifiée, et installer dix compétences médiocres ne fait pas une bonne. Cela représente dix descriptions de déclencheurs rivalisant avec vos bonnes pour la même correspondance, dix blocs de métadonnées inactifs à chaque requête, et un nombre croissant de paires qui pourraient se marcher dessus silencieusement. Nous avons approfondi les schémas d'échec spécifiques, les descriptions vagues qui ne se déclenchent jamais, les résultats pas meilleurs que ceux par défaut de Claude, les étapes de "setup" manquantes, dans pourquoi la moitié des compétences Claude ne fonctionnent pas.
La version pratique : avant d'installer quoi que ce soit, demandez-vous si cela survivrait au délai d'expérimentation de deux semaines, et si cela fait quelque chose de significativement mieux que ce que Claude ferait sans prompt. Si vous ne pouvez pas répondre oui aux deux, cela ne vous coûte pas cher de l'ignorer, mais cela ne vous aide pas non plus. Nos classements d'efficacité trient les compétences testées spécifiquement selon cette barre de "output-over-baseline", ce qui est un filtre plus rapide que de lire vingt READMEs vous-même.
PACK SKILLPROOF
Évitez complètement l'étalement. L'Optimizer Pack est notre ensemble d'ancres le plus compact, pré-vérifié pour les chevauchements de déclencheurs afin que vous installiez les huit qui comptent au lieu d'en élaguer quarante plus tard.
Obtenez l'Optimizer Pack — 10 $FAQ
Y a-t-il une limite stricte au nombre de compétences Claude que je peux installer ?
Aucune limite technique que nous ayons rencontrée lors des tests. Claude scanne chaque dossier de compétences qu'il trouve et charge tout leur frontmatter au démarrage de la session, qu'il s'agisse de 5 compétences ou de 150. La limite qui compte n'est pas un mur imposé par Claude, c'est le point où la taxe de métadonnées toujours active et les chances croissantes de chevauchement de descriptions commencent à coûter plus cher qu'une nouvelle compétence n'apporte. Ce point se situe généralement autour de 30 à 40 compétences installées pour la plupart des gens, bien avant tout plafond au niveau du format.
Les compétences inactives ralentissent-elles Claude ou coûtent-elles seulement des tokens ?
Principalement des tokens et la précision de la correspondance, pas une latence brute de manière dramatique. Le frontmatter d'une compétence inactive reste en contexte à chaque tour, ce qui ajoute un petit coût réel qui s'accumule sur un mois, et c'est une description de plus que Claude doit prendre en compte lorsqu'il décide quoi déclencher. Une poignée de compétences inactives est réellement inoffensive. Quarante d'entre elles, c'est une autre histoire, principalement parce que les chances qu'une compétence obsolète éclipse ou corresponde partiellement à une requête qui vous intéresse augmentent avec le nombre.
Comment savoir si une compétence que j'ai installée est réellement utilisée ?
Demandez quelque chose qu'elle devrait gérer sans la nommer, le même test de déclenchement que nous effectuons pour chaque entrée de catalogue. Si le comportement de Claude change visiblement, par exemple, il produit un vrai .docx au lieu de markdown copié-collé, elle s'est déclenchée. Si rien ne change, soit la description ne correspond pas à la façon dont vous formulez réellement les requêtes, soit une autre compétence remporte la correspondance en premier. Notre guide sur les compétences qui ne se déclenchent pas contient le processus complet en six vérifications pour distinguer ces deux cas.
Les compétences personnelles et de projet doivent-elles compter pour la même limite ?
Traitez-les séparément. Les compétences personnelles dans ~/.claude/skills/ accompagnent chaque projet que vous touchez, elles devraient donc être la courte liste d'ancres qui vous manquerait quotidiennement, quel que soit le contexte. Les compétences de projet dans .claude/skills/ ne chargent leur frontmatter que dans les sessions à l'intérieur de ce dépôt, donc un projet peut raisonnablement contenir plus de compétences situationnelles sans taxer du tout votre autre travail. L'erreur que nous voyons le plus souvent est de placer des compétences spécifiques à un client ou à un dépôt dans le dossier personnel, où elles taxent chaque projet sans rapport pour toujours.
Quel est le moyen le plus rapide de réduire une liste de compétences trop longue ?
Exécutez le rituel d'élagage mensuel une fois, immédiatement, plutôt que d'attendre le prochain passage programmé. Listez tout ce qui est installé, supprimez tout ce que vous ne vous souvenez pas avoir déclenché le mois dernier et qui n'est pas une ancre à usage intermittent connue, vérifiez les chevauchements de description parmi les survivantes, et déplacez tout ce qui est spécifique à un client ou à un projet hors de votre dossier personnel. La plupart des configurations trop importantes passent de plus de 30 compétences à moins de dix lors du premier passage, car la majeure partie de la liste est constituée d'expériences que personne n'a pris la peine de supprimer.
★ 9.6/10 × 3
Le pack de démarrage gratuit
Les 3 skills avec nos meilleurs scores de test, plus la checklist d'installation — le setup qu'on mettrait sur une machine neuve. Gratuit, par e-mail.