¿Cuántas habilidades de Claude deberías instalar?

¿Cuántas habilidades de Claude deberías instalar?

Menos de lo que crees. Para la mayoría de las personas que realizan un trabajo normal en Claude Code, el número que se mantiene a lo largo de los meses está entre cinco y ocho habilidades activamente utilizadas, sin contar lo que viene incluido en un plugin que no elegiste individualmente. Eso no es un límite estricto. Es el punto en el que el portafolio al que realmente recurres deja de crecer, sin importar cuántas más instales.

La razón por la que es bajo no es el desorden en una vista de carpeta. Cada habilidad que instalas, la uses o no, pone su descripción de disparador frente a Claude en cada solicitud, para siempre, y cada descripción adicional es una cosa más que Claude tiene que ignorar correctamente. Pasado cierto punto, añadir habilidades no añade capacidad. Añade ruido contra el que las buenas habilidades tienen que competir.

Este artículo es la aritmética detrás de ese número: lo que te cuesta una habilidad instalada pero inactiva, por qué dos habilidades superpuestas son peores que una sola, y la estructura de portafolio que usamos nosotros mismos después de catalogar y probar 73 de ellas.

Lo que realmente te cuesta una habilidad instalada

Las habilidades se cargan en dos etapas. Al inicio de la sesión, Claude lee solo el frontmatter, el name y description, de cada habilidad que puede encontrar, típicamente de 50 a 150 tokens cada una. Esos metadatos permanecen en contexto durante toda la sesión, independientemente de si la habilidad se activa alguna vez. El cuerpo completo, las instrucciones reales, se carga solo cuando una solicitud coincide con la descripción. Eso es divulgación progresiva, y es la razón por la que las habilidades escalan mejor que los prompts pegados. Cubrimos el mecanismo en qué son las habilidades de Claude.

La parte siempre activa es la que la gente olvida contar. Supongamos que has instalado 30 habilidades con un promedio de 100 tokens de frontmatter cada una: 3,000 tokens presentes en cada mensaje, cada turno, cada sesión, sean o no relevantes. En 30 turnos de una sesión de trabajo, eso son 90,000 tokens gastados releyendo una lista de metadatos antes de que Claude haga algo que le pediste. Durante 22 días hábiles, cerca de 2 millones de tokens al mes de puro 'impuesto' por estar inactivo. Nada de esto es caro por sí solo, unos pocos centavos a tarifas de Sonnet. Pero compite por espacio en la ventana de contexto y se acumula con todo lo demás que lo acompaña: CLAUDE.md, MCP tool schemas, historial de sesión. Hicimos el desglose completo en reducción de costos de tokens de Claude.

El costo mayor no es el dinero. Es la atención. Claude decide qué habilidad cargar al comparar tu solicitud con una pila de descripciones, y esa coincidencia se vuelve menos fiable a medida que la pila crece y las descripciones comienzan a superponerse en vocabulario. Una habilidad que instalaste en marzo y no has usado desde entonces sigue en esa pila cada vez que pides algo en abril, haciendo silenciosamente que la coincidencia correcta sea una opción entre 41 en lugar de una opción entre 8.

<div class="cta-pack cta-free">
  <p class="cta-eyebrow">PAQUETE DE INICIO GRATUITO</p>
  <p class="cta-text">Tres es el número correcto para empezar, no treinta. Te enviaremos por correo electrónico nuestras 3 habilidades mejor puntuadas y la lista de verificación de instalación que ejecutamos antes de cada prueba de SkillProof. Gratis.</p>
  <a class="cta-btn" href="#get-starter">Obtener el paquete de inicio gratuito</a>
</div>

El problema de colisión: dos habilidades, una solicitud

Instala suficientes habilidades y, eventualmente, dos de ellas describirán el mismo trabajo con palabras diferentes. Esto no es una hipótesis. Lo encontramos al construir nuestro propio catálogo de pruebas: dos paquetes de marketing instalados uno al lado del otro incluían una habilidad para copias de divulgación, cold-email y email-sequences, con descripciones que se superponían lo suficiente como para que un solo prompt "escríbeme un correo electrónico de seguimiento" pudiera coincidir plausiblemente con cualquiera de los dos.

Cuando eso sucede, ocurre una de tres cosas, y ninguna de ellas te es anunciada. Claude elige una, silenciosamente, basándose en qué descripción se lee como una coincidencia ligeramente mejor para tu fraseo exacto, por lo que el mismo prompt preguntado de dos maneras diferentes puede activar dos habilidades distintas. O una colisión fuerte en el campo name significa que una habilidad eclipsa completamente a la otra; la segunda simplemente nunca se carga, y no recibirás un error que te lo indique. O, en el peor de los casos, Claude intenta satisfacer ambas coincidencias parciales a la vez y produce una salida que está unida a partir de dos conjuntos de instrucciones que nunca fueron diseñadas para cooperar: tu habilidad de correo electrónico y tu habilidad de tono de voz intentando ambas apropiarse de la misma frase.

La solución es diagnóstica, no preventiva, porque generalmente no sabes que dos habilidades colisionan hasta que lo hacen. Escribimos la lista de verificación completa de seis puntos para esto en habilidad de Claude no se activa, pero la versión corta para el tamaño del portafolio específicamente: si no puedes explicar en una oración por qué la habilidad A maneja una solicitud en lugar de la habilidad B, se superponen demasiado para que ambas permanezcan instaladas. Fusiónalas, elimina una o reescribe la descripción más débil para delimitar una porción más estrecha y no superpuesta del trabajo. El número de colisiones en un portafolio escala aproximadamente con el cuadrado de su tamaño, que es la versión matemática de "mantenlo pequeño".

El enfoque de portafolio: anclas, situacionales, experimentos

Una vez que aceptas que cada habilidad instalada tiene un costo continuo, la pregunta cambia de "¿debería instalar esto?" a "¿en qué categoría encaja?". Nosotros clasificamos las nuestras en tres.

  • Anclas son las dos a cinco habilidades que notarías en un día si desaparecieran. Generación de documentos si escribes informes semanalmente. Una disciplina de depuración si escribes código diariamente. Una habilidad de tono o edición si tu trabajo son las palabras. Estas se ganan un hogar permanente en ~/.claude/skills/, disponibles en cada proyecto, y son la única categoría que vale la pena instalar por fe antes de que hayas probado que el disparador funciona específicamente para ti.
  • Situacionales son reales y útiles, pero limitadas a un contexto: una lista de verificación de migración para una base de código, la voz de marca específica de un cliente, una habilidad de cumplimiento que solo tu proyecto regulado necesita. Estas pertenecen a la carpeta .claude/skills/ de un proyecto, no a tu carpeta personal. Viajan con el repositorio, son visibles para los compañeros de equipo que lo clonan y, fundamentalmente, su descripción solo compite por atención dentro de las sesiones donde son realmente relevantes. Instalar una habilidad específica de un cliente globalmente significa que su descripción también acompaña a cada proyecto no relacionado que toques.
  • Experimentos son cualquier cosa que estés probando porque un colega la recomendó o una entrada de catálogo obtuvo una buena puntuación. Dales un plazo estricto de dos semanas desde la instalación. Si no la has usado de forma espontánea, naturalmente, sin esforzarte por probarla, al final de dos semanas, elimínala. La mayoría de los experimentos fallan esta prueba, y eso está bien; para eso es el período de prueba. El error no es probar habilidades, es permitir que las no probadas asciendan silenciosamente a un estado de ancla permanente solo porque eliminar una carpeta se siente como admitir que la prueba falló.

Esta estructura también responde a la pregunta "¿cuántas?" de manera más útil que un solo número. No es "instala 6 habilidades en total". Es "mantén tus anclas en lo que realmente extrañarías, mantén las situacionales delimitadas a donde importan, y pon una fecha de caducidad a todo lo demás".

Lo que sobrevivió en nuestro propio banco de pruebas

Probamos cada habilidad en el catálogo de SkillProof en una instalación limpia antes de que obtenga un veredicto, y por separado, algunas de esas habilidades probadas se convierten en las que realmente usamos a diario, meses después de la publicación de la reseña. Esa segunda lista es corta, y es informativa precisamente porque es corta.

  • DOCX (9.6/10) es la que notaríamos más rápido si desapareciera. La propia habilidad de referencia de Anthropic, y la razón es aburrida: producimos documentos de Word la mayoría de las semanas, y escribe documentos reales, tablas de contenido, cambios rastreados, membretes intactos, en lugar de markdown que tendríamos que reformatear a mano.
  • Systematic Debugging (9.6/10) y Test-Driven Development (9.6/10), ambas de la colección Superpowers, son el par que cambió cómo se ejecutan nuestras propias sesiones en lugar de lo que producen. Sin scripts, sin herramientas externas, puro cambio de comportamiento: red-green-refactor aplicado cada vez, una disciplina de depuración que no permite que Claude adivine una solución antes de reproducir el error. Estos son el caso más claro en nuestro catálogo de una habilidad que obtiene el estado de ancla solo por su salida.
  • Memory Management (9.2/10) se gana su lugar al ser invisible de la mejor manera: evita que el contexto se evapore entre sesiones sin que tengamos que gestionar un archivo de notas manualmente.

Observa lo que falta. Nuestro catálogo contiene 73 habilidades; 35 tienen un veredicto de "pass" limpio. Usamos quizás ocho de esas 35 como anclas diarias genuinas. Las otras 27 son buenas, probadas y honestas sobre lo que hacen, y la mayoría todavía se encuentran en estado situacional o experimental para nosotros, porque "probado y bueno" y "pertenece a tus cinco a ocho permanentes" son criterios diferentes. Una habilidad puede obtener 9/10 en una revisión y aun así ser incorrecto mantenerla instalada globalmente si usas su caso de uso dos veces al trimestre.

El ritual de poda mensual

Los portafolios se desvían. Una habilidad instalada para un proyecto sobrevive al proyecto. Un experimento supera su plazo de dos semanas porque eliminar cosas no es la tarea favorita de nadie. La solución es una revisión recurrente de diez minutos, no una limpieza única.

Una vez al mes, haz lo siguiente:

  1. Enumera lo que está realmente instalado. ls ~/.claude/skills/ y ls .claude/skills/ para cualquier proyecto en el que te encuentres. Si no reconoces un nombre de carpeta, esa es tu respuesta.
  2. Pregunta cuándo se activó por última vez cada una. Si no recuerdas haberla usado en el último mes, y no es un ancla que uses en ráfagas (temporada de impuestos, informes trimestrales), es una candidata a podar.
  3. Verifica si hay superposición. Lee el campo description de cada habilidad una al lado de la otra. Dos que podrían responder plausiblemente al mismo prompt son una colisión a punto de ocurrir; consulta la sección anterior.
  4. Confirma que las habilidades con alcance de proyecto son realmente con alcance de proyecto. Cualquier cosa específica de un cliente o repositorio no tiene cabida en tu carpeta personal, acompañando a cada proyecto no relacionado.
  5. Elimina, no archives. Una habilidad que está deshabilitada en algún lugar aún necesita no ser confundida con una activa. Si no se está ganando su espacio, elimina la carpeta.
  6. Vuelve a probar tus anclas. Pide algo que cada ancla debería manejar, sin nombrarla, de la misma manera que probamos los disparadores para el catálogo. Si no se activa limpiamente, algo añadido desde entonces probablemente la esté eclipsando.

Diez minutos, una vez al mes, y el portafolio se mantiene en el tamaño útil en lugar de desviarse hacia el tamaño que simplemente se acumula.

La calidad supera a la cantidad

Esta es toda la tesis de SkillProof comprimida en una sección, y vale la pena decirlo claramente aquí porque "¿cuántas habilidades?" es realmente un sustituto de una pregunta diferente: ¿cuál es el valor marginal de la próxima que estás a punto de instalar?

De las 45 habilidades que hemos sometido a pruebas completas, 35 pasaron limpiamente y 10 necesitaron configuración adicional para funcionar. Eso no es una crítica al ecosistema, el formato es intencionalmente abierto, cualquiera puede publicar sin una puerta de revisión, razón por la cual creció rápidamente. Pero también significa que la habilidad promedio en GitHub es unverified, e instalar diez mediocres no suma una buena. Suma diez descripciones de disparadores compitiendo con las buenas por la misma coincidencia, diez bloques de metadatos inactivos en cada solicitud, y un número creciente de pares que podrían interferir silenciosamente entre sí. Profundizamos en los patrones de falla específicos, descripciones vagas que nunca se activan, salida no mejor que la predeterminada de Claude, pasos de configuración faltantes, en por qué la mitad de las habilidades de Claude no funcionan.

La versión práctica: antes de instalar cualquier cosa, pregúntate si sobreviviría al plazo de dos semanas del experimento y si hace algo significativamente mejor de lo que Claude haría sin un prompt. Si no puedes responder afirmativamente a ambas, no te cuesta mucho omitirla, pero tampoco te está ayudando. Nuestras clasificaciones de eficiencia ordenan las habilidades probadas específicamente por esa barra de 'salida sobre línea base', lo cual es un filtro más rápido que leer veinte READMEs tú mismo.

<div class="cta-pack">
  <p class="cta-eyebrow">PAQUETE SKILLPROOF</p>
  <p class="cta-text">Evita la expansión por completo. El Optimizer Pack es nuestro conjunto de anclas más ajustado, pre-verificado para la superposición de disparadores, para que instales las ocho que importan en lugar de podar cuarenta más tarde.</p>
  <a class="cta-btn" href="/bundles/optimizer-pack">Obtener el Optimizer Pack — $10</a>
</div>

Preguntas Frecuentes

¿Existe un límite estricto en cuántas habilidades de Claude puedo instalar?

No hay un límite técnico que hayamos encontrado en las pruebas. Claude escanea cada carpeta de habilidades que encuentra y carga todo su frontmatter al inicio de la sesión, ya sean 5 habilidades o 150. El límite que importa no es una barrera que Claude imponga, es el punto en el que el "impuesto" de metadatos siempre activos y las crecientes probabilidades de superposición de descripciones comienzan a costar más de lo que una nueva habilidad aporta. Ese punto tiende a situarse alrededor de 30 a 40 habilidades instaladas para la mayoría de las personas, mucho antes de cualquier límite a nivel de formato.

¿Las habilidades inactivas ralentizan a Claude o solo cuestan tokens?

Principalmente tokens y precisión de coincidencia, no una latencia bruta de manera dramática. El frontmatter de una habilidad inactiva permanece en contexto en cada turno, lo que añade un costo pequeño y real que se acumula a lo largo de un mes, y es una descripción más que Claude tiene que considerar al decidir qué activar. Unas pocas habilidades inactivas son genuinamente inofensivas. Cuarenta de ellas son una historia diferente, principalmente porque las probabilidades de que una obsoleta eclipse o coincida parcialmente con una solicitud que te importa aumentan con el número.

¿Cómo sé si una habilidad que instalé se está usando realmente?

Pide algo que debería manejar sin nombrarlo, la misma prueba de disparador que ejecutamos para cada entrada del catálogo. Si el comportamiento de Claude cambia visiblemente, por ejemplo, produce un .docx real en lugar de markdown pegado, se activó. Si nada cambia, o la descripción no coincide con la forma en que realmente formulas las solicitudes, o otra habilidad está ganando la coincidencia primero. Nuestra guía de habilidad no se activa tiene el proceso completo de seis verificaciones para distinguirlas.

¿Las habilidades personales y de proyecto deben contar para el mismo límite?

Trátalas por separado. Las habilidades personales en ~/.claude/skills/ acompañan a cada proyecto que tocas, por lo que deberían ser la lista corta de anclas que extrañarías diariamente sin importar el contexto. Las habilidades de proyecto en .claude/skills/ solo cargan su frontmatter en sesiones dentro de ese repositorio, por lo que un proyecto puede llevar razonablemente más habilidades situacionales sin gravar tu otro trabajo en absoluto. El error que más vemos es poner habilidades específicas de cliente o de repositorio en la carpeta personal, donde gravan cada proyecto no relacionado para siempre.

¿Cuál es la forma más rápida de reducir una lista de habilidades excesiva?

Ejecuta el ritual de poda mensual una vez, inmediatamente, en lugar de esperar la próxima pasada programada. Enumera todo lo instalado, elimina cualquier cosa que no recuerdes haber activado en el último mes y que no sea un ancla de uso intermitente conocido, verifica las sobrevivientes en busca de superposición de descripciones y mueve cualquier cosa específica de cliente o proyecto fuera de tu carpeta personal. La mayoría de las configuraciones excesivas pasan de más de 30 habilidades a menos de diez en la primera pasada, porque la mayor parte de la lista son experimentos que nadie se molestó en eliminar.

★ 9.6/10 × 3

El pack de inicio gratis

Los 3 skills con nuestras mejores puntuaciones de test más la checklist de instalación: el setup que pondríamos en una máquina recién estrenada. Gratis, por email.

Un email con el pack + un breve resumen semanal con nuevos resultados de test. Date de baja cuando quieras.