CTF AI/ML
Referencia de CTF para ataques de ML: trucos de pesos de modelo, ejemplos adversarios, jailbreaks de LLM.
Funciona con configuración
Qué hace
Sub-skill de referencia rápida que cubre técnicas de ataque de IA/ML para competiciones CTF: análisis de pesos de modelo (negación de fine-tuning, fusión de LoRA, inversión de modelo), generación de ejemplos adversarios (FGSM/PGD/C&W), y ataques a LLM (inyección de prompts, jailbreaking, contrabando de tokens). Es una de las ocho skills de categoría del repositorio ljagiello/ctf-skills, pensada para ser despachada por el orquestador solve-challenge de ese repositorio en lugar de activarse de forma totalmente independiente (el frontmatter establece user-invocable: false). Se dispara en tareas CTF que involucran archivos de modelos de ML, robustez adversaria, o retos de jailbreak/inyección de prompts para LLM.
Informe de la prueba
Dio la solución exacta en forma cerrada (2xW_orig - W_chal) con código ejecutable para recuperar una flag suprimida, muy por encima de comparar pesos a mano. Está marcada como no invocable por sí sola, así que instalar solo esta carpeta puede no activarse nunca.
Probado el: 2026-07-10 · Claude Code 2.x (agent harness)
Instalación
git clone https://github.com/ljagiello/ctf-skills cd ctf-skills mkdir -p ~/.claude/skills cp -r ctf-ai-ml ~/.claude/skills/ctf-ai-ml
Comandos y prompts de ejemplo
/ctf-ai-mlReferencia de CTF para ataques de ML: trucos de pesos de modelo, ejemplos adversarios, jailbreaks de LLM.
Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):
Craft an adversarial example to bypass this CTF model classifierFind a jailbreak prompt injection for this LLM CTF challengeAnalyze this model's weights for a fine-tuning negation trick