CTF AI/ML
CTF-naslag voor ML-aanvallen: trucs met modelgewichten, adversarial examples, LLM-jailbreaks.
Werkt met setup
Wat het doet
Quick-reference-subskill die AI/ML-aanvalstechnieken voor CTF-competities behandelt: analyse van modelgewichten (fine-tuning-negatie, LoRA-merging, model inversion), het genereren van adversarial examples (FGSM/PGD/C&W), en LLM-aanvallen (prompt injection, jailbreaking, token smuggling). Het is een van de acht categorieskills in de ljagiello/ctf-skills-repo, bedoeld om te worden aangeroepen door de solve-challenge-orchestrator van die repo, niet om volledig standalone te triggeren (frontmatter zet user-invocable: false). Gaat aan bij CTF-taken met ML-modelbestanden, adversarial robustness, of LLM-jailbreak-/prompt-injection-challenges.
Testrapport
Gaf de exacte closed-form-fix (2xW_orig - W_chal) met uitvoerbare code om een onderdrukte flag terug te halen, ver voorbij handmatig gewichten diffen. Is gemarkeerd als niet los aan te roepen, dus alleen deze map installeren triggert misschien nooit.
Getest op: 2026-07-10 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/ljagiello/ctf-skills cd ctf-skills mkdir -p ~/.claude/skills cp -r ctf-ai-ml ~/.claude/skills/ctf-ai-ml
Commando's en voorbeeldprompts
/ctf-ai-mlCTF-naslag voor ML-aanvallen: trucs met modelgewichten, adversarial examples, LLM-jailbreaks.
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Craft an adversarial example to bypass this CTF model classifierFind a jailbreak prompt injection for this LLM CTF challengeAnalyze this model's weights for a fine-tuning negation trick