CTF AI/ML

CTF-naslag voor ML-aanvallen: trucs met modelgewichten, adversarial examples, LLM-jailbreaks.

Door ljagiello · ljagiello/ctf-skills

Werkt met setup ★ 8.8/10

CTF AI/ML — CTF-naslag voor ML-aanvallen: trucs met modelgewichten, adversarial examples, LLM-jailbreaks.

Wat het doet

Quick-reference-subskill die AI/ML-aanvalstechnieken voor CTF-competities behandelt: analyse van modelgewichten (fine-tuning-negatie, LoRA-merging, model inversion), het genereren van adversarial examples (FGSM/PGD/C&W), en LLM-aanvallen (prompt injection, jailbreaking, token smuggling). Het is een van de acht categorieskills in de ljagiello/ctf-skills-repo, bedoeld om te worden aangeroepen door de solve-challenge-orchestrator van die repo, niet om volledig standalone te triggeren (frontmatter zet user-invocable: false). Gaat aan bij CTF-taken met ML-modelbestanden, adversarial robustness, of LLM-jailbreak-/prompt-injection-challenges.

Testrapport

Gaf de exacte closed-form-fix (2xW_orig - W_chal) met uitvoerbare code om een onderdrukte flag terug te halen, ver voorbij handmatig gewichten diffen. Is gemarkeerd als niet los aan te roepen, dus alleen deze map installeren triggert misschien nooit.

Getest op: 2026-07-10 · Claude Code 2.x (agent harness)

Installatie

git clone https://github.com/ljagiello/ctf-skills
cd ctf-skills
mkdir -p ~/.claude/skills
cp -r ctf-ai-ml ~/.claude/skills/ctf-ai-ml

Commando's en voorbeeldprompts

  • /ctf-ai-mlCTF-naslag voor ML-aanvallen: trucs met modelgewichten, adversarial examples, LLM-jailbreaks.

Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):

  • Craft an adversarial example to bypass this CTF model classifier
  • Find a jailbreak prompt injection for this LLM CTF challenge
  • Analyze this model's weights for a fine-tuning negation trick