CTF AI/ML

CTF-referanse for ML-angrep: triks med modellvekter, adversarielle eksempler, LLM-jailbreaks.

av ljagiello · ljagiello/ctf-skills

Krever oppsett ★ 8.8/10

CTF AI/ML — CTF-referanse for ML-angrep: triks med modellvekter, adversarielle eksempler, LLM-jailbreaks.

Hva den gjør

Hurtigreferanse-underskill som dekker AI-/ML-angrepsteknikker for CTF-konkurranser: analyse av modellvekter (fine-tuning-negasjon, LoRA-sammenslåing, modellinversjon), generering av adversarielle eksempler (FGSM/PGD/C&W), og LLM-angrep (prompt-injeksjon, jailbreaking, token-smugling). Det er ett av åtte kategoriskills i ljagiello/ctf-skills-repoet, ment å bli dispatchet av det repoets solve-challenge-orkestrator fremfor å bli utløst helt frittstående (frontmatter setter user-invocable: false). Utløses på CTF-oppgaver som involverer ML-modellfiler, adversariell robusthet, eller LLM-jailbreak-/prompt-injeksjonsutfordringer.

Testrapport

Ga den eksakte lukket-form-fiksen (2xW_orig - W_chal) med kjørbar kode for å gjenopprette et undertrykt flagg, godt utover å diffe vekter for hånd. Det er merket som ikke-frittstående-kallbart, så å installere bare denne mappen vil kanskje aldri utløses.

Testet på: 2026-07-10 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/ljagiello/ctf-skills
cd ctf-skills
mkdir -p ~/.claude/skills
cp -r ctf-ai-ml ~/.claude/skills/ctf-ai-ml

Kommandoer og eksempelprompter

  • /ctf-ai-mlCTF-referanse for ML-angrep: triks med modellvekter, adversarielle eksempler, LLM-jailbreaks.

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Craft an adversarial example to bypass this CTF model classifier
  • Find a jailbreak prompt injection for this LLM CTF challenge
  • Analyze this model's weights for a fine-tuning negation trick