CTF AI/ML

CTF-Referenz für ML-Angriffe: Model-Weight-Tricks, Adversarial Examples, LLM-Jailbreaks.

von ljagiello · ljagiello/ctf-skills

Funktioniert mit Setup ★ 8.8/10

CTF AI/ML — CTF-Referenz für ML-Angriffe: Model-Weight-Tricks, Adversarial Examples, LLM-Jailbreaks.

Was es kann

Kurzreferenz-Sub-Skill zu KI-/ML-Angriffstechniken für CTF-Wettbewerbe: Model-Weight-Analyse (Fine-Tuning-Negation, LoRA-Merging, Model-Inversion), Adversarial-Example-Generierung (FGSM/PGD/C&W) und LLM-Angriffe (Prompt Injection, Jailbreaking, Token Smuggling). Einer von acht Kategorie-Skills im Repo ljagiello/ctf-skills, gedacht zum Dispatch durch dessen Solve-Challenge-Orchestrator statt zur vollständig eigenständigen Auslösung (Frontmatter setzt user-invocable: false). Reagiert bei CTF-Aufgaben mit ML-Modelldateien, Adversarial Robustness oder LLM-Jailbreak-/Prompt-Injection-Challenges.

Testbericht

Lieferte die exakte geschlossene Formel (2xW_orig - W_chal) mit lauffähigem Code zum Wiederherstellen einer unterdrückten Flag, weit über das manuelle Diffen von Weights hinaus. Ist als allein nicht aufrufbar markiert, ein alleiniges Installieren dieses Ordners könnte daher nie auslösen.

Getestet am: 2026-07-10 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/ljagiello/ctf-skills
cd ctf-skills
mkdir -p ~/.claude/skills
cp -r ctf-ai-ml ~/.claude/skills/ctf-ai-ml

Befehle & Beispiel-Prompts

  • /ctf-ai-mlCTF-Referenz für ML-Angriffe: Model-Weight-Tricks, Adversarial Examples, LLM-Jailbreaks.

Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):

  • Craft an adversarial example to bypass this CTF model classifier
  • Find a jailbreak prompt injection for this LLM CTF challenge
  • Analyze this model's weights for a fine-tuning negation trick