AI/ML Attack Surface

Grep-driven checklista för ML-deserialisering, promptinjektion och laddning av opålitliga modeller

av allsmog · allsmog/vuln-scout

Testad · Fungerar ★ 8.4/10

AI/ML Attack Surface — Grep-driven checklista för ML-deserialisering, promptinjektion och laddning av opålitliga modeller

Vad den gör

En säkerhetsreferens i en fil som katalogiserar AI/ML-specifika sårbarhetsklasser (osäker torch/pickle/numpy deserialisering, promptinjektion, Jupyter notebook-injektion, laddning av opålitliga HuggingFace-modeller, träningsdataförgiftning) med CWE-mappningar, körklara grep-detektionskommandon och säkra alternativ per ramverk. Triggar vid AI-säkerhet, ML-pipeline-attack, promptinjektion, eller förfrågningar om osäker modelladdning.

Testrapport

Matade den en 29-radig fil med torch.load, pickle.load, np.load(allow_pickle=True) och ett f-sträng prompt-injektionsmönster; dess egen grep-batteri, körd i verkligheten, fångade alla 4 verkliga problem (det dedikerade prompt-injektions-regexet missade faktiskt fallet och det dök bara upp via det generiska messages/system grep — ett verkligt gap i dess egen föreslagna kommando) och mappade varje träff till en CWE plus ett konkret säkert alternativ (weights_only=True, skops.io, safetensors).

Testad: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/allsmog/vuln-scout
cd vuln-scout
mkdir -p ~/.claude/skills
cp -r vuln-scout/skills/ai-ml-attacks ~/.claude/skills/ai-ml-attack-surface

Kommandon och exempelprompter

  • /ai-ml-attack-surfaceGrep-driven checklista för ML-deserialisering, promptinjektion och laddning av opålitliga modeller

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Audit this ML codebase for unsafe model deserialization
  • Check our inference service for prompt-injection exposure
  • Scan this repo for untrusted pickle and model-loading risks