AI/ML Attack Surface
Grep-driven checklista för ML-deserialisering, promptinjektion och laddning av opålitliga modeller
Testad · Fungerar
Vad den gör
En säkerhetsreferens i en fil som katalogiserar AI/ML-specifika sårbarhetsklasser (osäker torch/pickle/numpy deserialisering, promptinjektion, Jupyter notebook-injektion, laddning av opålitliga HuggingFace-modeller, träningsdataförgiftning) med CWE-mappningar, körklara grep-detektionskommandon och säkra alternativ per ramverk. Triggar vid AI-säkerhet, ML-pipeline-attack, promptinjektion, eller förfrågningar om osäker modelladdning.
Testrapport
Matade den en 29-radig fil med torch.load, pickle.load, np.load(allow_pickle=True) och ett f-sträng prompt-injektionsmönster; dess egen grep-batteri, körd i verkligheten, fångade alla 4 verkliga problem (det dedikerade prompt-injektions-regexet missade faktiskt fallet och det dök bara upp via det generiska messages/system grep — ett verkligt gap i dess egen föreslagna kommando) och mappade varje träff till en CWE plus ett konkret säkert alternativ (weights_only=True, skops.io, safetensors).
Testad: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/allsmog/vuln-scout cd vuln-scout mkdir -p ~/.claude/skills cp -r vuln-scout/skills/ai-ml-attacks ~/.claude/skills/ai-ml-attack-surface
Kommandon och exempelprompter
/ai-ml-attack-surfaceGrep-driven checklista för ML-deserialisering, promptinjektion och laddning av opålitliga modeller
Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):
Audit this ML codebase for unsafe model deserializationCheck our inference service for prompt-injection exposureScan this repo for untrusted pickle and model-loading risks