AI/ML Attack Surface

Grep-drevet sjekkliste for ML deserialisering, prompt injeksjon, og ubetrodd modell lasting

av allsmog · allsmog/vuln-scout

Bestått ★ 8.4/10

AI/ML Attack Surface — Grep-drevet sjekkliste for ML deserialisering, prompt injeksjon, og ubetrodd modell lasting

Hva den gjør

En enkelt-fil sikkerhetsreferanse som katalogiserer AI/ML-spesifikke sårbarhetsklasser (usikker torch/pickle/numpy deserialisering, prompt injeksjon, Jupyter notebook injeksjon, ubetrodd HuggingFace modell lasting, treningsdata forgiftning) med CWE-mappinger, kjør-klar grep-deteksjonskommandoer, og trygge alternativer per rammeverk. Utløses ved AI-sikkerhet, ML pipeline angrep, prompt injeksjon, eller usikker modell lasting forespørsler.

Testrapport

Ga den en 29-linjers fil med torch.load, pickle.load, np.load(allow_pickle=True) og et f-string prompt-injeksjonsmønster; dens egen grep-batteri, kjørt for reelt, fanget alle 4 reelle problemer (den dedikerte prompt-injeksjons-regexen bommet faktisk på tilfellet og den dukket bare opp via den generiske messages/system grep — et reelt gap i dens egen foreslåtte kommando) og mappet hvert treff til en CWE pluss et konkret trygt alternativ (weights_only=True, skops.io, safetensors).

Testet på: 2026-07-14 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/allsmog/vuln-scout
cd vuln-scout
mkdir -p ~/.claude/skills
cp -r vuln-scout/skills/ai-ml-attacks ~/.claude/skills/ai-ml-attack-surface

Kommandoer og eksempelprompter

  • /ai-ml-attack-surfaceGrep-drevet sjekkliste for ML deserialisering, prompt injeksjon, og ubetrodd modell lasting

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Audit this ML codebase for unsafe model deserialization
  • Check our inference service for prompt-injection exposure
  • Scan this repo for untrusted pickle and model-loading risks