BigHugger
sk Skill · mukul975

detecting-model-extraction-attacks

Detect MITRE ATLAS AML.T0024 attacks (model stealing, inversion, membership inference) performed via inference-API abuse, by monitoring per-principal query volume/distribution, rate-limiting and perturbing outputs, and red-teaming your model's extractability. Use for a public or partner inference API needing cloning/inversion/membership-inference detection, or a pre-deployment red-team exercise to measure extraction…

installs 8w
0
30-day movement
starts with the next reading
Related entries
1
Connections
0
bashmlsecopsquery-monitoringPythonmitre-atlasmodel-inversioninference-apimembership-inferencemodel-extractionpythonai-security
Host repository
mukul975/Anthropic-Cybersecurity-Skills
Version
1.0
Licence
Apache-2.0
Host stars
33k
Host language
Python