ai-security

Assess AI/ML system security and map vulnerabilities to MITRE ATLAS techniques.

Updated Apr 2, 2026
One-click install
npx skills add https://github.com/4lerman/text_evaluator --skill ai-security-4lerman
Or copy as Structured Prompt for Agent
Please help me install this Agent Skill.
Skill: ai-security
Source: https://github.com/4lerman/text_evaluator/tree/main/.agents/skills/engineering-skills/ai-security
Command: npx skills add https://github.com/4lerman/text_evaluator --skill ai-security-4lerman

SYSTEM DOCUMENTATION & REQUIREMENTS

💡 This Skill requires ai_threat_scanner.py, and includes scripts (resource) and references (resource) components.

What problem does it solve?

This Skill addresses the critical need for assessing the security of AI/ML systems, ensuring they are resilient against attacks like prompt injection, jailbreaks, and data poisoning.

Core Features & Use Cases

  • AI/ML Security Assessment: Evaluates systems for vulnerabilities such as prompt injection, jailbreak attempts, model inversion risk, data poisoning, and agent tool abuse.
  • MITRE ATLAS Mapping: Provides detailed mapping of findings to MITRE ATLAS techniques for better understanding and addressing specific threats.
  • Risk Scoring and Recommendations: Offers comprehensive risk scoring and actionable recommendations for enhancing security measures.

Quick Start

Run the ai-security skill to scan the model for potential vulnerabilities.

Frequently Asked Questions about ai-security

High-intent search queries and answers about installing and using this skill.

FAQPage Schema
How do I assess AI and ML systems for prompt injection and jailbreak vulnerabilities?

Assessing AI and ML systems for prompt injection and jailbreak vulnerabilities involves running a comprehensive security evaluation that identifies these specific attack vectors. The assessment scans the model to detect attempts to bypass safety mechanisms and maps findings to known threat techniques.

What is MITRE ATLAS mapping in the context of AI security?

MITRE ATLAS mapping in AI security is the process of correlating identified vulnerabilities, such as model inversion or data poisoning, with standardized adversarial threat techniques. This mapping provides a structured framework for understanding and addressing specific system security risks.

Can I test for agent tool abuse and data poisoning in my ML models?

Yes, you can test for agent tool abuse and data poisoning in ML models through a dedicated AI security assessment. The evaluation specifically targets these vulnerabilities, providing risk scoring and actionable recommendations to enhance system protection against malicious inputs.

Does AI security testing require authorization before scanning?

Yes, AI security testing requires explicit authorization before conducting invasive scans. Because the assessment evaluates systems for vulnerabilities like prompt injection and model inversion, obtaining prior permission ensures the testing remains ethical and compliant.

How do I get risk scores and recommendations for AI model vulnerabilities?

To get risk scores and recommendations for AI model vulnerabilities, execute an AI security assessment that identifies threats like prompt injection and jailbreaks. The evaluation outputs comprehensive risk scores alongside actionable recommendations for enhancing security measures.