# Safety Scan > Escanea entradas en busca de prompt injection, contenido inseguro y ataques adversariales con AIDefence. Úsalo antes de pasar datos no confiables a un modelo o ejecutarlos. Fuente: https://skillsagentes.com/skills/ruvnet/ruflo/safety-scan Markdown: https://skillsagentes.com/skills/ruvnet/ruflo/safety-scan.md Repositorio: https://github.com/ruvnet/ruflo Autor: ruvnet Licencia: MIT Actualizado: el mes pasado Coste de contexto: 58 tok instalada, 411 tok al activarse, 411 tok con todos los archivos del bundle Bundle: 1 archivo, 2 KB Permisos que pide: mcp__plugin_ruflo-core_ruflo__aidefence_scan mcp__plugin_ruflo-core_ruflo__aidefence_analyze mcp__plugin_ruflo-core_ruflo__aidefence_is_safe mcp__plugin_ruflo-core_ruflo__aidefence_learn mcp__plugin_ruflo-core_ruflo__aidefence_stats bash ## Instalación Un skill son archivos markdown: los mismos archivos valen para cualquier agente y lo único que cambia es el directorio de destino, es decir la bandera `--agent`. Añade `-g` para instalarlo en todos los proyectos de la máquina. ```bash # Claude Code npx -y skills add ruvnet/ruflo --skill safety-scan --agent claude-code # Cursor npx -y skills add ruvnet/ruflo --skill safety-scan --agent cursor # Codex npx -y skills add ruvnet/ruflo --skill safety-scan --agent codex # Gemini CLI npx -y skills add ruvnet/ruflo --skill safety-scan --agent gemini # Windsurf npx -y skills add ruvnet/ruflo --skill safety-scan --agent windsurf # Cline npx -y skills add ruvnet/ruflo --skill safety-scan --agent cline ``` ## Qué hace - Escanea texto en busca de prompt injection, contenido inseguro y ataques adversariales usando AIDefence. - Ofrece una comprobación rápida (aidefence_is_safe), análisis detallado con clasificación de amenazas y confianza (aidefence_analyze), y escaneo completo multicapa (aidefence_scan). - Permite entrenar las defensas con amenazas confirmadas (aidefence_learn) y ver estadísticas de detección (aidefence_stats). ## Cuándo usarla - Antes de procesar entradas no confiables (envíos de usuarios, payloads de API, datos de webhook) que vayan a un modelo o a ejecución. ## Qué la activa - "Escanea esta entrada en busca de prompt injection antes de procesarla" - "¿Es seguro este payload del webhook?" ## Antes de instalar - Requiere las herramientas MCP aidefence_* del plugin ruflo-aidefence. ## Archivos - SKILL.md — 2 KB ## SKILL.md Reproducido tal cual desde ruvnet/ruflo bajo MIT. Esta sección es el documento original y está en inglés. # Safety Scan Scan content for prompt injection, jailbreak attempts, and unsafe patterns. ## When to use Before processing untrusted input (user submissions, API payloads, webhook data), scan it to detect prompt injection, adversarial content, or policy violations. ## Steps 1. **Quick safety check** — call `mcp__plugin_ruflo-core_ruflo__aidefence_is_safe` with the input text for a boolean safe/unsafe result 2. **Deep analysis** — call `mcp__plugin_ruflo-core_ruflo__aidefence_analyze` for detailed threat classification and confidence scores 3. **Full scan** — call `mcp__plugin_ruflo-core_ruflo__aidefence_scan` for comprehensive multi-layer scanning 4. **Train defenses** — call `mcp__plugin_ruflo-core_ruflo__aidefence_learn` with confirmed threats to improve detection 5. **View stats** — call `mcp__plugin_ruflo-core_ruflo__aidefence_stats` for detection rates and false positive metrics ## Threat categories - Prompt injection (direct and indirect) - Jailbreak attempts - Data exfiltration patterns - Instruction override attacks - Social engineering prompts ## Dónde encaja - Categoría: [Seguridad](https://skillsagentes.com/categorias/seguridad.md) — Auditorías, revisión de dependencias, manejo de secretos y modelado de amenazas. - Creador: [ruvnet](https://skillsagentes.com/creators/ruvnet.md) — 275 skills en el directorio - [Todas las skills](https://skillsagentes.com/skills.md) - [Ranking de instalaciones](https://skillsagentes.com/ranking.md) ## Otras skills del mismo repositorio - [Harness Gepa](https://skillsagentes.com/skills/ruvnet/ruflo/harness-gepa.md): Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución. - [Deepseek Reason](https://skillsagentes.com/skills/ruvnet/ruflo/deepseek-reason.md): Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde. - [Deepseek Chat](https://skillsagentes.com/skills/ruvnet/ruflo/deepseek-chat.md): Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento. - [Adr Index](https://skillsagentes.com/skills/ruvnet/ruflo/adr-index.md): Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP. - [Agntcy Status](https://skillsagentes.com/skills/ruvnet/ruflo/agntcy-status.md): Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado. --- Skills Agentes · [Índice de páginas en markdown](https://skillsagentes.com/sitemap.md) · [Inicio](https://skillsagentes.com/index.md)